OpenAI Lança GPT-5.6 Lineup
Três tiers: Sol (flagship + Deep Think), Terra (50% mais barato), Luna (rápido).
Modelos · openai
Três tiers: Sol (flagship + Deep Think), Terra (50% mais barato), Luna (rápido).
Modelos · openai
Google DeepMind adiou Gemini 3.5 Pro para 17 de julho, abandonando arquitetura Gemini 2.5 Pro em favor de redesenho completo. Perda de talento acelera: Noam Shazeer para OpenAI, John Jumper para Anthropic.
Modelos · TechTimes · - Google
Modelos · web-search · - xai
A partir de hoje (08/07), entra em vigor a nova política de privacidade da Anthropic, que permite compartilhar conversas de usuários do Claude com autoridades policiais com base em "boa-fé" da empresa, sem exigir mandado ou ordem judicial. No mesmo pacote, a Anthropic passa a poder exigir documento de identidade com foto, selfie ao vivo e escaneamento facial de usuários do plano consumidor para manter acesso à plataforma.
Modelos · web · anthropic, claude, privacidade, politica, verificacao-identidade, regulacao
O Departamento de Comércio dos EUA liberou a OpenAI para lançar amplamente a família GPT-5.6 após período de preview limitado, sob pressão da administração Trump para acelerar o rollout. Os três modelos — Sol (flagship agêntico), Terra (custo-benefício) e Luna (rápido/barato) — ficam disponíveis globalmente a partir de 09/07.
Modelos · bloomberg · openai, gpt-5.6, lancamento, governo-eua, controle-exportacao
SpaceXAI (xAI) e Cursor lançaram publicamente o Grok 4.5, primeiro modelo desenvolvido em conjunto pelas duas empresas desde o acordo de US$10 bi entre elas — mirando tarefas de coding, finanças e jurídico. O modelo já roda dentro do Cursor e do Grok Build.
Modelos · bloomberg · xai, grok, cursor, spacexai, coding, juridico
A Mistral lançou o Robostral Navigate, modelo de navegação robótica que usa apenas uma câmera e comandos de linguagem simples, é agnóstico a hardware e foi treinado inteiramente por simulação — aposta da francesa em "IA física" para acompanhar a corrida por robótica.
Modelos · bloomberg · mistral, robotica, ia-fisica, navegacao, simulacao
A OpenAI publicou um plugin oficial que permite invocar o Codex de dentro do Claude Code para revisão de código ou delegação de tarefas, incluindo importador de sessões entre os dois agentes — sinal de interoperabilidade crescente entre ferramentas concorrentes de coding agêntico.
Ferramentas e código · github · openai, codex, claude-code, interoperabilidade, coding-agents
Harrison Chase (LangChain) anunciou o NemoClaw, combinando LangChain Deep Agents, NVIDIA Nemotron 3 Ultra e o runtime OpenShell, prometendo custo de inferência por execução até 10x menor que modelos fechados líderes — aposta em "sistema ao redor do modelo" (memória, ferramentas, avaliação) como diferencial competitivo.
Ferramentas e código · web · langchain, nvidia, nemoclaw, harrison-chase, agentes-empresariais, custo-de-inferencia
Harrison Chase (LangChain) anunciou parceria com a NVIDIA para o blueprint "NemoClaw for LangChain Deep Agents", voltado a ajudar empresas a construir, avaliar e implantar agentes abertos. Em fireside chat com Jensen Huang, Chase destacou memória, uso de ferramentas e avaliação como componentes tão importantes quanto o modelo em si — e observou publicamente a migração do mercado de frameworks de agentes para "harnesses" completos (DeepAgents, Claude Agent SDK, EVE).
Ferramentas e código · web · langchain, nvidia, deep-agents, harrison-chase, context-engineering, agentes-empresariais
Junto do lançamento do Grok 4.5, a xAI atualizou o Grok Build com comando `/goal`, fluxo `/sessions` renovado, melhor gestão de skills/plugins, execução bash/arquivo mais confiável e startup mais rápido em repositórios grandes — movimento competitivo direto contra Claude Code e Codex.
Ferramentas e código · web · xai, grok, grok-build, cli, agentes-de-codigo, claude-code
Context Engineering (design de contexto → LLM) substituiu prompt engineering. Fenômeno 'context rot' (performance degrada com contexto grande) mudou arquitetura de LLM systems.
Comunidade · Job Culture, LogRocket · context engineering, LLM best practices
Pesquisadores demonstraram o exploit "Friendly Fire": quando Claude Code (modo automático) e Codex CLI (auto-review) revisam repositórios não confiáveis, instruções escondidas em arquivos do repositório conseguem manipular o agente para executar código malicioso no host. Testado contra Sonnet 4.6/5, Opus 4.8 e GPT-5.5; classificado como falha de design, não bug pontual.
Comunidade · web · seguranca, prompt-injection, claude-code, codex-cli, agentes-de-codigo, falha-de-design
Reportagem cita que 30-46% do uso corporativo de tokens de IA nos EUA já vai para modelos chineses, 60-90% mais baratos que Anthropic/OpenAI. O GLM-5.2 teve a adoção mais rápida já rastreada pela Vercel em 2026, com volume diário de tokens crescendo ~27x e número de clientes ~80x na primeira semana — enquanto Tencent (Hy3) e Meituan (LongCat-2.0) lançam novos modelos MoE que já entram entre os mais "trending" do HuggingFace.
Comunidade · web · glm-5.2, modelos-chineses, tencent, meituan, custo-de-inferencia, market-share
Em artigo de opinião no Financial Times, Sam Altman propôs um fórum internacional liderado pelos EUA para definir padrões de segurança e acesso a IA — comparando com modelos como a aviação civil e a AIEA — enquanto negociações em curso dariam ao governo Trump uma participação de 5% na OpenAI.
Comunidade · web · sam-altman, geopolitica, regulacao, openai, governo-eua
Levantamento de discussões no Hacker News mostra que o eixo do debate sobre agentes de código amadureceu: menos "isso é hype?" e mais foco prático em preservação de contexto em sessões longas, inspeção de codebases reais sem desperdiçar recursos, composição com shell/sistemas externos e supervisão sem atrito.
Comunidade · web · hacker-news, agentes-de-codigo, contexto, confianca, engenharia-de-software