Radar do FAROL16 notas

quarta-feira, 8 de julho de 2026

Modelos

OpenAI Lança GPT-5.6 Lineup

Três tiers: Sol (flagship + Deep Think), Terra (50% mais barato), Luna (rápido).

Modelos · openai

Google adia Gemini 3.5 Pro para 17 de julho; sofre êxodo de talentos para Anthropic

Google DeepMind adiou Gemini 3.5 Pro para 17 de julho, abandonando arquitetura Gemini 2.5 Pro em favor de redesenho completo. Perda de talento acelera: Noam Shazeer para OpenAI, John Jumper para Anthropic.

Modelos · TechTimes · - Google

Grok 4.5 — Frontier Model com Dev Surface Integrado

Modelos · web-search · - xai

Anthropic muda política de privacidade do Claude: repasse a autoridades sem mandado e verificação de identidade obrigatória

A partir de hoje (08/07), entra em vigor a nova política de privacidade da Anthropic, que permite compartilhar conversas de usuários do Claude com autoridades policiais com base em "boa-fé" da empresa, sem exigir mandado ou ordem judicial. No mesmo pacote, a Anthropic passa a poder exigir documento de identidade com foto, selfie ao vivo e escaneamento facial de usuários do plano consumidor para manter acesso à plataforma.

Modelos · web · anthropic, claude, privacidade, politica, verificacao-identidade, regulacao

OpenAI recebe aval para lançar GPT-5.6 (Sol, Terra, Luna) globalmente a partir de amanhã

O Departamento de Comércio dos EUA liberou a OpenAI para lançar amplamente a família GPT-5.6 após período de preview limitado, sob pressão da administração Trump para acelerar o rollout. Os três modelos — Sol (flagship agêntico), Terra (custo-benefício) e Luna (rápido/barato) — ficam disponíveis globalmente a partir de 09/07.

Modelos · bloomberg · openai, gpt-5.6, lancamento, governo-eua, controle-exportacao

Grok 4.5 sai do beta: xAI e Cursor lançam modelo conjunto para direito e finanças

SpaceXAI (xAI) e Cursor lançaram publicamente o Grok 4.5, primeiro modelo desenvolvido em conjunto pelas duas empresas desde o acordo de US$10 bi entre elas — mirando tarefas de coding, finanças e jurídico. O modelo já roda dentro do Cursor e do Grok Build.

Modelos · bloomberg · xai, grok, cursor, spacexai, coding, juridico

Mistral lança Robostral Navigate, modelo de navegação para robôs treinado só por simulação

A Mistral lançou o Robostral Navigate, modelo de navegação robótica que usa apenas uma câmera e comandos de linguagem simples, é agnóstico a hardware e foi treinado inteiramente por simulação — aposta da francesa em "IA física" para acompanhar a corrida por robótica.

Modelos · bloomberg · mistral, robotica, ia-fisica, navegacao, simulacao

Ferramentas e código

OpenAI lança plugin oficial para invocar o Codex a partir do Claude Code

A OpenAI publicou um plugin oficial que permite invocar o Codex de dentro do Claude Code para revisão de código ou delegação de tarefas, incluindo importador de sessões entre os dois agentes — sinal de interoperabilidade crescente entre ferramentas concorrentes de coding agêntico.

Ferramentas e código · github · openai, codex, claude-code, interoperabilidade, coding-agents

LangChain e NVIDIA lançam NemoClaw, blueprint de agentes empresariais 10x mais barato

Harrison Chase (LangChain) anunciou o NemoClaw, combinando LangChain Deep Agents, NVIDIA Nemotron 3 Ultra e o runtime OpenShell, prometendo custo de inferência por execução até 10x menor que modelos fechados líderes — aposta em "sistema ao redor do modelo" (memória, ferramentas, avaliação) como diferencial competitivo.

Ferramentas e código · web · langchain, nvidia, nemoclaw, harrison-chase, agentes-empresariais, custo-de-inferencia

LangChain e NVIDIA lançam NemoClaw, blueprint para Deep Agents empresariais

Harrison Chase (LangChain) anunciou parceria com a NVIDIA para o blueprint "NemoClaw for LangChain Deep Agents", voltado a ajudar empresas a construir, avaliar e implantar agentes abertos. Em fireside chat com Jensen Huang, Chase destacou memória, uso de ferramentas e avaliação como componentes tão importantes quanto o modelo em si — e observou publicamente a migração do mercado de frameworks de agentes para "harnesses" completos (DeepAgents, Claude Agent SDK, EVE).

Ferramentas e código · web · langchain, nvidia, deep-agents, harrison-chase, context-engineering, agentes-empresariais

Grok Build ganha comandos de agente e CLI mais robusta

Junto do lançamento do Grok 4.5, a xAI atualizou o Grok Build com comando `/goal`, fluxo `/sessions` renovado, melhor gestão de skills/plugins, execução bash/arquivo mais confiável e startup mais rápido em repositórios grandes — movimento competitivo direto contra Claude Code e Codex.

Ferramentas e código · web · xai, grok, grok-build, cli, agentes-de-codigo, claude-code

Comunidade

Context Engineering virou disciplina — 'prompt engineering' está morto (2026)

Context Engineering (design de contexto → LLM) substituiu prompt engineering. Fenômeno 'context rot' (performance degrada com contexto grande) mudou arquitetura de LLM systems.

Comunidade · Job Culture, LogRocket · context engineering, LLM best practices

"Friendly Fire": pesquisadores mostram agentes de código sendo sequestrados via prompt injection em revisão automática

Pesquisadores demonstraram o exploit "Friendly Fire": quando Claude Code (modo automático) e Codex CLI (auto-review) revisam repositórios não confiáveis, instruções escondidas em arquivos do repositório conseguem manipular o agente para executar código malicioso no host. Testado contra Sonnet 4.6/5, Opus 4.8 e GPT-5.5; classificado como falha de design, não bug pontual.

Comunidade · web · seguranca, prompt-injection, claude-code, codex-cli, agentes-de-codigo, falha-de-design

Modelos chineses (GLM-5.2, Hy3, LongCat-2.0) ganham fatia relevante do uso corporativo de IA nos EUA

Reportagem cita que 30-46% do uso corporativo de tokens de IA nos EUA já vai para modelos chineses, 60-90% mais baratos que Anthropic/OpenAI. O GLM-5.2 teve a adoção mais rápida já rastreada pela Vercel em 2026, com volume diário de tokens crescendo ~27x e número de clientes ~80x na primeira semana — enquanto Tencent (Hy3) e Meituan (LongCat-2.0) lançam novos modelos MoE que já entram entre os mais "trending" do HuggingFace.

Comunidade · web · glm-5.2, modelos-chineses, tencent, meituan, custo-de-inferencia, market-share

Altman propõe fórum internacional de IA liderado pelos EUA — e negocia fatia de 5% para o governo Trump

Em artigo de opinião no Financial Times, Sam Altman propôs um fórum internacional liderado pelos EUA para definir padrões de segurança e acesso a IA — comparando com modelos como a aviação civil e a AIEA — enquanto negociações em curso dariam ao governo Trump uma participação de 5% na OpenAI.

Comunidade · web · sam-altman, geopolitica, regulacao, openai, governo-eua

Hacker News muda o debate: de 'agentes de código funcionam?' para 'como confiar neles operacionalmente

Levantamento de discussões no Hacker News mostra que o eixo do debate sobre agentes de código amadureceu: menos "isso é hype?" e mais foco prático em preservação de contexto em sessões longas, inspeção de codebases reais sem desperdiçar recursos, composição com shell/sistemas externos e supervisão sem atrito.

Comunidade · web · hacker-news, agentes-de-codigo, contexto, confianca, engenharia-de-software