# Radar do FAROL · segunda-feira, 6 de julho de 2026

8 notícias. Dados: https://radar.farolia.org/dados/dia/2026-07-06.json

## Modelos

- **[Gemini 2.5 Pro com Deep Think](https://blog.google/technology/ai/gemini-2-5-pro/)** (Modelos; google-deepmind). Deep Think mode, 82.4% GPQA, 89.8% MMLU-Pro, 2M token context.
- **[Google adia Gemini 3.5 Pro para 17/07 com reconstrução arquitetural completa; êxodo do DeepMind já custou US$225bi em valor de mercado](https://the-agent-report.com/2026/07/google-gemini-3-5-pro-delayed-july-2026/)** (Modelos; the-agent-report). Atualização da história do atraso do Gemini 3.5 Pro (já coberta em 25-26/06 como "adiado para julho"): agora há data específica, 17/07, e o motivo mudou de categoria — não é só polimento, é uma reconstrução arquitetural completa da 2.5 Pro, mirando raciocínio matemático, geração de cenas SVG e qualidade de imagem para competir com GPT-5.6 e Fable 5. O pano de fundo segue sendo a debandada de talentos sênior do DeepMind (Noam Shazeer para a OpenAI; John Jumper, Jonas Adler e Alexander Pritzel para a Anthropic em uma única semana) — que já teria apagado ~US$225 bilhões do valor de mercado da Alphabet.
- **[OpenAI lança gpt-realtime-2.1 e 2.1-mini: -25% de latência p95 para agentes de voz](https://www.marktechpost.com/2026/07/06/openai-gpt-realtime-2-1-mini-reasoning-realtime-api/)** (Modelos; marktechpost). A OpenAI lançou dois novos modelos Realtime — gpt-realtime-2.1 e gpt-realtime-2.1-mini — voltados a experiências de voz e multimodais de baixa latência, com pelo menos 25% de redução na latência p95 via cache aprimorado. O gpt-realtime-2.1 traz melhor reconhecimento alfanumérico, tratamento de silêncio/ruído e suporta interações speech-to-speech com esforço de raciocínio configurável.
- **[ThinkingCap-Qwen3.6-27B: finetune foca em raciocínio econômico em tokens](https://hf.co/bottlecapai/ThinkingCap-Qwen3.6-27B)** (Modelos; web). Finetune do Qwen3.6-27B otimizado para "efficient-thinking" — reduzir a quantidade de tokens gastos em cadeias de raciocínio sem perder qualidade de resposta.

## Ferramentas e código

- **[ICML 2026 Seul Recorde; 60+ Agentic Workshops](https://icml.cc/)** (Ferramentas e código; icml). 23.918 submissões recorde. 60+ de 247 workshops sobre IA agentica (~24%).
- **[Simon Willison leva sqlite-utils à v4.0 estável — escrita majoritariamente por um agente Claude Fable](https://simonwillison.net/2026/jul/5/sqlite-utils-fable/)** (Ferramentas e código; web). Simon Willison relatou ter usado um agente Claude Fable (custo de ~US$149) para levar o sqlite-utils à sua primeira major version desde 2020 — o agente identificou sozinho bugs bloqueadores de release, incluindo uma falha crítica de commit em delete_where(), e a documentação final foi escrita em conjunto por Claude Fable 5, Claude Opus 4.8 e GPT-5.5.

## Comunidade

- **[China: Qwen (Alibaba) e Doubao (ByteDance) vão desativar criação de agentes de IA em 15/07](https://technode.com/2026/07/06/bytedances-doubao-and-alibabas-qwen-to-shut-down-ai-agent-features-on-july-15/)** (Comunidade; web). Alibaba (Qwen) e ByteDance (Doubao) vão suspender a criação de novos agentes de IA e desligar agentes já criados por usuários a partir de 15 de julho de 2026, em resposta à entrada em vigor de novas regras chinesas sobre serviços de interação antropomórfica com IA.
- **[NVIDIA rebate relatório da SemiAnalysis sobre atraso no roadmap de chips de IA](https://www.roic.ai/news/nvidia-reaffirms-ai-chip-roadmap-rejects-delay-reports-07-06-2026)** (Comunidade; web). A NVIDIA reafirmou que seu roadmap de chips de IA segue no prazo, mantendo cadência quase anual para a próxima geração de processadores, após relatório da SemiAnalysis sugerir atrasos. Blackwell segue esgotado até meados de 2026.
