Radar do FAROL8 notas

segunda-feira, 6 de julho de 2026

Modelos

Gemini 2.5 Pro com Deep Think

Deep Think mode, 82.4% GPQA, 89.8% MMLU-Pro, 2M token context.

Modelos · google-deepmind

Google adia Gemini 3.5 Pro para 17/07 com reconstrução arquitetural completa; êxodo do DeepMind já custou US$225bi em valor de mercado

Atualização da história do atraso do Gemini 3.5 Pro (já coberta em 25-26/06 como "adiado para julho"): agora há data específica, 17/07, e o motivo mudou de categoria — não é só polimento, é uma reconstrução arquitetural completa da 2.5 Pro, mirando raciocínio matemático, geração de cenas SVG e qualidade de imagem para competir com GPT-5.6 e Fable 5. O pano de fundo segue sendo a debandada de talentos sênior do DeepMind (Noam Shazeer para a OpenAI; John Jumper, Jonas Adler e Alexander Pritzel para a Anthropic em uma única semana) — que já teria apagado ~US$225 bilhões do valor de mercado da Alphabet.

Modelos · the-agent-report · google, deepmind, gemini-3-5-pro, talentos, shazeer, jumper

OpenAI lança gpt-realtime-2.1 e 2.1-mini: -25% de latência p95 para agentes de voz

A OpenAI lançou dois novos modelos Realtime — gpt-realtime-2.1 e gpt-realtime-2.1-mini — voltados a experiências de voz e multimodais de baixa latência, com pelo menos 25% de redução na latência p95 via cache aprimorado. O gpt-realtime-2.1 traz melhor reconhecimento alfanumérico, tratamento de silêncio/ruído e suporta interações speech-to-speech com esforço de raciocínio configurável.

Modelos · marktechpost · openai, gpt-realtime, voz, realtime-api, agentes-de-voz

ThinkingCap-Qwen3.6-27B: finetune foca em raciocínio econômico em tokens

Finetune do Qwen3.6-27B otimizado para "efficient-thinking" — reduzir a quantidade de tokens gastos em cadeias de raciocínio sem perder qualidade de resposta.

Modelos · web · qwen, finetune, raciocinio, eficiencia, open-weights

Ferramentas e código

ICML 2026 Seul Recorde; 60+ Agentic Workshops

23.918 submissões recorde. 60+ de 247 workshops sobre IA agentica (~24%).

Ferramentas e código · icml

Simon Willison leva sqlite-utils à v4.0 estável — escrita majoritariamente por um agente Claude Fable

Simon Willison relatou ter usado um agente Claude Fable (custo de ~US$149) para levar o sqlite-utils à sua primeira major version desde 2020 — o agente identificou sozinho bugs bloqueadores de release, incluindo uma falha crítica de commit em delete_where(), e a documentação final foi escrita em conjunto por Claude Fable 5, Claude Opus 4.8 e GPT-5.5.

Ferramentas e código · web · simon-willison, sqlite-utils, claude-fable, agentic-coding, python

Comunidade

China: Qwen (Alibaba) e Doubao (ByteDance) vão desativar criação de agentes de IA em 15/07

Alibaba (Qwen) e ByteDance (Doubao) vão suspender a criação de novos agentes de IA e desligar agentes já criados por usuários a partir de 15 de julho de 2026, em resposta à entrada em vigor de novas regras chinesas sobre serviços de interação antropomórfica com IA.

Comunidade · web · china, regulacao, qwen, doubao, alibaba, bytedance

NVIDIA rebate relatório da SemiAnalysis sobre atraso no roadmap de chips de IA

A NVIDIA reafirmou que seu roadmap de chips de IA segue no prazo, mantendo cadência quase anual para a próxima geração de processadores, após relatório da SemiAnalysis sugerir atrasos. Blackwell segue esgotado até meados de 2026.

Comunidade · web · nvidia, chips, blackwell, semianalysis, hardware