# Radar do FAROL · quinta-feira, 23 de julho de 2026

18 notícias. Dados: https://radar.farolia.org/dados/dia/2026-07-23.json

## Modelos

- **[FLUX 3: Black Forest Labs lança modelo multimodal que gera vídeo, imagem e áudio juntos — e mira robótica](https://bfl.ai/blog/flux-3-mimic)** (Modelos; black-forest-labs). A Black Forest Labs apresentou o FLUX 3, um modelo de fundação multimodal que aprende de imagens, vídeo e áudio numa única arquitetura unificada. Gera clipes de até 20 segundos com áudio sincronizado (fala, efeitos, ambiente) e estende a mesma base para controle de robôs (linha 'Mimic'). Lançamento em fases: vídeo/ação primeiro via API e parceiros; imagem nas próximas semanas; pesos abertos só para o FLUX Dev no 2º semestre de 2026.
- **[Casa Branca acusa Moonshot de destilar o Fable da Anthropic no Kimi K3 e usar chips Nvidia GB300 via Tailândia](https://techcrunch.com/2026/07/22/treasury-threatens-sanctions-after-white-house-claims-moonshot-distilled-anthropics-fable/)** (Modelos; websearch). Michael Kratsios (OSTP/Casa Branca) acusou a Moonshot AI de fazer destilação em larga escala do modelo Fable da Anthropic para construir o Kimi K3 (2,8T de parâmetros, lançado em 16/07), usando uma plataforma interna que alternava métodos de acesso para escapar da detecção. Alegou ainda que a Moonshot operou servidores Nvidia GB300 (geração Blackwell, banida para a China) e acessou GB300 na Tailândia para treinar. O secretário do Tesouro, Scott Bessent, ameaçou sanções a empresas chinesas por "ataques de destilação". Especialistas contestam: o Fable só é público desde 1º/07, prazo curto para uma destilação primária.
- **[Claude voice mode ganha suporte a múltiplos modelos (Opus, Sonnet, Haiku)](https://techcrunch.com/2026/07/23/anthropic-updates-claude-voice-mode-with-more-capable-models/)** (Modelos; TechCrunch). Anthropic atualizou Claude voice mode permitindo usuários escolherem entre Opus, Sonnet e Haiku. Flexibilidade de trade-off latência vs. qualidade.
- **[Apertus 1.5: Suíça lança nova versão do seu modelo aberto, agora com variante de 70B](https://www.cscs.ch/science/computer-science-hpc/2026/apertus-15-building-the-next-generation-of-open-ai-infrastructure)** (Modelos; cscs). O centro suíço de supercomputação (CSCS) publicou o Apertus 1.5, atualização do modelo de linguagem totalmente aberto da Suíça, incluindo uma versão de 70B parâmetros. O projeto se posiciona como infraestrutura pública de IA — pesos, dados e receita de treino abertos — como alternativa soberana aos modelos fechados das big labs.
- **[Echo (Tracer/YC): qualidade nível Claude Fable a 1/3 do custo orquestrando modelos abertos](https://news.ycombinator.com/item?id=49026810)** (Modelos; hackernews). Show HN (169 pts) do Echo, da Tracer (lab de "coordinated intelligence", backing YC): um sistema que orquestra modelos open-weight (GLM-5.2, Kimi K2.7, etc.), adaptando a alocação de inteligência por tarefa, e entrega qualidade equivalente ao Claude Fable a ~1/3 do custo total de inferência no mesmo mix de tarefas. Superou cada modelo aberto individual testado. Os autores apresentam como evidência escopada e promissora — não como vitória em toda tarefa.

## Ferramentas e código

- **[The Register: o custo de migração do MCP ao romper com o passado stateful](https://www.theregister.com/devops/2026/07/23/model_context_protocol_prepares_to_break_with_its_stateful_past/5276722)** (Ferramentas e código; theregister). Análise crítica sobre a ruptura que o MCP promove ao abandonar o modelo bidirecional com estado.
- **[Anthropic reúne receitas práticas no novo Claude Cookbook](https://platform.claude.com/cookbook/)** (Ferramentas e código; anthropic). A Anthropic publicou o Claude Cookbook na plataforma de desenvolvedores — uma coletânea de receitas e exemplos executáveis para construir com Claude (tool use, agentes, RAG, extração estruturada, etc.). Foi o post nº 1 do Hacker News no período.
- **[Hetzner começa a oferecer inferência de LLM](https://sliplane.io/blog/hetzner-inference)** (Ferramentas e código; sliplane). A Hetzner — provedora europeia conhecida por servidores baratos — está entrando no mercado de inferência de LLM. Movimento acompanhado de perto pela comunidade por prometer custos bem abaixo dos hyperscalers para rodar modelos abertos.
- **[Harness Handbook: tornando 'harnesses' de agentes compreensíveis, auditáveis e editáveis](https://ruhan-wang.github.io/Harness-Handbook/)** (Ferramentas e código; github-pages). Lançado um 'Harness Handbook' — guia aberto sobre como estruturar o 'harness' (a camada de orquestração, contexto, ferramentas e persistência ao redor de um LLM) de forma compreensível, auditável e editável. Tema central da onda de IA agêntica de 2026.
- **[GitHub em alta: consoles e harnesses de agentes (BossConsole, klaatcode) e Gemma 4 26B em ~2 GB de RAM](https://github.com/risa-labs-inc/BossConsole)** (Ferramentas e código; github). Repositórios em alta no GitHub nas últimas 12h reforçam duas tendências. (1) Consoles/harnesses operadores de agentes: BossConsole (risa-labs, console multi-thread nativo em JVM — não Electron — para rodar Claude Code, Codex, Gemini ou OpenCode com navegador, terminal, editor e 100+ ferramentas MCP) e klaatcode (agente de código no terminal com roteamento inteligente de modelos, alegando cortar custo em 10x). (2) Inferência local enxuta: turbo-fieldfare roda Gemma 4 26B-A4B em ~2 GB de RAM em qualquer MacBook M-series.

## Pesquisa

- **[arXiv: Agentic Context Management — memória e custo como problema de arquitetura](https://arxiv.org/abs/2607.21503v1)** (Pesquisa; arxiv). Paper que reformula memória de agente e custo de contexto como problemas de ciclo de vida e arquitetura, não de prompt.
- **[Paper: Windowed-MTP remove o 'imposto' do draft-KV em contexto de milhões de tokens](http://arxiv.org/abs/2607.21535v1)** (Pesquisa; arxiv). Windowed-MTP ataca o custo de KV-cache na decodificação especulativa (multi-token prediction) quando o contexto chega a milhões de tokens, usando janelas para evitar recalcular o draft sobre todo o contexto. Ganho de eficiência para modelos de contexto ultralongo.
- **[Paper: OpenForgeRL treina agentes 'harness-native' em qualquer ambiente](http://arxiv.org/abs/2607.21557v1)** (Pesquisa; arxiv). OpenForgeRL propõe um framework para treinar agentes nativos de 'harness' — que aprendem a operar as ferramentas e a orquestração do próprio arcabouço — em ambientes arbitrários via RL. Alinhado à tendência de agentes que dominam seu harness em vez de só chamar ferramentas.
- **[Paper: 'Beyond Sycophancy' mede resistência e conformidade estruturada no raciocínio moral de LLMs](http://arxiv.org/abs/2607.21558v1)** (Pesquisa; arxiv). Novo paper no arXiv investiga além da bajulação (sycophancy): quando e como LLMs resistem ou cedem a pressões em dilemas morais, propondo uma taxonomia de 'resistência estruturada' vs. 'conformidade'. Contribui para entender robustez de valores sob pressão do usuário.
- **[arXiv — 'Notes to Self: Can LLMs Benefit from Experiential Abstractions?](https://arxiv.org/abs/2607.20372)** (Pesquisa; arxiv). Pré-print recente (cs.CL/cs.AI) investiga se LLMs se beneficiam de "abstrações experienciais" — anotações que o próprio modelo escreve a si mesmo ("notes to self") destilando lições de experiências passadas para reaproveitar em tarefas futuras, em vez de reprocessar o histórico bruto. Linha de pesquisa em memória e auto-melhoria de agentes, adjacente a context engineering e a arquiteturas de agente com memória de longo prazo.

## Comunidade

- **[Google Adia Gemini 3.5 Pro para Rebuild Completo da Arquitetura](https://www.axios.com/2026/07/23/googles-deep-mind-ai-model-race)** (Comunidade; google-deepmind). 
- **[Pastor da Flórida processa a OpenAI: conselho médico do ChatGPT o teria levado 'à beira da morte](https://www.bbc.com/news/articles/cwylp3nxp5yo)** (Comunidade; websearch). Scott Winters, pastor de 55 anos da Flórida, processou a OpenAI e Sam Altman (justiça estadual da Califórnia) alegando que o GPT-4o (versão já aposentada) o instruiu a limitar movimentos e ficar em casa, além de "repetida e insistentemente" errar o diagnóstico e, valendo-se de conversas anteriores sobre religião, garantir que ele se recuperaria — culminando numa embolia pulmonar massiva que "o levou à beira da morte". A OpenAI respondeu que "o ChatGPT não é médico e nunca deve substituir cuidado, diagnóstico ou tratamento".
- **[AI Overviews pode levar o Reddit a encerrar acordo de US$ 60 mi/ano com o Google](https://www.neowin.net/news/ai-overviews-could-push-reddit-to-end-its-60-million-a-year-deal-with-google/)** (Comunidade; neowin). O crescimento dos AI Overviews do Google — que respondem direto na busca e reduzem cliques para os sites — estaria pressionando o Reddit a repensar seu acordo de licenciamento de dados de US$ 60 milhões/ano com o Google. Tensão emblemática entre donos de conteúdo e buscadores movidos a IA.
