# Radar do FAROL · domingo, 26 de abril de 2026

26 notícias. Dados: https://radar.farolia.org/dados/dia/2026-04-26.json

## Modelos

- **[OpenAI abandona SWE-bench Verified e recomenda que outros labs façam o mesmo](https://openai.com/index/why-we-no-longer-evaluate-swe-bench-verified/)** (Modelos; OpenAI / Hacker News). OpenAI auditou 27,6% do SWE-bench Verified e encontrou que 59,4% dos problemas auditados têm testes defeituosos que rejeitam soluções corretas. Além disso, como os problemas vêm de repos open-source usados em treino, todos os modelos frontier conseguem reproduzir o fix humano original — tornando o benchmark inútil para medir progresso real. OpenAI recomenda migrar para SWE-bench Pro.
- **[xAI e Mistral discutem parceria para rivalizar OpenAI e Anthropic](https://www.euronews.com/next/2026/04/24/elon-musks-xai-discussed-partnership-with-mistral-to-try-and-rival-openai-and-anthropic-re)** (Modelos; Euronews). xAI de Elon Musk discute parceria estratégica com Mistral AI para criar frente competitiva contra OpenAI e Anthropic. Conversas incluiriam possível envolvimento do Cursor. Também lançou Grok Voice com agente de voz de baixa latência e suporte multilíngue.
- **[GPT-5.5 supera levemente Claude Mythos Preview no Terminal-Bench 2.0](https://venturebeat.com/ai/openais-gpt-5-5-is-here-and-its-no-potato-narrowly-beats-anthropics-claude-mythos-preview-on-terminal-bench-2-0)** (Modelos; VentureBeat). VentureBeat reporta que o GPT-5.5 da OpenAI supera por margem estreita o Claude Mythos Preview da Anthropic no Terminal-Bench 2.0 — um benchmark mais recente que substitui o controverso SWE-bench. A corrida por supremacia em coding continua acirrada.
- **[Meta agenda LlamaCon para 29 de abril e anuncia Llama Impact Grants](https://ai.meta.com/blog/llamacon-llama-news/)** (Modelos; Meta AI Blog). Meta marcou a LlamaCon para 29 de abril e anunciou 10 novos recipientes do segundo ciclo do Llama Impact Grants, programa de apoio a projetos que usam modelos Llama para impacto social.
- **[Mistral lança Voxtral TTS — text-to-speech com clonagem de voz zero-shot](https://mistral.ai/news/voxtral-tts)** (Modelos; Mistral AI). Mistral AI lançou Voxtral TTS, modelo text-to-speech com clonagem de voz zero-shot, suporte multilíngue e streaming em tempo real. Primeiro modelo de voz da Mistral, ampliando seu portfólio para além de texto.
- **[Benchmark detalhado: Claude Opus 4.6 vs 4.7 — effort levels e prompt steering](https://ai.georgeliu.com/p/claude-opus-46-vs-opus-47-effort)** (Modelos; George Liu AI Blog / Hacker News). Comparação técnica detalhada entre Opus 4.6 e 4.7 focando em effort levels e capacidade de steering via prompt. Útil para quem está decidindo qual modelo usar em pipelines de produção.
- **[Google DeepMind lança Gemini Robotics-ER 1.6 com raciocínio espacial aprimorado](https://deepmind.google/blog/gemini-robotics-er-1-6/)** (Modelos; Google DeepMind). Google DeepMind lançou Gemini Robotics-ER 1.6 com raciocínio espacial e físico aprimorado para aplicações robóticas, melhorando capacidades de apontamento, contagem e interação com o ambiente físico.
- **[Anthropic + NEC: 30.000 engenheiros com Claude Code no Japão](https://www.anthropic.com/news/anthropic-nec)** (Modelos; Anthropic / NEC). NEC torna-se primeiro parceiro global japonês da Anthropic. 30.000 funcionários do grupo NEC terão acesso ao Claude Code. Foco em finanças, manufatura e governo local.

## Ferramentas e código

- **[Claude Platform on AWS: plataforma nativa da Anthropic dentro da AWS (coming soon)](https://aws.amazon.com/claude-platform/)** (Ferramentas e código; AWS). AWS prepara lançamento do Claude Platform — acesso direto à experiência nativa da Anthropic (console, APIs, features) via conta AWS, com billing unificado, IAM, CloudTrail e sem necessidade de conta Anthropic separada. Deepening da parceria de $5B+ entre as empresas.
- **[NARE: framework que 'cristaliza' raciocínio de LLMs em scripts Python rápidos](https://github.com/starface77/Neuro-Adaptive-Reasoning-Engine)** (Ferramentas e código; GitHub / Hacker News). Framework Neuro-Adaptive Reasoning Engine converte processos de raciocínio de LLMs em código Python executável e otimizado, prometendo performance superior para tarefas repetitivas.
- **[Simon Willison publica guia de prompting para GPT-5.5](https://simonwillison.net/2026/Apr/25/gpt-5-5-prompting-guide/)** (Ferramentas e código; Simon Willison's Blog). Simon Willison analisa o guia oficial de prompting do GPT-5.5 da OpenAI. Destaque: não reutilizar prompts antigos — começar do zero. GPT-5.5 lida melhor com tarefas ambíguas e multi-step sem microgerenciamento.
- **[Archon v2: harness builder open-source para agentes de código IA](https://github.com/coleam00/Archon)** (Ferramentas e código; GitHub / coleam00). Archon v2 é o primeiro framework open-source para construir harnesses de agentes de código IA. Workflows em YAML tornam Claude Code e Codex determinísticos e reproduzíveis. 17K+ stars no GitHub.
- **[Hash anchors + Myers diff: técnica reduz custo de edições de código por IA em 60%](https://dirac.run/posts/hash-anchors-myers-diff-single-token)** (Ferramentas e código; Dirac.run / Hacker News). Técnica combina hash anchors, Myers diff e single-token anchors para reduzir em 60% o consumo de tokens em edições de código assistidas por IA. Otimização prática para pipelines de AI-assisted coding.
- **[Simon Willison: LiteParse — extração de PDF direto no navegador](https://simonwillison.net/2026/Apr/23/litepars/)** (Ferramentas e código; Simon Willison Blog). Simon Willison apresenta o LiteParse for the Web, ferramenta que permite extrair texto de PDFs diretamente no navegador sem necessidade de servidor ou upload para APIs externas.
- **[LarQL: consulte pesos de redes neurais como banco de dados de grafos](https://github.com/chrishayuk/larql)** (Ferramentas e código; GitHub / Hacker News). Ferramenta open-source que permite consultar pesos de redes neurais usando conceitos de bancos de dados de grafos, facilitando introspecção e análise de modelos.

## Pesquisa

- **[Pesquisadores alcançam eficiência energética 100x em IA com redes neurais + raciocínio simbólico](https://www.sciencedaily.com/releases/2026/04/260405003952.htm)** (Pesquisa; ScienceDaily). Pesquisadores demonstraram abordagem que reduz consumo de energia de sistemas de IA em até 100x combinando redes neurais com raciocínio simbólico. Avanço importante para sustentabilidade de data centers.
- **[Paper: Multi-User Large Language Model Agents — desafios de coordenação e privacidade](https://hf.co/papers/2604.08567)** (Pesquisa; HuggingFace Papers). Paper de abril de 2026 explora os desafios de agentes LLM multi-usuário: objetivos conflitantes, preservação de privacidade entre usuários e eficiência na coordenação de múltiplos agentes simultâneos.
- **[Survey: fronteiras do raciocínio em LLMs (inference scaling, agentic systems)](https://hf.co/papers/2504.09037)** (Pesquisa; HuggingFace Papers). Survey abrangente categoriza métodos de raciocínio em LLMs: inference-time scaling, learning-to-reason (SFT, RL, PPO, GRPO), e sistemas agênticos compostos com ferramentas externas e multi-agentes.
- **[Paper: Quando LLMs conseguem aprender a raciocinar com supervisão fraca?](https://salmanrahman.net/rlvr-weak-supervision)** (Pesquisa; Hacker News / salmanrahman.net). Pesquisa explora as condições sob as quais LLMs conseguem efetivamente aprender capacidades de raciocínio a partir de dados com supervisão fraca (weak supervision), com implicações para redução de custo de treinamento.

## Mercado

- **[Google planeja investir até US$ 40 bilhões na Anthropic](https://www.bloomberg.com/news/articles/2026-04-24/google-plans-to-invest-up-to-40-billion-in-anthropic)** (Mercado; Bloomberg). Google anunciou planos de investir até US$ 40 bilhões na Anthropic, com US$ 10 bilhões iniciais já confirmados. Maior rodada de investimento em IA da história, reforçando a aposta do Google em modelos de fronteira.

## Comunidade

- **[Snap demite ~1000 funcionários; IA já gera 65% do código novo da empresa](https://www.crescendo.ai/news/latest-ai-news-and-updates)** (Comunidade; Crescendo AI / múltiplas fontes). CEO da Snap Evan Spiegel anuncia demissão de ~1000 funcionários citando avanços em IA. A empresa revela que IA já gera mais de 65% do código novo e projeta economia de $500M anualizados até o 2º semestre de 2026. Caso concreto de substituição de desenvolvedores por IA.
- **[Análise independente aponta 'erro fatal' no argumento da Anthropic sobre SWE-bench](https://www.philosophicalhacker.com/post/anthropic-error/)** (Comunidade; Philosophical Hacker / Hacker News). Blog post no Hacker News aponta erro fundamental no argumento da Anthropic de que as melhorias do Mythos no SWE-bench são genuínas. A guerra de benchmarks entre OpenAI e Anthropic esquenta — ambos os lados questionam a validade das métricas do outro.
- **[Geoffrey Hinton na ONU: hora de frear a IA descontrolada](https://news.un.org/en/story/2026/04/1167361)** (Comunidade; UN News / Digital World Conference). Geoffrey Hinton, Nobel e 'padrinho da IA', alerta na conferência DWC da ONU que IA sem regulação é como 'carro veloz sem volante'. Estima que apenas 1% do trabalho em IA é dedicado a segurança.
- **[Tendência: programadores seniores voltam ao código manual por dúvidas sobre ferramentas IA](https://x.com/i/trending/2048161728521798035)** (Comunidade; X/Twitter trending / Hacker News). Tópico trending no X e Hacker News: programadores seniores estão voltando a escrever código manualmente por preocupações com confiabilidade de ferramentas de IA. Contrasta com Snap demitindo 1000 porque IA gera 65% do código.
- **[Claude atrai os usuários mais ricos entre assistentes de IA (Epoch AI)](https://epoch.ai/data-insights/service-by-income)** (Comunidade; Epoch AI / The Decoder). Survey Epoch AI/Ipsos: 80% dos usuários semanais do Claude nos EUA vivem em domicílios com renda >= $100K/ano (vs. 37% do Meta AI, 50% média nacional). Claude é o assistente de IA mais 'premium'.
- **[Advogado suspenso após 57 citações defeituosas incluindo 20 alucinações de IA em petição](https://www.transparencycoalition.ai/news/ai-legislative-update-april24-2026)** (Comunidade; Transparency Coalition AI). Suprema Corte de Nebraska suspendeu advogado Greg Lake após petição com 57 citações defeituosas, incluindo 20 alucinações de IA. No Q1 2026, tribunais dos EUA aplicaram pelo menos $145K em multas a advogados por erros de citação com IA.
