# Radar do FAROL · sábado, 9 de maio de 2026

27 notícias. Dados: https://radar.farolia.org/dados/dia/2026-05-09.json

## Modelos

- **[Anthropic apresenta Claude Dreaming: agentes que revisam o trabalho entre sessões](https://releasebot.io/updates/anthropic/claude)** (Modelos; web-search). Anthropic libera em research preview o Claude Dreaming: o sistema revisa o trabalho entre sessões, identifica padrões e atualiza arquivos com preferências do usuário e contexto.
- **[Anthropic investiga acesso nao-autorizado ao Claude Mythos via conta de contractor](https://www.bloomberg.com/news/articles/2026-05-08/anthropic-investigates-unauthorized-mythos-access)** (Modelos; bloomberg). Anthropic confirma que investiga acesso nao-autorizado ao Claude Mythos Preview por meio de uma conta de fornecedor (contractor). Bloomberg apurou que usuarios em forum privado conseguiram rodar prompts no modelo via credencial vazada. Mythos Preview e o frontier model com capacidades cyber de elite (encontrou RCE de 17 anos em FreeBSD/NFS sozinho). Caso reforca tese de que credenciais de terceiros sao o vetor mais fraco e levanta duvidas sobre os $100M em creditos do Project Glasswing prometidos a 40 organizacoes de software critico.
- **[xAI libera Grok 4.3 na API: 1M de contexto, vídeo nativo e $1.25/M tokens](https://help.apiyi.com/en/grok-4-3-release-xai-api-model-retirement-en.html)** (Modelos; web-search). Grok 4.3 entra disponível via API com raciocínio integrado, 1M de contexto, entrada nativa de vídeo e preço $1.25/M tokens — 8 modelos legados serão aposentados em 15/maio.
- **[OpenAI lança trio de voice models realtime: GPT-Realtime-2, Translate e Whisper](https://releasebot.io/updates/openai)** (Modelos; web-search). OpenAI adiciona à API três novos modelos de voz: GPT-Realtime-2 para raciocínio em voz, GPT-Realtime-Translate para tradução simultânea (70+ idiomas) e GPT-Realtime-Whisper para transcrição streaming.
- **[Gemini 3.1 Flash Lite entra em GA: foco em tarefas agentic de alto volume](https://www.neuralbuddies.com/p/ai-news-recap-may-8-2026)** (Modelos; web-search). Gemini 3.1 Flash Lite agora está em disponibilidade geral, otimizado para tarefas agentic de alto volume, tradução e custo-eficiência.
- **[Zyphra ZAYA1-8B aparece entre os top trending da Hugging Face](https://hf.co/Zyphra/ZAYA1-8B)** (Modelos; huggingface). Zyphra publicou o ZAYA1-8B em 4 de maio: 23.6K downloads, 295 likes, trending score 291 — entre os modelos open-weights mais quentes da semana.
- **[HiDream-O1-Image: novo modelo image-to-image em qwen3-vl trending no HuggingFace](https://hf.co/HiDream-ai/HiDream-O1-Image)** (Modelos; huggingface). HiDream-AI publicou em 8/5 o HiDream-O1-Image, modelo image-text-to-image construido sobre arquitetura qwen3-vl, licenca MIT. Trending score 97 no Hub apos 24h. Combina geracao + edicao de imagem em pipeline unificado. Concorrente direto do Z-Image e do Tongyi-MAI/Z-Image que vinha dominando o trending da semana.

## Ferramentas e código

- **[Claude desembarca no Microsoft 365: add-ins para Excel, PowerPoint, Word e Outlook](https://fortune.com/2026/05/05/anthropic-wall-street-financial-services-agents-jamie-dimon/)** (Ferramentas e código; web-search). Anthropic estende o Claude ao Microsoft 365 com add-ins para Excel, PowerPoint e Word, com Outlook a caminho — disputando o terreno do Copilot dentro do Office.
- **[GitHub lanca Spec-Kit: toolkit open-source para spec-driven development com agentes](https://www.marktechpost.com/2026/05/08/meet-github-spec-kit-an-open-source-toolkit-for-spec-driven-development-with-ai-coding-agents/)** (Ferramentas e código; marktechpost). GitHub anunciou em 8/5 o Spec-Kit, toolkit open-source para spec-driven development com agentes de codigo (Claude Code, Cursor, Copilot agent). Ideia: voce escreve uma spec executavel em YAML/Markdown, o kit gera testes, scaffolding e tasks que o agente segue de forma estruturada — em vez de prompt cru. Tenta resolver o problema de 'agent reviewer' nao saber se mudanca esta dentro do escopo.
- **[CISA + Five Eyes publicam advisory: 'Adocao Cuidadosa de IA Agentica' — rapido demais e perigoso](https://www.cisa.gov/news-events/cybersecurity-advisories/aa26-129a)** (Ferramentas e código; cisa). CISA, NSA, ASD ACSC (Australia), Centre for Cyber Security (Canada), NCSC-UK e NCSC-NZ publicaram advisory conjunto 'Careful Adoption of Agentic Artificial Intelligence (AI) Services'. Mensagem: agentes autonomos sao perigosos demais para rollout rapido em ambientes corporativos. Recomendam: sandboxing por padrao, principle-of-least-privilege em ferramentas, audit trail de toda chamada externa, kill-switch humano, threat-modeling especifico para prompt injection.
- **[ChatGPT Workspace Agents libera para Enterprise com EKM](https://openai.com/news/)** (Ferramentas e código; openai). OpenAI libera Workspace Agents — agentes corporativos repetitiveis cruzando ChatGPT e Slack — para ChatGPT Enterprise com Enterprise Key Management. Empurra OpenAI para o territorio que o Anthropic acabou de ocupar com Claude Managed Agents.
- **[Heretic 1.3 viraliza no r/LocalLLaMA: 273 upvotes em 7 horas](https://startupfortune.com/heretic-13-drew-273-points-on-localllama-in-seven-hours-and-the-reasons-why-tell-you-more-about-local-ais-real-problems-than-any-benchmark-comparison/)** (Ferramentas e código; reddit). Heretic 1.3, atualização de stack para rodar LLMs localmente, somou 273 upvotes e 47 comentários em 7 horas no r/LocalLLaMA — promete saídas reproduzíveis, benchmarking integrado e menor pico de VRAM.
- **[Simon Willison libera llm-gemini 0.31, llm-echo 0.5a0 e datasette-llm 0.1a7](https://simonwillison.net/)** (Ferramentas e código; blog). Simon Willison liberou em 5-7 de maio múltiplas releases: llm-gemini 0.31 (Gemini provider para o LLM CLI), llm-echo 0.5a0 (mock provider), datasette-llm 0.1a7 e datasette-referrer-policy 0.1.
- **[QwenPaw v1.1.6: assistente pessoal local-first com Mermaid, skill CLI e session titles](https://github.com/agentscope-ai/QwenPaw)** (Ferramentas e código; github). AgentScope (time da Alibaba) liberou em 9/5 a v1.1.6 do QwenPaw — assistente pessoal local-first construido em cima da familia Qwen3.6. Novidades: titulos de sessao gerados por LLM, dashboard de uso de tokens, render de diagramas Mermaid, CLI para instalar/desinstalar/testar skills, API de status de agente. Ponto importante: arquitetura modela colaboracao entre 'small + large' models — pequeno responde rapido, grande entra quando o pequeno declara incerteza.

## Pesquisa

- **[AI Co-Mathematician: paper do DeepMind sobre acelerar matematicos com IA agentica](https://arxiv.org/abs/2605.07011)** (Pesquisa; arxiv). Daniel Zheng, Ingrid von Glehn, Lars Buesing, Daniel M. Roy, Martin Wattenberg e outros publicaram em 8/5/2026 o paper 'AI Co-Mathematician: Accelerating Mathematicians with Agentic AI' (22 paginas, cs.AI). Apresenta agentes que conversam com matematicos profissionais durante a prova, gerenciam lemmas/conjecturas como contexto vivo, e recuperam literatura relevante. Continuacao da agenda Gemini Deep Think aplicada a matematica avancada.
- **[Google DeepMind: AlphaEvolve ganha atualizações para descobertas matemáticas e otimização](https://deepmind.google/blog/alphaevolve-impact/)** (Pesquisa; web-search). Em 7 de maio, Google introduziu atualizações no AlphaEvolve, agente de código baseado em Gemini que projeta algoritmos avançados — agora avança em problemas abertos de matemática/CS e otimiza algoritmos já em produção.
- **[ARGUS: paper apresenta benchmark AgentLure para prompt-injection contextual em agentes](https://arxiv.org/abs/2605.04321)** (Pesquisa; arxiv). Pesquisadores publicaram em 5/5 o paper ARGUS, que introduz o benchmark **AgentLure** capturando ataques de prompt-injection conscientes de contexto contra agentes de LLM (nao mais o ataque ingenuo, mas adversario que ja sabe a estrutura do prompt do sistema). Junto com o benchmark, o paper propoe uma defesa baseada em verificacao redundante por agente independente. Resultados sugerem que agentes hoje em producao falham em 60-80 porcento dos casos contextuais.
- **[VibeServe (arXiv 2605.06068): podem agentes de IA construir stacks completos de LLM serving?](https://arxiv.org/abs/2605.06068)** (Pesquisa; arxiv). Paper publicado em 7 de maio apresenta o VibeServe, primeiro loop agentic que gera stacks inteiros de LLM serving end-to-end — outer loop planeja designs, inner loop implementa, valida e mede performance.

## Mercado

- **[Moonshot AI levanta US$ 2 bilhões a US$ 20bi de valuation — pressão sobre o open source chinês](https://techstartups.com/2026/05/08/top-tech-news-today-may-8-2026/)** (Mercado; web-search). Moonshot AI (criadora do Kimi K2) levantou US$ 2 bilhões a um valuation reportado de US$ 20bi — sinal do apetite por modelos open-source chineses como alternativa mais barata aos frontier americanos.
- **[Sierra (Bret Taylor) levanta quase US$ 1 bilhão para agentes de atendimento](https://www.cnbc.com/2026/05/04/bret-taylor-sierra-fundraise-openai.html)** (Mercado; web-search). Sierra, startup de agentes de atendimento fundada pelo ex-co-CEO da Salesforce e atual chairman do board da OpenAI Bret Taylor, levanta cerca de US$ 1 bilhão na nova rodada — semana mais forte de funding em IA enterprise.

## Regulação e segurança

- **[Casa Branca prepara ordem executiva para auditar modelos de IA no estilo FDA](https://www.xloggs.com/2026/05/08/breaking-news-cyber-threats-2026-05-08-1700-pdt/)** (Regulação e segurança; web-search). Em 7 de maio, a Casa Branca anunciou planos de redigir uma ordem executiva para auditar novos modelos de IA — processo comparado à aprovação de drogas pelo FDA — em resposta direta ao Mythos da Anthropic, que encontra vulnerabilidades de rede.
- **[Anthropic abre programa público de bug bounty no HackerOne (US$ 100 a US$ 10K)](https://www.neuralbuddies.com/p/ai-news-recap-may-8-2026)** (Regulação e segurança; web-search). Anthropic abriu publicamente seu programa de bug bounty no HackerOne, com recompensas de US$ 100 a US$ 10.000 por vulnerabilidades reportadas.

## Comunidade

- **[Karpathy no AI Ascent: \"Software 3.0\" e a transição do vibe coding para agentic engineering](https://aintelligencehub.com/articles/karpathy-vibe-coding-to-agent-workflows-may-2026)** (Comunidade; web-search). No AI Ascent 2026 da Sequoia, Andrej Karpathy formaliza a ideia de \"Software 3.0\" — código escrito por prompts, contexto, agentes, ferramentas e verificação — e separa o vibe coding (raise the floor) do agentic engineering (manter qualidade profissional).
- **[NVIDIA ja passou de US$ 40B em investimentos AI em 2026](https://www.cnbc.com/2026/05/09/nvidia-embraces-ai-investor-topping-40-billion-in-equity-bets-2026.html)** (Comunidade; cnbc). Levantamento da CNBC: NVIDIA acumula US$ 40B+ em equity em 2026, financiando toda a cadeia de IA — US$ 30B em OpenAI, US$ 3.2B em Corning, US$ 2.1B em IREN — para garantir capacidade e bloquear concorrencia em silicio.
- **[Hassabis (DeepMind) prev AGI com 10x do impacto da Revolucao Industrial em 1/10 do tempo](https://finance.yahoo.com/news/demis-hassabis-predicts-agi-10x-143113425.html)** (Comunidade; yahoo-finance). Demis Hassabis (CEO DeepMind), no India AI Impact Summit, manteve a previsao de AGI em ~5 anos e disse que tera '10x o impacto da Revolucao Industrial em 1/10 do tempo'. Pediu guardrails cientificos urgentes e mais investimento em alinhamento.
- **[Andon Labs abre cafe rodado por IA em Stockholm — barista, caixa e estoque autonomos](https://simonwillison.net/2026/May/5/andon-labs-cafe/)** (Comunidade; simonwillison). Simon Willison cobriu em 5/5 a abertura do cafe da Andon Labs em Stockholm — operacao integral comandada por IA: braco robotico para preparar bebidas, kiosk com agente conversacional para atendimento, sistema de visao para gerenciar estoque, e integracao com Claude para resolver casos fora do script. Sem barista humano em horario comercial. Item ganha tracao porque toca em duas teses: 'agentes operam o mundo fisico' e 'IA substitui empregos de servico'.
- **[Meta testa internamente \"Hatch\": agente de IA sempre-ligado em Instagram e Facebook](https://www.neuralbuddies.com/p/ai-news-recap-may-8-2026)** (Comunidade; web-search). Meta está testando internamente um agente de IA sempre-ligado chamado Hatch, ancorado nos dados de Instagram e Facebook do usuário.
