# Radar do FAROL · quinta-feira, 21 de maio de 2026

17 notícias. Dados: https://radar.farolia.org/dados/dia/2026-05-21.json

## Modelos

- **[MiniCPM5-1B: modelo on-device com tool-calling e long-context](https://huggingface.co/openbmb/MiniCPM5-1B)** (Modelos; huggingface). OpenBMB lançou MiniCPM5-1B, modelo de 1B parâmetros (arquitetura Llama) otimizado para dispositivos — tool-calling nativo, long-context, en/zh. Datasets: Ultra-FineWeb, UltraData-Math, UltraData-SFT-2605. 275 likes e trending score 240 na primeira semana. Bom candidato para PoCs locais em macOS/Apple Silicon.
- **[MIT Tech Review: Code with Claude mostrou o futuro da engenharia de software (quer queira ou não)](https://www.technologyreview.com/2026/05/21/1137735/anthropics-code-with-claude-showed-off-codings-future-whether-you-like-it-or-not/)** (Modelos; technology-review). Cobertura editorial do evento de Londres. MIT TR registra que quase metade da plateia já mergeou PR escrito 100% pelo Claude na última semana, e que a maior parte do código da Anthropic — incluindo o próprio Claude Code — hoje é escrita por Claude. Marco simbólico para a categoria.
- **[PwC expande parceria com Anthropic — Claude no core de delivery global](https://www.anthropic.com/news/pwc-expanded-partnership)** (Modelos; anthropic). PwC amplia a parceria com Anthropic para usar Claude na construção de tecnologia e execução de trabalho de cliente em escala global. Junto com o anúncio KPMG-Claude da manhã, sinaliza que o Big Four está consolidando Claude como stack padrão de consultoria.
- **[xAI lança grok-voice-think-fast-1.0 e APIs standalone de Speech-to-Text e TTS](https://docs.x.ai/developers/release-notes)** (Modelos; xai-docs). Novo modelo de voice agent multi-step (suporte/vendas/enterprise), 25+ idiomas, baixa latência. APIs separadas de STT/TTS com diarização, timestamps, tags expressivas e clonagem de voz a partir de gravação curta. xAI vai atrás da pilha de voz enterprise — terreno até aqui dominado por ElevenLabs, Deepgram e OpenAI Realtime.
- **[PaddleOCR-VL — VLM SOTA para parsing de documentos (NaViT + ERNIE)](https://huggingface.co/papers/date/2026-05-21)** (Modelos; huggingface). VLM combinando NaViT (resolução dinâmica) com ERNIE atinge SOTA em document parsing e reconhecimento de elementos com alta eficiência computacional. Direto relevante para pipelines de RAG sobre PDFs e processos administrativos.
- **[Mistral Medium 3.5 vira default em Vibe e Le Chat — 77,6% no SWE-Bench Verified](https://www.marktechpost.com/2026/05/02/mistral-ai-launches-remote-agents-in-vibe-and-mistral-medium-3-5-with-77-6-swe-bench-verified-score/)** (Modelos; marktechpost). Modelo denso de ~128B vira default em Vibe (coding agentic) e Le Chat. 77,6% no SWE-Bench Verified e esforço de raciocínio configurável por request — o mesmo modelo serve chat leve e runs agentic longos. Mistral consolida ecossistema coding open-weights soberano.

## Ferramentas e código

- **[xAI lança Grok Build — CLI agentic de coding rival do Claude Code (SuperGrok Heavy, US$300/mês)](https://www.engadget.com/2173482/xai-coding-agent-grok-build/)** (Ferramentas e código; engadget). xAI entra de cabeça na arena de CLIs agentic com Grok Build — terminal-native, planeja projetos, edita arquivos, roda shell, monta apps a partir de prompt. Inicialmente exclusivo para SuperGrok Heavy (~US$300/mês). Pressão direta sobre Claude Code, Gemini Antigravity e Mistral Vibe.
- **[OpenAI Codex CLI v0.133.0 — Goal Mode passa a default, com armazenamento e tracking turn-a-turn](https://codersera.com/blog/openai-may-2026-updates-roundup/)** (Ferramentas e código; web-news). OpenAI lançou Codex CLI v0.133.0 em 21/05 com Goal Mode habilitado por default. Adiciona armazenamento dedicado por goal, tracking de progresso turn-a-turn e melhor suporte a MCP. Parte do quarto release do mês que transforma Codex CLI em runtime persistente de agentes autônomos, ampliando paralelo direto com Claude Code e Dynamic Workflows da Anthropic.
- **[Simon Willison melhora Datasette Agent para respostas truncadas](https://simonwillison.net/2026/May/21/datasette-agent/)** (Ferramentas e código; simonwillison). Simon Willison publicou patch no Datasette Agent (assistente AI sobre Datasette) para lidar com respostas truncadas de LLM — caso real onde o modelo cortou JSON no meio e o agente caiu silenciosamente. Solução envolve detectar truncamento, re-prompt automático e fallback gracioso. Padrão útil para qualquer pipeline com saída estruturada.

## Pesquisa

- **[PEEK — reuso persistente de orientação para agentes LLM em contextos recorrentes](https://huggingface.co/papers/date/2026-05-21)** (Pesquisa; huggingface). Mapa de contexto persistente que permite a agentes LLM reusar conhecimento de orientação sobre contextos externos recorrentes. Corta custo computacional e melhora desempenho em tarefas repetitivas. Importante para o padrão "agente que volta ao mesmo sistema várias vezes".
- **[LongLive-2.0 — geração de vídeo longo com paralelismo NVFP4](https://huggingface.co/papers/date/2026-05-21)** (Pesquisa; huggingface). Infraestrutura paralela em precisão NVFP4 ataca os gargalos de treino e inferência de vídeo longo via treinamento autoregressivo sequence-parallel e fine-tuning de difusão. Move a fronteira do que é "minuto coerente" em vídeo gerado.
- **[TideGS — 1B+ primitivos de 3D Gaussian Splatting treinados numa única GPU](https://huggingface.co/papers/date/2026-05-21)** (Pesquisa; huggingface). Hierarquia SSD-CPU-GPU com block-virtualization, pipeline assíncrono e streaming diferencial permite treinar 3D Gaussian Splatting com mais de 1 bilhão de primitivos em uma única GPU. Salto de escala para reconstrução 3D em commodity hardware.

## Comunidade

- **[ChatGPT Ads aberto a todos: OpenAI lança self-serve Ads Manager com CPC bidding](https://openai.com/index/new-ways-to-buy-chatgpt-ads/)** (Comunidade; openai). OpenAI removeu o piso mínimo de gasto e abriu o Ads Manager para qualquer anunciante dos EUA, com CPC bidding e measurement tools. Parceiros incluem Dentsu, Omnicom, Publicis, WPP, Adobe, Criteo, Kargo, Pacvue, StackAdapt. Anúncios não influenciam outputs orgânicos.
- **[Fortune: Anthropic aterrissa em Londres enquanto coding por IA e suas ansiedades viram mainstream](https://fortune.com/2026/05/21/claude-code-london-anthropic-ai-software-engineering/)** (Comunidade; fortune). Peça da Fortune cobre o desembarque europeu da Anthropic e o debate sobre o efeito da IA no mercado de engenharia de software no Reino Unido. Ângulo de impacto trabalhista ganhando tração editorial — segunda peça importante do dia além da MIT Tech Review.
- **[TechCrunch: Google tenta empurrar ecossistema de agentes para consumidor que talvez não queira comprar](https://techcrunch.com/2026/05/21/google-is-pitching-an-ai-agent-ecosystem-to-consumers-who-may-not-buy-it/)** (Comunidade; techcrunch). Análise crítica do pitch agentic do Google I/O 2026 (Gemini Omni, Spark, Antigravity 2.0). TechCrunch argumenta que a aposta esbarra em ceticismo do consumidor final. Contraponto editorial importante ao hype do I/O.
- **[Alpha Compute ativa ALPHA-01 no Canadá com 504 GPUs B200 e pipeline de US$200M+](https://www.stocktitan.net/news/ALP/alpha-compute-corp-provides-mid-q2-2026-fmdx84xx7igd.html)** (Comunidade; stocktitan). Update mid-Q2 da Alpha Compute — ALPHA-01 entra em operação com 504 GPUs B200, primeiro cliente enterprise ativo, US$21M projetados em 12 meses e pipeline qualificado de US$200M+ em AI research, enterprise e sovereign workloads. Sinal de que neoclouds sub-escala continuam capturando demanda mesmo com hyperscalers expandindo.
- **[Casa Branca arquiva Executive Order de revisão pré-lançamento de IA de fronteira](https://www.buildfastwithai.com/blogs/ai-news-today-may-23-2026)** (Comunidade; Build Fast with AI). Draft de EO que estabeleceria revisão voluntária de 90 dias pré-lançamento para modelos de fronteira, com participação da NSA em testes classificados, foi engavetado em 21/05. Reportagem aponta que Sacks, Musk e Zuckerberg falaram diretamente com Trump fora do processo normal de policy. Sinaliza recuo claro do governo federal em red-teaming obrigatório justo na semana em que o Glasswing comprova que modelos atuais já encontram zero-days em massa. Labs perdem incentivo regulatório para auto-disclosure; democratas devem usar para campanha midterm.
