Radar do FAROL17 notas

quinta-feira, 21 de maio de 2026

Modelos

MiniCPM5-1B: modelo on-device com tool-calling e long-context

OpenBMB lançou MiniCPM5-1B, modelo de 1B parâmetros (arquitetura Llama) otimizado para dispositivos — tool-calling nativo, long-context, en/zh. Datasets: Ultra-FineWeb, UltraData-Math, UltraData-SFT-2605. 275 likes e trending score 240 na primeira semana. Bom candidato para PoCs locais em macOS/Apple Silicon.

Modelos · huggingface · openbmb, edge-ai, on-device, tool-calling, llama-arch, minicpm

MIT Tech Review: Code with Claude mostrou o futuro da engenharia de software (quer queira ou não)

Cobertura editorial do evento de Londres. MIT TR registra que quase metade da plateia já mergeou PR escrito 100% pelo Claude na última semana, e que a maior parte do código da Anthropic — incluindo o próprio Claude Code — hoje é escrita por Claude. Marco simbólico para a categoria.

Modelos · technology-review · anthropic, claude-code, engineering, future-of-work, mit-tr

PwC expande parceria com Anthropic — Claude no core de delivery global

PwC amplia a parceria com Anthropic para usar Claude na construção de tecnologia e execução de trabalho de cliente em escala global. Junto com o anúncio KPMG-Claude da manhã, sinaliza que o Big Four está consolidando Claude como stack padrão de consultoria.

Modelos · anthropic · anthropic, pwc, big-four, enterprise, consulting, claude

xAI lança grok-voice-think-fast-1.0 e APIs standalone de Speech-to-Text e TTS

Novo modelo de voice agent multi-step (suporte/vendas/enterprise), 25+ idiomas, baixa latência. APIs separadas de STT/TTS com diarização, timestamps, tags expressivas e clonagem de voz a partir de gravação curta. xAI vai atrás da pilha de voz enterprise — terreno até aqui dominado por ElevenLabs, Deepgram e OpenAI Realtime.

Modelos · xai-docs · xai, grok-voice, stt, tts, voice-agents, enterprise

PaddleOCR-VL — VLM SOTA para parsing de documentos (NaViT + ERNIE)

VLM combinando NaViT (resolução dinâmica) com ERNIE atinge SOTA em document parsing e reconhecimento de elementos com alta eficiência computacional. Direto relevante para pipelines de RAG sobre PDFs e processos administrativos.

Modelos · huggingface · vlm, ocr, document-parsing, rag, navit, ernie

Mistral Medium 3.5 vira default em Vibe e Le Chat — 77,6% no SWE-Bench Verified

Modelo denso de ~128B vira default em Vibe (coding agentic) e Le Chat. 77,6% no SWE-Bench Verified e esforço de raciocínio configurável por request — o mesmo modelo serve chat leve e runs agentic longos. Mistral consolida ecossistema coding open-weights soberano.

Modelos · marktechpost · mistral, medium-35, vibe, le-chat, swe-bench, coding-agent

Ferramentas e código

xAI lança Grok Build — CLI agentic de coding rival do Claude Code (SuperGrok Heavy, US$300/mês)

xAI entra de cabeça na arena de CLIs agentic com Grok Build — terminal-native, planeja projetos, edita arquivos, roda shell, monta apps a partir de prompt. Inicialmente exclusivo para SuperGrok Heavy (~US$300/mês). Pressão direta sobre Claude Code, Gemini Antigravity e Mistral Vibe.

Ferramentas e código · engadget · xai, grok-build, claude-code, gemini-cli, cli-agentic, coding-agent

OpenAI Codex CLI v0.133.0 — Goal Mode passa a default, com armazenamento e tracking turn-a-turn

OpenAI lançou Codex CLI v0.133.0 em 21/05 com Goal Mode habilitado por default. Adiciona armazenamento dedicado por goal, tracking de progresso turn-a-turn e melhor suporte a MCP. Parte do quarto release do mês que transforma Codex CLI em runtime persistente de agentes autônomos, ampliando paralelo direto com Claude Code e Dynamic Workflows da Anthropic.

Ferramentas e código · web-news · openai, codex-cli, goal-mode, agentes, dev-tools

Simon Willison melhora Datasette Agent para respostas truncadas

Simon Willison publicou patch no Datasette Agent (assistente AI sobre Datasette) para lidar com respostas truncadas de LLM — caso real onde o modelo cortou JSON no meio e o agente caiu silenciosamente. Solução envolve detectar truncamento, re-prompt automático e fallback gracioso. Padrão útil para qualquer pipeline com saída estruturada.

Ferramentas e código · simonwillison · datasette, simon-willison, llm-tools, robustness, agents

Pesquisa

PEEK — reuso persistente de orientação para agentes LLM em contextos recorrentes

Mapa de contexto persistente que permite a agentes LLM reusar conhecimento de orientação sobre contextos externos recorrentes. Corta custo computacional e melhora desempenho em tarefas repetitivas. Importante para o padrão "agente que volta ao mesmo sistema várias vezes".

Pesquisa · huggingface · agents, context-engineering, persistent-memory, llm, efficiency

LongLive-2.0 — geração de vídeo longo com paralelismo NVFP4

Infraestrutura paralela em precisão NVFP4 ataca os gargalos de treino e inferência de vídeo longo via treinamento autoregressivo sequence-parallel e fine-tuning de difusão. Move a fronteira do que é "minuto coerente" em vídeo gerado.

Pesquisa · huggingface · video-generation, nvfp4, sequence-parallel, diffusion, long-video

TideGS — 1B+ primitivos de 3D Gaussian Splatting treinados numa única GPU

Hierarquia SSD-CPU-GPU com block-virtualization, pipeline assíncrono e streaming diferencial permite treinar 3D Gaussian Splatting com mais de 1 bilhão de primitivos em uma única GPU. Salto de escala para reconstrução 3D em commodity hardware.

Pesquisa · huggingface · 3dgs, gaussian-splatting, single-gpu, ssd-streaming, reconstruction-3d

Comunidade

ChatGPT Ads aberto a todos: OpenAI lança self-serve Ads Manager com CPC bidding

OpenAI removeu o piso mínimo de gasto e abriu o Ads Manager para qualquer anunciante dos EUA, com CPC bidding e measurement tools. Parceiros incluem Dentsu, Omnicom, Publicis, WPP, Adobe, Criteo, Kargo, Pacvue, StackAdapt. Anúncios não influenciam outputs orgânicos.

Comunidade · openai · openai, ads, monetizacao, cpc

Fortune: Anthropic aterrissa em Londres enquanto coding por IA e suas ansiedades viram mainstream

Peça da Fortune cobre o desembarque europeu da Anthropic e o debate sobre o efeito da IA no mercado de engenharia de software no Reino Unido. Ângulo de impacto trabalhista ganhando tração editorial — segunda peça importante do dia além da MIT Tech Review.

Comunidade · fortune · anthropic, london, software-engineering, future-of-work, fortune, europa

TechCrunch: Google tenta empurrar ecossistema de agentes para consumidor que talvez não queira comprar

Análise crítica do pitch agentic do Google I/O 2026 (Gemini Omni, Spark, Antigravity 2.0). TechCrunch argumenta que a aposta esbarra em ceticismo do consumidor final. Contraponto editorial importante ao hype do I/O.

Comunidade · techcrunch · google, gemini-spark, antigravity, consumer-ai, skepticism, counter-narrative

Alpha Compute ativa ALPHA-01 no Canadá com 504 GPUs B200 e pipeline de US$200M+

Update mid-Q2 da Alpha Compute — ALPHA-01 entra em operação com 504 GPUs B200, primeiro cliente enterprise ativo, US$21M projetados em 12 meses e pipeline qualificado de US$200M+ em AI research, enterprise e sovereign workloads. Sinal de que neoclouds sub-escala continuam capturando demanda mesmo com hyperscalers expandindo.

Comunidade · stocktitan · neocloud, b200, sovereign-ai, canada, gpu-infrastructure, capex

Casa Branca arquiva Executive Order de revisão pré-lançamento de IA de fronteira

Draft de EO que estabeleceria revisão voluntária de 90 dias pré-lançamento para modelos de fronteira, com participação da NSA em testes classificados, foi engavetado em 21/05. Reportagem aponta que Sacks, Musk e Zuckerberg falaram diretamente com Trump fora do processo normal de policy. Sinaliza recuo claro do governo federal em red-teaming obrigatório justo na semana em que o Glasswing comprova que modelos atuais já encontram zero-days em massa. Labs perdem incentivo regulatório para auto-disclosure; democratas devem usar para campanha midterm.

Comunidade · Build Fast with AI · white-house, executive-order, frontier-models, nsa, trump, musk