Radar do FAROL26 notas

segunda-feira, 25 de maio de 2026

Modelos

CVE-2026-28952: vulnerabilidade no kernel do macOS 26.5 descoberta por Claude

Apple credita Claude (Anthropic) como descobridor de uma vulnerabilidade de kernel no macOS 26.5 (CVE-2026-28952), reportada via responsible disclosure. Caso prático e citado de IA encontrando bug sério em código de produção de larga escala. Discussão no HN com 145 pontos sobre o que muda quando AI assistants viram parte rotineira do pipeline de security research.

Modelos · hackernews · claude, anthropic, security, apple, macos, cve

DeepSeek-Reasonix explode no Hacker News (577 pts, 243 coments) — coding agent DeepSeek-only com 99,82% de prefix-cache hit

Projeto open-source `esengine/DeepSeek-Reasonix` chegou ao topo do Hacker News no fim de semana (577 pontos, 243 comentários) — coding agent CLI engineered around prefix-cache stability, deliberadamente DeepSeek-only. Real-world: usuário processou **435M tokens de input num único dia (01/05/2026)** com **99,82% de cache hit**, derrubando custo de ~US$ 61 para ~US$ 12. Contexto particionado em 3 regiões — prefix imutável (system prompt + tool specs), append-only log (turnos), volatile scratch (reasoning + plan). Aposta na invariância byte-stable do prefix-cache do DeepSeek como diferencial arquitetural inalcançável por agents multi-provider.

Modelos · web · deepseek, coding-agent, prefix-cache, terminal-cli, esengine, ranking-hn

Anthropic em conversas com Microsoft para rodar Claude no chip Maia 200

CNBC reporta que Anthropic está em conversas avançadas com Microsoft para rodar Claude no chip Maia 200 — o silício de IA da própria MSFT. Movimento de diversificação além de TPUs do Google, Trainium da AWS e do deal SpaceX/Colossus (US$ 15 bi/ano em GPU NVIDIA). Sinaliza triangulação Microsoft-OpenAI-Anthropic em infraestrutura: MSFT não dependeria mais só de OpenAI para monetizar Maia. Para Anthropic, é hedge contra escassez de HBM e supply chain Asia-Pacific. Combina com o achado da Epoch AI hoje cedo: memória já é 2/3 do custo do chip de IA — quem diversifica silício vence.

Modelos · cnbc.com · anthropic, microsoft, maia, chip, infraestrutura, hardware-ia

Moonshot lança Kimi-K2.6 — MoE 1T params, 256K context, otimizado para coding agents

Moonshot AI (China) lança Kimi-K2.6 — MoE ~1T params com 32B ativos, 384 experts, contexto 256K, otimizado explicitamente para coding agents. Pesos abertos. No mesmo período, DeepSeek-V4-Pro recebeu corte permanente de 75% no preço. Movimentos chineses dominam r/LocalLLaMA esta semana — junto com GLM-5.1 da Zhipu (também agentic-focused). Para a comunidade open weights BR, Kimi-K2.6 vira candidato sério a substituto local de Claude Sonnet/Opus em fluxo Claude Code — vantagem: roda em 8× H100 quantizado vs 0 opções de Claude local.

Modelos · news.smol.ai · moonshot, kimi-k2-6, moe, china, open-weights, coding-agent

Cohere libera Command A+ multimodal sob Apache 2.0 — 48 idiomas, roda em 2 H100

Cohere lançou em 20/05 o Command A+ — primeira família Command comercialmente usável sem licença restritiva, multimodal, suporte a 48 idiomas (PT-BR incluído), roda em 2 H100 com quantização W4A4. Sinal de abertura competitiva contra Llama 4, Mistral Medium 3.5 e Qwen3-VL. Para CIn/UFPE, USP, FGV e times BR montando RAG corporativo, é a primeira opção 'open weight com selo enterprise' (Cohere historicamente atende compliance pesada — bancos, defesa, governo). Apache 2.0 sem cláusula de uso comercial fechada — limpa de gambiarras.

Modelos · llm-stats.com · cohere, command-a-plus, apache2, multilingue, open-source, multimodal

Meituan libera LongCat-Video-Avatar-1.5 — geração de vídeo avatar a partir de áudio (170 likes em 4 dias)

A unidade Meituan-LongCat (China) liberou em 21/05 o modelo `LongCat-Video-Avatar-1.5` — diffusion-based, audio-text-to-video e audio-image-text-to-video com licença MIT, suportando inglês e chinês. Subiu para 173 likes e trending score 170 no HF em 4 dias. É continuação dirigida por áudio do trabalho LongCat-Video original — concorre diretamente com Sonic, EMO e VASA-1 no nicho de "talking head + avatar persistente" para uso comercial. MIT é permissivo o suficiente para uso embarcado em chatbots, atendimento e edu-tech sem royalties.

Modelos · huggingface · meituan, longcat, video-generation, avatar, audio-driven, diffusers

Mistral Medium 3.5 atinge 77.6% SWE-Bench Verified e ganha Vibe remote agents

Mistral Medium 3.5 — modelo denso de 128B — vira default em Vibe e Le Chat. Atinge 77.6% no SWE-Bench Verified, competitivo com Claude Opus (87.6%) e GPT-5 (~82%). Junto vem Vibe remote agents: cada sessão de coding roda em sandbox isolado e abre PR no GitHub ao concluir — competidor direto de Claude Code e OpenAI Codex. Para devs BR e europeus, é a opção 'sob lei europeia' com preço agressivo. Reforça quadrilátero competitivo coding-agent: Anthropic Claude Code + OpenAI Codex + Mistral Vibe + Cursor 3.3.

Modelos · marktechpost.com · mistral, medium-3-5, vibe, remote-agents, swe-bench, coding-agent

Ferramentas e código

Using AI to write better code more slowly

Nolan Lawson (autor reconhecido em performance web) argumenta que IA o tornou um programador melhor — porém mais devagar. Tese central: o ganho em qualidade vem de IA empurrar você a pensar mais antes de escrever, planejar testes, justificar decisões. O custo é tempo de ciclo maior em cada PR. Viralizou no HN (699 pts) — toca o nervo do debate "AI = produtividade automática vs. AI = engenharia mais cuidadosa".

Ferramentas e código · hackernews · ai-assisted-coding, productivity, claude-code, paradox, software-engineering

Magnifica Humanitas — Papa Leão XIV publica encíclica sobre IA com presença pessoal em coletiva no Vaticano

Vaticano publicou no dia 25/05 a primeira encíclica de Leão XIV — _Magnifica Humanitas: Sobre a Proteção da Pessoa Humana na Era da Inteligência Artificial_. Documento assinado em 15/05, exatos 135 anos após Leão XIII assinar a _Rerum Novarum_ sobre direitos dos trabalhadores. Pela primeira vez na história, o Papa em pessoa esteve presente na coletiva de imprensa do Vaticano para apresentar um documento social, ao lado do Card. Víctor Manuel Fernández (DDF), Card. Michael Czerny (DPHI), profª Anna Rowlands (Durham) e profª Léocadie Lushombo (Santa Clara). Leão XIV enquadra a IA como o teste moral definidor da era — equivalente à Revolução Industrial — e amplia a Doutrina Social da Igreja do Rerum Novarum, passando por Centesimus Annus e Laudato Si'.

Ferramentas e código · web · papa-leao-xiv, vaticano, enciclica, etica-ia, dignidade-humana, rerum-novarum

Dreaming (Claude Code) — Harvey reporta 6× aumento em task-completion para legal drafting

Análise pós-Code with Claude London (19–20/05) traz primeiro caso de uso concreto da feature **Dreaming** lançada por Anthropic: a fintech-legal **Harvey** reportou aumento de **~6× nas taxas de conclusão** de tarefas de drafting jurídico depois de habilitar Dreaming nos seus workflows de agentes. O problema era clássico: agentes esqueciam quirks de filetype e workarounds específicos de ferramenta entre sessões, falhando o mesmo job toda vez. Com Dreaming, Claude Code "sonha" entre tasks — relê os notes-to-self, consolida padrões, e desperta com memória que persiste. Anthropic posicionou a analogia explicitamente como "REM-sleep memory consolidation" para agentes.

Ferramentas e código · web · anthropic, claude-code, dreaming, memory-consolidation, harvey, legal-tech

OpenAI lança 'Frontier', plataforma de agentes para enterprise

OpenAI anunciou Frontier, plataforma para empresas construírem, fazerem deploy e gerirem agentes de IA com contexto compartilhado e integrações nativas com sistemas existentes. Objetivo declarado: reduzir silos de workflow e aumentar parcela enterprise da receita para 50% do total. Concorre diretamente com a oferta da Anthropic para enterprise e com Microsoft Copilot Studio.

Ferramentas e código · webnews · openai, frontier, enterprise, agents, shared-context, integrations

SAP+Anthropic — Claude entra como modelo first-class na SAP Business AI Platform (anunciado em SAP Sapphire)

No **SAP Sapphire 2026** (semana de 19/05) a SAP anunciou parceria estratégica com Anthropic — Claude vai ser modelo first-class na **SAP Business AI Platform**, com acesso direto a contexto de ERP (S/4HANA), CRM (Customer Experience), HR (SuccessFactors) e analytics (Datasphere). Combinado com **KPMG Digital Gateway** (19/05) e **PwC** expansão (16/05), Anthropic consolida em 3 semanas o **stack enterprise mainstream**: ERP via SAP, Big 4 advisory via KPMG/PwC, compliance via Compliance API. Move estratégico de Anthropic para deixar OpenAI/Microsoft de fora dos workflows operacionais críticos das Fortune 500.

Ferramentas e código · web · anthropic, sap, sapphire, claude, business-ai, enterprise

OpenAI lança Daybreak para detecção de vulnerabilidades e validação de patch

OpenAI lança hoje (25/05) o Daybreak — agente para detecção autônoma de vulnerabilidades em código + validação de patch. Compete diretamente com Project Glasswing/Mythos da Anthropic (cobertos no 24/05). Marca movimento concertado das duas big labs entrando em AppSec autônomo no mesmo mês — sinal de que cybersecurity será o primeiro vertical em que agentes superam humanos em rotina contínua. Threat actors usando IA aumentam ~340% YoY (relatórios CrowdStrike/Mandiant). Para CTOs BR: começou a fase 'AI vs AI' em segurança de aplicação.

Ferramentas e código · thehackernews.com · openai, daybreak, appsec, seguranca-ofensiva, vulnerabilidades, glasswing

Cursor 3.3 lança Bugbot autônomo (78% self-resolution) e Durable Canvases

Cursor 3.3 introduz Bugbot autônomo — triagia bugs reportados em CI/issues do GitHub, reproduz, propõe fix e roda testes. Reporta ~78% de self-resolution. Em paralelo lança Durable Canvases — planos multi-etapa que persistem entre sessões (versão Cursor do 'Dreaming' da Anthropic). Tópico quente no HN. Para o duelo Cursor vs Claude Code, a moldura 2026 fica: Cursor ganha em UX nativa de IDE, Claude Code ganha em integração com agentes externos e MCP. Mistral Vibe entra como terceira opção sob lei europeia.

Ferramentas e código · nxcode.io · cursor, bugbot, ide, coding-agent, durable-canvases, claude-code

LangChain Interrupt 2026 + Deep Agents 0.6 com GLM-5 e DeepSeek nativos

Harrison Chase conduz LangChain Interrupt 2026 cunhando 'Agent Development Lifecycle (ADLC)' — shift de 'construir agentes (2025)' para 'operar sistemas agênticos em escala (2026+)'. Deep Agents 0.6 integra GLM-5 (Zhipu) e DeepSeek nativamente, abrindo possibilidade de stacks 100% open weights. Conferência ressoando no LinkedIn. Para times BR adotando padrões: ADLC é a referência mais concreta de como organizar o ciclo de vida de agentes em produção — observabilidade, eval contínuo, governance, custo por execução.

Ferramentas e código · blog.langchain.com · langchain, interrupt, deep-agents, harrison-chase, adlc, agent-ops

xAI Grok ganha conectores Vercel, Canva, Gamma e S&P Global em lote único

xAI liberou em 22/05 batch de conectores third-party para Grok: deploy via Vercel, design via Canva, slides via Gamma, dados financeiros via S&P Global Capital IQ. Estratégia de 'cockpit IA' para concorrer com ChatGPT Apps e Claude Skills. Posicionamento de produto: Grok 4 + conectores = workspace executivo verticalmente integrado. Reforça padrão consolidando-se em 2026: cada LLM vira um shell de orquestração de SaaS. Para usuário Premium+ BR (R$ ~200/mês), agrega valor real sem precisar logar em 4 ferramentas.

Ferramentas e código · basenor.com · xai, grok, conectores, vercel, canva, gamma

Pesquisa

Survey Agentic Reasoning for LLMs (Wei et al.) — top HF Papers da semana com 204 upvotes e discussão aberta com autores

Survey de Tianxin Wei et al. (29 autores) propondo redefinição de LLMs como agentes autônomos capazes de planejar, agir e aprender via interação contínua. Cobre frameworks single e multi-agent, RL post-training, in-context reasoning, world modeling e governança. **204 upvotes** no HF Papers, autores **participando da discussão com 6 comentários**. Importante porque consolida o estado da arte numa área fragmentada — boa referência única para times BR que estão escolhendo abordagem agentic em 2026.

Pesquisa · huggingface · agentic-reasoning, survey, llm-as-agent, rl-llm, planejamento, world-modeling

MCP roadmap 2026 foca em production readiness — auth, governance, observabilidade

Mantenedores do MCP publicam roadmap 2026 focado em 'growing pains' de produção: autenticação OAuth 2.1 + escopos finos, governance (policy-as-code para permissões de tool), observabilidade end-to-end com tracing distribuído, e custo por execução. Tópico ativo no HN — devs preocupados com adoção corporativa. MCP virou de facto standard nos últimos 12 meses (Anthropic, OpenAI, Google, todos suportam). 2026 será o ano em que provar segurança e governance vira gargalo. Para arquitetos BR: MCP precisa entrar no inventário de tech radar agora.

Pesquisa · thenewstack.io · mcp, model-context-protocol, anthropic, agente, padronizacao, auth

Mercado

Anthropic deve fechar rodada de US$ 30 bi a valuation US$ 900 bi+ na próxima semana — ultrapassa OpenAI

Bloomberg confirmou no dia 22/05 que a rodada de Anthropic — anunciada em 18/05 a valuation de US$ 900 bi+ — deve fechar oficialmente na próxima semana. Sequoia, Dragoneer, Altimeter e Greenoaks lideram em conjunto, cada uma com ~US$ 2 bi. Se sair como previsto, Anthropic ultrapassa a marca de US$ 852 bi da OpenAI (mar/2026) e vira a startup de IA mais valiosa do mundo. Receita Q2 projetada em **US$ 10,9 bi** (dobro do Q1), primeira margem operacional positiva trimestral e ARR esperado em **US$ 50 bi+ até final de junho**.

Mercado · web · anthropic, valuation, openai, sequoia, dragoneer, altimeter

OpenAI protocola S-1 confidencial para IPO Q4 e cria DeployCo com Tomoro

OpenAI entregou prospecto S-1 confidencial à SEC em 22/05 mirando IPO em Q4 2026 com valuation US$ 852 bi – US$ 1 tri. Goldman Sachs + Morgan Stanley lideram. No mesmo movimento criou DeployCo (US$ 4 bi iniciais, majority-owned) e comprou consultoria Tomoro para capturar margem de implementação enterprise — território histórico de Accenture, Deloitte e PwC. Análise da Fortune sugere que o S-1 deve forçar transparência sobre churn, custo de inferência e dependência Azure. Para a Anthropic, que fechou US$ 30 bi a US$ 900 bi+ esta semana, a corrida vira: quem chega a US$ 1 tri primeiro vence a narrativa.

Mercado · axios.com, crescendo.ai · openai, ipo, s-1, deployco, tomoro, consultoria

Regulação e segurança

EU AI Act simplificado pelo 'AI Omnibus' — deadlines empurrados para 2027/2028

União Europeia aprovou em 07/05 o 'AI Omnibus' simplificando o AI Act. Deadlines de sistemas high-risk (emprego, saúde, educação) empurrados para dez/2027; produtos físicos para ago/2028. Carve-out para máquinas industriais. Nova proibição explícita de 'nudifiers' (geração não-consensual de nudez) em dez/2026. Pressão de Macron + Merz para 'não matar startups EU' venceu posição mais dura da CE. Para PL 2338/2023 no Senado BR, é sinal claro: rigor europeu original era inviável; modelo mais funcional pode dar a régua para o Brasil também.

Regulação e segurança · euronews.com · eu, ai-act, regulacao, omnibus, high-risk, nudifier

Comunidade

Chris Olah (Anthropic) ao lado do Papa Leão XIV na coletiva da Magnifica Humanitas — CNN

Cobertura da CNN destaca dado que tinha passado no briefing matinal: Chris Olah, co-fundador da Anthropic e principal pesquisador de interpretabilidade, esteve fisicamente ao lado do Papa Leão XIV na coletiva da Magnifica Humanitas. Vaticano sublinhou que presença 'não é endosso, prêmio ou canonização' — mas a foto vale mais do que mil palavras: Anthropic se posiciona como interlocutor moral da Igreja em IA. Combina com remarks oficial publicado no blog da Anthropic. Aprofunda o eixo Vaticano-safety que já vinha sendo construído desde Pacem in AI (mensagem do Papa em janeiro 2024).

Comunidade · cnn.com · vaticano, papa-leao-xiv, anthropic, chris-olah, etica-ia, encyclical

Memória já é quase 2/3 do custo de componentes de chips de IA — Epoch AI

Estudo da Epoch AI publicado nas últimas 24h e capa do Hacker News (394 pts, 416 coments) mostra que **memória** (HBM principalmente) passou a representar aproximadamente **dois terços do custo de componentes** dos chips de IA mais avançados (H100/B100/MI300, etc). Implicação: bottleneck do treinamento e da inferência não é mais o die de compute em si, mas a fila de produção de HBM3e/HBM4 — concentrada em SK Hynix, Micron e Samsung. Reorganiza a economia política da corrida por GPUs e ajuda a explicar o deal Anthropic-SpaceX de US$ 15 bi/ano e as ondas de novos datacenters anunciadas pela Microsoft e Oracle.

Comunidade · web · memoria-hbm, gpu, custos, datacenters, epoch-ai, infraestrutura-ia

Hassabis declara 'foothills of the singularity' no Google I/O e mostra Genie em Street View

No keynote do Google I/O, Demis Hassabis projetou AGI para 2030 (+/- 1 ano) e demonstrou Genie integrado ao Street View do Google Maps — agora é possível 'caminhar' por qualquer rua do mundo em world model interativo. Waymo já usa Genie para 'imaginar' cenários inesperados antes de agir. Frase 'foothills of the singularity' viralizou nas comunidades técnicas. Sinal de que Google está consolidando vantagem em world models (Genie 3 lançado em jan/2026, Genie 4 agora integrado em produto) — território que OpenAI/Anthropic não cobrem. Para AV (autonomous vehicles) é o maior salto desde end-to-end driving.

Comunidade · semafor.com · google-deepmind, gemini, hassabis, genie, world-model, agi

Valor: IA pode afetar 37% dos trabalhadores brasileiros — análise por ocupação

Valor Econômico publica hoje (25/05) análise detalhada — 37% dos trabalhadores brasileiros têm tarefas significativamente afetáveis por IA generativa. Distribuição por ocupação (CBO): forte em escritório, administrativo, atendimento, jornalismo, advocacia; pequena em construção, transporte, agricultura. Discutido no F u t u r e s. Coloca a régua em momento perfeito: encíclica papal hoje, LeCun vs CEOs sobre 'job apocalypse' essa semana, e parecer do IPEA em curso. Para gestores BR, RH e sindicatos, é peça essencial. Junto com debate Silvio Meira sobre datacenters BR, fecha o ciclo 'capital + trabalho + território'.

Comunidade · valor.globo.com · brasil, mercado-trabalho, ia-empregos, valor-economico, ipea, dieese

LeCun vs CEOs sobre 'AI job apocalypse' — chama narrativas de doom de 'extremamente destrutivas

Yann LeCun (Meta) chama narrativas de 'AI job apocalypse' de 'extremamente destrutivas'. Defende posição histórica — tecnologia leva ~15 anos para produzir ganhos reais de produtividade, e o efeito Jevons leva a mais demanda por trabalho, não menos. Posiciona: 'everyone is going to be a boss managing agents'. Embate público com Dario Amodei que mudou tom recente para Jevons Paradox. Combina com o número do Valor hoje (37% trabalhadores BR afetados), análise de Henrique de Castro no F u t u r e s e a encíclica papal hoje. Debate central da semana.

Comunidade · fortune.com · yann-lecun, dario-amodei, ai-jobs, doom-narrative, jevons-paradox, meta