Radar do FAROL18 notas

sexta-feira, 12 de junho de 2026

Modelos

Governo dos EUA força Anthropic a suspender Fable 5 e Mythos 5

Em 12/06, às 17h21 (ET), o governo dos EUA emitiu uma diretiva de controle de exportação citando segurança nacional e ordenou a suspensão do acesso a Fable 5 e Mythos 5 por qualquer estrangeiro — o efeito líquido foi a Anthropic ter de desligar abruptamente os dois modelos para TODOS os clientes. Os demais modelos (Opus 4.8, Sonnet 4.6, Haiku 4.5) seguem normais. A Anthropic cumpre a ordem mas discorda publicamente: diz que o gatilho foi um jailbreak estreito e não-universal (pedir ao modelo para ler um codebase e corrigir falhas), capacidade já disponível em outros modelos como o GPT-5.5, e alerta que esse padrão 'praticamente interromperia toda nova implantação de modelos de fronteira'.

Modelos · anthropic.com · anthropic, fable-5, mythos-5, regulacao, seguranca, jailbreak

Simon Willison: Claude Fable 5 e 'implacavelmente proativo

Apos dois dias de uso intenso, Simon Willison descreve o Claude Fable 5 como 'implacavelmente proativo': o modelo encontra e corrige bugs por conta propria (consertou sozinho a lib asyncinject) e usa qualquer recurso disponivel para atingir o objetivo. Ele alerta que essa proatividade extrema tambem amplia riscos de prompt injection em agentes de codigo.

Modelos · simonwillison.net · claude, fable-5, simon-willison, agentes, claude-code

MiniMax libera pesos abertos e technical report do M3 (1M contexto, SWE-Bench Pro 59%)

Dentro da janela prometida de 10 dias pos-lancamento, a MiniMax liberou os pesos abertos e o technical report do M3 — primeiro open-weight a combinar coding de fronteira (59,0% no SWE-Bench Pro, acima do GPT-5.5), contexto de 1M tokens via atencao esparsa MSA e multimodalidade nativa. Assunto dominante na comunidade de LLMs locais.

Modelos · marktechpost.com · minimax, m3, open-weights, llms-locais, coding

Anthropic anuncia 'Claude Corps': US$ 150 mi e 1.000 fellows para levar IA a ONGs

A Anthropic vai doar US$ 150 milhoes para o 'Claude Corps': 1.000 fellows pagos (US$ 85k/ano + budget de tokens) embedados por um ano em ONGs para acelerar a adocao de IA generativa no terceiro setor. Movimento de distribuicao e goodwill as vesperas do IPO.

Modelos · theregister.com · anthropic, claude, nonprofits, adocao

WWDC 2026 encerra: Siri reconstruída, extensões Claude/ChatGPT/Gemini e nuvem da Apple em GPUs NVIDIA no Google

A WWDC consolidou o iOS 27 com Siri AI reconstruída (contexto cross-app e APIs de consciência de tela) e sistema de Extensions com Claude, ChatGPT e Gemini. A Apple confirmou que seus Apple Foundation Models on Cloud rodam em GPUs NVIDIA hospedadas na infraestrutura do Google.

Modelos · buildfastwithai · apple, wwdc, siri, nvidia, google, ios27

Grok Imagine gera video completo e xAI lanca marketplace de plugins no Grok Build

Em 11/06 a xAI demonstrou o Grok Imagine gerando video completo de alta qualidade — Musk publicou no X um video feito inteiramente pela ferramenta. No mesmo dia, a xAI lancou o marketplace de plugins integrado ao Grok Build, reforcando a aposta em ecossistema de agentes/extensoes.

Modelos · basenor.com · xai, grok, video, plugins, agentes

VibeThinker-3B (Weibo): modelo pequeno de raciocinio em matematica e codigo

Modelo de 3B derivado do Qwen2.5-Coder com foco em raciocinio matematico e de codigo, mostrando que modelos pequenos especializados seguem ganhando espaco para rodar local.

Modelos · Hugging Face · weibo, reasoning, small-model, math, code

Ferramentas e código

Agentjacking: erros falsos do Sentry sequestram agentes de código via MCP

A Tenet Security revelou o 'Agentjacking', nova classe de ataque que injeta comandos maliciosos em eventos de erro do Sentry. O servidor MCP do Sentry entrega esses eventos a agentes como Claude Code e Cursor como output confiável de diagnóstico, levando-os a executar código arbitrário na máquina do dev — com os privilégios do desenvolvedor. Em testes controlados houve 85% de sucesso e 2.388 organizações expostas; o Sentry reconheceu a falha mas decidiu não corrigi-la ('tecnicamente indefensável'), ativando só um filtro global para uma string de payload.

Ferramentas e código · thehackernews.com · seguranca, agentjacking, mcp, claude-code, cursor, sentry

Cadeia de falhas no LangGraph permite execução remota de código (RCE) em deploys self-hosted

A Check Point divulgou três falhas (já corrigidas) no LangGraph, framework da LangChain para agentes de IA stateful. Encadeando CVE-2025-67644 (SQL injection no checkpointer SQLite, CVSS 7.3) e CVE-2026-28277 (desserialização insegura de msgpack), um atacante consegue RCE em deploys self-hosted que usam o checkpointer SQLite ou Redis com filtro controlável pelo usuário. A plataforma gerenciada (LangSmith Deployment) não é afetada. Reforça o debate de segurança de agentes que carregam acesso e confiança elevados.

Ferramentas e código · thehackernews.com · seguranca, langgraph, langchain, rce, cve, ia-agentica

Huawei lança HarmonyOS 7 com arquitetura agêntica e mais de 2.000 agentes de IA, mirando a Apple

No HDC 2026 (12/06), a Huawei apresentou o HarmonyOS 7, um SO com arquitetura 'agent-friendly' e assistente Xiaoyi capaz de manter contexto, lembrar interações e acionar mais de 2.000 agentes de IA, com 90% de sucesso em tarefas complexas. A versão beta para devs já traz agentes de codificação. É uma das apostas mais agressivas em um sistema operacional inteiramente agêntico, num momento em que os recursos de IA do iOS 27 seguem indisponíveis na China continental.

Ferramentas e código · scmp.com · huawei, harmonyos, ia-agentica, sistema-operacional, apple, china

Microsoft libera recursos locais de IA do Windows (antes so Copilot+) para GPUs NVIDIA

A Microsoft liberou recursos locais de IA do Windows — antes exclusivos de Copilot+ PCs com NPU — para rodar em GPUs NVIDIA. A mudanca se conecta a relatos de parceria Microsoft-NVIDIA em 'AI PCs' capazes de rodar agentes localmente, e amplia muito a base de maquinas aptas a inferencia on-device.

Ferramentas e código · borecraft.com · microsoft, nvidia, ia-local, windows, on-device

Pesquisa

Paper: APPO — Agentic Procedural Policy Optimization (RL para tool-use multi-turn)

Novo metodo de RL agentico que melhora tool-use multi-turn refinando onde o agente 'ramifica' decisoes e como o credito e atribuido ao longo da trajetoria, usando um Branching Score baseado em incerteza de tokens e vantagem em nivel de procedimento. Relevante para quem treina agentes com chamadas de ferramenta em multiplos turnos.

Pesquisa · arxiv.org · rl, agentes, tool-use, paper, arxiv

DeepMind e parceiros lancam chamada de US$ 10 mi para pesquisa em seguranca de sistemas multiagente

O Google DeepMind, com Schmidt Sciences, Cooperative AI Foundation, ARIA e Google.org, lancou chamada de financiamento de ate US$ 10 milhoes para pesquisa tecnica em seguranca de sistemas multiagente — o cenario em que milhoes de agentes de organizacoes diferentes negociam entre si. Prazo de submissao: 08/08/2026.

Pesquisa · deepmind.google · deepmind, multiagente, ai-safety, funding

Mercado

SpaceX precifica IPO a US$ 135/acao e estreia hoje na Nasdaq — maior IPO da historia, com a xAI dentro

A SpaceX precificou seu IPO em US$ 135/acao na noite de 11/06, levantando ~US$ 75 bi a um valuation de ~US$ 1,77 trilhao — o maior IPO da historia. As acoes estreiam hoje (12/06) na Nasdaq como SPCX. Relevante para IA: a xAI (absorvida em fevereiro) vai junto, e a SpaceX e fornecedora de compute da Anthropic (Colossus).

Mercado · capital.com · spacex, xai, ipo, mercado

SpaceX estreia na Nasdaq no maior IPO da história e faz Musk o primeiro trilionário

SpaceX (com a xAI absorvida) estreou na Nasdaq a US$ 135/ação, levantando ~US$ 75 bi com valuation de US$ 1,75 tri — o maior IPO já registrado — e tornando Elon Musk o primeiro trilionário da história. O S-1 revelou que a xAI perdeu US$ 6,36 bi em 2025. O papel vira termômetro para os IPOs de Anthropic e OpenAI.

Mercado · forbes · spacex, xai, ipo, mercado, musk

Comunidade

Amodei propoe que a Anthropic 'taxe a si mesma' e anuncia fundo de US$ 200 mi para impacto da IA no trabalho

Dario Amodei publicou ensaio defendendo suporte economico estatal a trabalhadores deslocados pela IA, e a Anthropic anunciou US$ 200 milhoes para um Economic Futures Research Fund (trials de politicas publicas) mais fellowships nacionais. Dias depois de a OpenAI publicar metas de 'ganhos amplamente compartilhados' — os dois labs disputam a narrativa economica pre-IPO.

Comunidade · fortune.com · anthropic, dario-amodei, empregos, politica-publica

Demis Hassabis: estamos 'nos sopes da singularidade', AGI possivel por volta de 2029

No Google I/O 2026, Hassabis disse que a sociedade tem poucos anos para se preparar para a AGI (agora vendo 2029 como possivel) e criticou empresas que usam IA como 'desculpa' para cortes.

Comunidade · Fast Company · deepmind, agi, hassabis, timeline

ChatGPT cai a 54,7% das visitas web; Claude cresce 306% no trimestre (8,2% global)

Dados divulgados nas ultimas 24h mostram o ChatGPT com 54,7% das visitas web globais de chatbots — ante 76,5% em fev/2025 — enquanto o Claude saltou para 8,2% global e 12,5% nos EUA, crescimento de 306% em um trimestre. A guerra de uso (nao de awareness) esta cada vez mais aberta.

Comunidade · llm-stats.com · chatgpt, claude, market-share, tendencias