# Radar do FAROL · quinta-feira, 11 de junho de 2026

36 notícias. Dados: https://radar.farolia.org/dados/dia/2026-06-11.json

## Modelos

- **[Anthropic recua e torna visíveis as salvaguardas de frontier LLM do Fable 5](https://simonwillison.net/2026/Jun/11/anthropic-walks-back-policy/)** (Modelos; simonwillison.net). Menos de 48h após a descoberta no system card de que o Fable 5 degradaria silenciosamente respostas sobre desenvolvimento de LLMs de fronteira, a Anthropic admitiu 'tradeoff errado' e pediu desculpas. Requests sinalizados agora caem visivelmente para o Opus 4.8 (como já ocorre com cyber/bio) e a API retornará o motivo da recusa.
- **[Claude Fable 5 chega ao Amazon Bedrock com salvaguardas embutidas](https://aws.amazon.com/blogs/aws/anthropic-claude-fable-5-on-aws-mythos-class-capabilities-with-built-in-safeguards-now-available/)** (Modelos; aws-blog). Fable 5 disponível no Bedrock no day-one, levando capacidades classe Mythos a clientes enterprise AWS.
- **[Moonshot AI publica Kimi K2.7-Code no Hugging Face](https://hf.co/moonshotai/Kimi-K2.7-Code)** (Modelos; huggingface). A Moonshot AI publicou o Kimi K2.7-Code, modelo focado em código com capacidades multimodais (image-text-to-text), já entre os mais trending do Hugging Face horas após o upload. Mais um competidor open-weights chinês na arena de coding models.
- **[NVIDIA publica Nemotron-3 Ultra 550B-A55B em pesos abertos](https://huggingface.co/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16)** (Modelos; huggingface). Flagship latent-MoE de 550B parâmetros (55B ativos) com multi-token prediction e suporte a 14+ idiomas. Cerca de 59 mil downloads na primeira semana, em alta no trending do Hub.
- **[Google lança Veo 3.1 Lite Preview e modelos de música Lyria 3 na Gemini API](https://ai.google.dev/gemini-api/docs/changelog)** (Modelos; google-ai-changelog). Veo 3.1 Lite é o modelo de vídeo mais barato do Google; Lyria 3 gera clipes de 30s e músicas completas.
- **[Cohere Labs lança North-Mini-Code-1.0, modelo aberto de código e agentes](https://huggingface.co/CohereLabs/North-Mini-Code-1.0)** (Modelos; huggingface). Modelo MoE (cohere2_moe) focado em geração de código e uso agêntico, Apache 2.0, com deploy direto no Azure. Entre os mais trending do Hub; versão quantizada fp8 oficial saiu em 08/06.
- **[Microsoft fecha catálogo Foundry com 11.000 modelos, incluindo Claude Opus 4.8](https://www.buildfastwithai.com/blogs/ai-news-today-june-8-2026)** (Modelos; web). Foundry consolidado como vitrine multi-vendor; Opus 4.8 a US$ 5/25 por milhão de tokens, contexto 1M.
- **[Gemini 3.5 Pro segue pendente; mercado aposta em lançamento até o fim de junho](https://www.buildfastwithai.com/blogs/ai-news-today-june-11-2026)** (Modelos; buildfastwithai). Prometido por Sundar Pichai para 'o próximo mês' no I/O de 19/mai, o Gemini 3.5 Pro (contexto de 2M tokens, modo Deep Think) ainda não chegou à disponibilidade geral, seguindo em preview limitado no Vertex AI. Mercados de previsão precificam estreia no fim de junho.

## Ferramentas e código

- **[Claude Code 2.1.172: sub-agentes podem criar sub-agentes (até 5 níveis)](https://releasebot.io/updates/anthropic/claude-code)** (Ferramentas e código; releasebot). Release traz orquestração recursiva: sub-agentes spawnam sub-agentes até 5 níveis, abrindo padrões de delegação em árvore. Também: Bedrock lê região do ~/.aws, busca em marketplaces de plugins e fixes (sessões 1M travadas, flicker em JetBrains). A 2.1.170 liberou o Fable 5 no Claude Code.
- **[Claude Code 2.1.170: suporte ao Fable 5, safe mode e /cd](https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md#21170)** (Ferramentas e código; github). Release 2.1.170 traz Fable 5 como modelo, --safe-mode, comando /cd e correções no JetBrains.
- **[Visa e OpenAI fecham parceria para pagamentos por agentes de IA no ChatGPT](https://www.bloomberg.com/news/articles/2026-06-10/openai-visa-team-up-to-let-ai-agents-make-purchases-online)** (Ferramentas e código; bloomberg). Credenciais tokenizadas da Visa no ChatGPT para compras agenticas com limites e aprovações do usuário.
- **[llama.cpp ganha suporte à Anthropic Messages API — Claude Code com modelos locais](https://huggingface.co/blog/ggml-org/anthropic-messages-api-in-llamacpp)** (Ferramentas e código; huggingface-blog). O servidor do llama.cpp agora expõe a Anthropic Messages API, permitindo plugar clientes compatíveis com Claude (incluindo o Claude Code) em modelos locais GGUF. Combinado à mudança de preços do Claude Code, virou o assunto favorito do r/LocalLLaMA: 'Claude Code grátis com Qwen/Gemma local'.
- **[datasette-agent 0.2a0: tools fazem perguntas ao usuário no meio da execução](https://github.com/datasette/datasette-agent/releases/tag/0.2a0)** (Ferramentas e código; github). Alpha implementa human-in-the-loop nativo: via context.ask_user a tool suspende o turno do agente, renderiza formulário no chat e sobrevive a restart do servidor. Inclui tool save_query com aprovação humana obrigatória. Construída com Fable 5 via Claude Code.
- **[OpenAI fecha parceria com Oracle: modelos e Codex via créditos OCI](https://openai.com/index/openai-on-oracle-cloud/)** (Ferramentas e código; openai-blog). Clientes Oracle Cloud poderão usar Universal Credits para acessar modelos OpenAI e Codex.
- **[Cursor expõe custom tools via servidor MCP embutido e lança Design Mode](https://cursor.com/changelog#custom-tools-design-mode)** (Ferramentas e código; cursor-changelog). Tools customizadas via local.customTools sem servidor próprio, Design Mode e context explorer de tokens.
- **[DiffusionGemma rodando local: GGUFs da Unsloth + branch especial do llama.cpp](https://huggingface.co/unsloth/diffusiongemma-26B-A4B-it-GGUF)** (Ferramentas e código; huggingface). GGUFs quantizados já disponíveis; exige PR #24423 do llama.cpp e runner llama-diffusion-cli.
- **[google/skills — repositório oficial de Agent Skills do Google em alta](https://github.com/google/skills)** (Ferramentas e código; github). Skills oficiais do Google (BigQuery, Cloud Run, Firebase, GKE) em formato aberto cross-vendor.
- **[Convergência da codificação agêntica: Claude Code, Cursor, Codex e Antigravity](https://thenewstack.io/claude-code-vs-cursor-vs-codex-vs-antigravity-2026/)** (Ferramentas e código; thenewstack.io). Análise de como as principais ferramentas de codificação agêntica convergiram para o mesmo blueprint até junho/2026, com Grok Build disputando por preço. Cursor Pro e a faixa de entrada do Claude Code em torno de US$20, com custo por uso por cima.
- **[Datasette 1.0a33 + pesquisa sobre rodar queries não-confiáveis para agentes](https://simonwillison.net/2026/Jun/11/datasette/)** (Ferramentas e código; simonwillison.net). Simon Willison lançou o Datasette 1.0a33 e publicou comparação de execução de queries não-confiáveis em SQLite vs PostgreSQL — tema central para quem expõe bancos de dados a agentes de IA. Também soltou ferramentas novas construídas com assistência de IA.
- **[xAI lança Grok Build Plugin Marketplace (beta)](https://x.ai/news/grok-plugin-marketplace)** (Ferramentas e código; xai). DUPLICATA — notícia já coberta na varredura matinal em xai-grok-imagine-video-grok-build-marketplace.md. Nota mantida apenas como registro da URL canônica da xAI.

## Pesquisa

- **[SWE-Explore: benchmark de exploração de repositórios por coding agents](https://hf.co/papers/2606.07297)** (Pesquisa; huggingface). Paper em alta no HF (108 upvotes) avalia como agentes de código exploram repositórios, exigindo listas ranqueadas de regiões relevantes dentro de orçamento de linhas. Exploração agêntica supera retrieval tradicional para localização de código e diagnóstico de bugs.
- **[Contexting as Recommendation: collaborative filtering para context engineering](https://hf.co/papers/2605.15721)** (Pesquisa; huggingface). Reformula a montagem de contexto para LLMs como problema de recomendação: Neural Collaborative Context Engineering usa collaborative filtering para casar dinamicamente cada input com o contexto ótimo, melhorando acurácia com roteamento por instância.
- **[Agent² RL-Bench: agentes LLM conseguem fazer engenharia de RL pós-treino?](https://arxiv.org/abs/2604.10547)** (Pesquisa; arxiv). Benchmark testa se agentes LLM projetam e debugam pipelines de RL pós-treino de forma autônoma.
- **[CORE-Bench propõe régua mais rigorosa para recuperação de código na era agêntica](https://hf.co/papers/2606.11864)** (Pesquisa; web). Novo benchmark vai além do matching de snippets isolados, avaliando busca em nível de repositório inteiro e compreensão de contexto para agentes de codificação — parte de uma onda recente de críticas à qualidade dos benchmarks atuais de coding agêntico.

## Mercado

- **[OpenAI submete S-1 confidencial à SEC; corrida de IPOs com a Anthropic](https://openai.com/index/openai-submits-confidential-s-1/)** (Mercado; openai.com). OpenAI confirmou envio confidencial de S-1 à SEC (~US$852 bi), uma semana após a Anthropic (~US$965 bi, 1/jun). Em paralelo, Altman e Pachocki reformularam a meta de 2028: de pesquisador de IA 'totalmente autônomo' para um 'tandem' humano-IA, pedindo órgão internacional capaz de desacelerar a IA de fronteira.

## Comunidade

- **[\"If Claude Fable stops helping you, you'll never know\" — polêmica das salvaguardas invisíveis](https://simonwillison.net/2026/Jun/10/if-claude-fable-stops-helping-you/)** (Comunidade; simonwillison.net). O system card de 319 páginas revelou que o Fable 5 degradaria silenciosamente (steering vectors, PEFT, modificação de prompt) respostas sobre desenvolvimento de LLMs de fronteira, sem avisar o usuário. Forte reação negativa no HN e no X — que levou ao recuo da Anthropic em 11/06.
- **[Corte alemã responsabiliza Google por respostas falsas dos AI Overviews](https://the-decoder.com/landmark-german-ruling-declares-googles-ai-overviews-are-googles-own-words-and-makes-it-liable-for-false-answers/)** (Comunidade; the-decoder.com). Tribunal regional alemão decidiu que AI Overviews são 'palavras do próprio Google' — conteúdo gerado, não citação — tornando a empresa responsável por afirmações falsas. Precedente potencialmente enorme para responsabilidade civil de respostas de IA em buscadores; decisão ainda não final.
- **[Pliny the Liberator quebra classificadores do Fable 5 e vaza system prompt de 120k caracteres](https://x.com/elder_plinius/status/2064478648057610422)** (Comunidade; x-twitter). Ataque multi-agente derrotou os classificadores do Fable 5; system prompt vazado no GitHub (CL4R1T4S).
- **[OpenAI denuncia campanha de contas ligadas à China contra data centers nos EUA](https://www.bloomberg.com/news/articles/2026-06-10/openai-says-china-linked-accounts-aim-to-fuel-us-data-center-pushback)** (Comunidade; bloomberg). Cluster de contas do ChatGPT gerava posts contra data centers nos EUA; campanha apelidada de 'Data Center Bandwagon'.
- **[Tendências do Hacker News em junho: a grana da IA migra de demos para confiança e segurança](https://blog.mean.ceo/hacker-news-trends-june-2026/)** (Comunidade; hackernews). Análise do front page do HN: demanda real por engenheiros de IA, agentes de código e dev tools seguros; preocupação crescente com ataques assistidos por IA, pacotes maliciosos e supply chain. O humor sobre 'AI coding' ficou mais ácido.
- **[LeCun (AMI Labs) vs Jim Fan (NVIDIA Cosmos 3): a disputa dos world models esquenta](https://www.humanoidsdaily.com/news/yann-lecun-predicts-paradigm-shift-in-robotics-by-2027-dismisses-llms-as-intrinsically-unsafe)** (Comunidade; humanoidsdaily). LeCun voltou a chamar LLMs de 'intrinsecamente inseguros' e prevê mudança de paradigma na robótica até 2027, apostando em JEPA via sua startup AMI (seed recorde de US$ 1,03 bi). Jim Fan defende o caminho oposto com o Cosmos 3 da NVIDIA (gerar o mundo como vídeo).
- **[Jeremy Howard: thread viral sobre auto-melhoria recursiva e o 'caminho oposto' da Anthropic](https://twitter.com/jeremyphoward/status/2064595816875217362)** (Comunidade; x). Howard propõe que o lab com o melhor modelo deveria se proibir de usá-lo para pesquisa de fronteira, liberando-o para os demais — e critica a Anthropic por fazer o oposto. Thread que cristalizou o debate da semana sobre poder concentrado e recursive self-improvement.
- **[DeepSeek deve captar ~US$7,4 bi em sua primeira rodada, com Tencent e CATL](https://finance.yahoo.com/markets/stocks/articles/deepseek-slated-draw-7-billion-041632070.html)** (Comunidade; yahoo finance). A principal startup de IA da China está prestes a levantar ~50 bi de yuans (US$7,4 bi) com investidores como Tencent e CATL, avaliando a empresa entre US$52 bi e US$59 bi — sinal da aceleração do financiamento de IA na Ásia.
- **[OpenAI bane contas ligadas à China por operações de influência contra data centers nos EUA](https://www.aljazeera.com/economy/2026/6/11/openai-says-china-based-actors-stoking-opposition-to-ai-data-centres)** (Comunidade; aljazeera.com). OpenAI afirmou que atores baseados na China provavelmente usaram o ChatGPT em operações encobertas para fomentar oposição a data centers nos EUA, e baniu o cluster de contas envolvido.
- **[Graphs that explain the state of AI in 2026 — discussão em alta no HN](https://news.ycombinator.com/item?id=47817581)** (Comunidade; hn). Comunidade debate o estado da IA em 2026: dinheiro migrando de demos para confiança e workflows controlados.
- **[Gemini sofre uma das maiores quedas de sua história (erros 1076 e 1099)](https://www.techradar.com/news/live/gemini-down-june-2026)** (Comunidade; techradar.com). Grande interrupção do Gemini em 10/06, com pico de 1.168 relatos nos EUA e ~450 no Reino Unido. Google aplicou mitigações e reportou recuperação ao longo do dia.
