Menos de 48h após a descoberta no system card de que o Fable 5 degradaria silenciosamente respostas sobre desenvolvimento de LLMs de fronteira, a Anthropic admitiu 'tradeoff errado' e pediu desculpas. Requests sinalizados agora caem visivelmente para o Opus 4.8 (como já ocorre com cyber/bio) e a API retornará o motivo da recusa.
Modelos · simonwillison.net · anthropic, fable-5, safety, politica
A Moonshot AI publicou o Kimi K2.7-Code, modelo focado em código com capacidades multimodais (image-text-to-text), já entre os mais trending do Hugging Face horas após o upload. Mais um competidor open-weights chinês na arena de coding models.
Modelos · huggingface · kimi, moonshot, coding, open-weights, multimodal
Flagship latent-MoE de 550B parâmetros (55B ativos) com multi-token prediction e suporte a 14+ idiomas. Cerca de 59 mil downloads na primeira semana, em alta no trending do Hub.
Modelo MoE (cohere2_moe) focado em geração de código e uso agêntico, Apache 2.0, com deploy direto no Azure. Entre os mais trending do Hub; versão quantizada fp8 oficial saiu em 08/06.
Prometido por Sundar Pichai para 'o próximo mês' no I/O de 19/mai, o Gemini 3.5 Pro (contexto de 2M tokens, modo Deep Think) ainda não chegou à disponibilidade geral, seguindo em preview limitado no Vertex AI. Mercados de previsão precificam estreia no fim de junho.
Release traz orquestração recursiva: sub-agentes spawnam sub-agentes até 5 níveis, abrindo padrões de delegação em árvore. Também: Bedrock lê região do ~/.aws, busca em marketplaces de plugins e fixes (sessões 1M travadas, flicker em JetBrains). A 2.1.170 liberou o Fable 5 no Claude Code.
Ferramentas e código · releasebot · claude-code, agentes, anthropic, release
O servidor do llama.cpp agora expõe a Anthropic Messages API, permitindo plugar clientes compatíveis com Claude (incluindo o Claude Code) em modelos locais GGUF. Combinado à mudança de preços do Claude Code, virou o assunto favorito do r/LocalLLaMA: 'Claude Code grátis com Qwen/Gemma local'.
Alpha implementa human-in-the-loop nativo: via context.ask_user a tool suspende o turno do agente, renderiza formulário no chat e sobrevive a restart do servidor. Inclui tool save_query com aprovação humana obrigatória. Construída com Fable 5 via Claude Code.
Ferramentas e código · github · simon-willison, human-in-the-loop, agentes, datasette
Análise de como as principais ferramentas de codificação agêntica convergiram para o mesmo blueprint até junho/2026, com Grok Build disputando por preço. Cursor Pro e a faixa de entrada do Claude Code em torno de US$20, com custo por uso por cima.
Ferramentas e código · thenewstack.io · claude-code, cursor, codex, mercado
Simon Willison lançou o Datasette 1.0a33 e publicou comparação de execução de queries não-confiáveis em SQLite vs PostgreSQL — tema central para quem expõe bancos de dados a agentes de IA. Também soltou ferramentas novas construídas com assistência de IA.
DUPLICATA — notícia já coberta na varredura matinal em xai-grok-imagine-video-grok-build-marketplace.md. Nota mantida apenas como registro da URL canônica da xAI.
Ferramentas e código · xai · xai, grok, plugins, duplicado
Paper em alta no HF (108 upvotes) avalia como agentes de código exploram repositórios, exigindo listas ranqueadas de regiões relevantes dentro de orçamento de linhas. Exploração agêntica supera retrieval tradicional para localização de código e diagnóstico de bugs.
Pesquisa · huggingface · benchmark, coding-agents, swe, paper
Reformula a montagem de contexto para LLMs como problema de recomendação: Neural Collaborative Context Engineering usa collaborative filtering para casar dinamicamente cada input com o contexto ótimo, melhorando acurácia com roteamento por instância.
Novo benchmark vai além do matching de snippets isolados, avaliando busca em nível de repositório inteiro e compreensão de contexto para agentes de codificação — parte de uma onda recente de críticas à qualidade dos benchmarks atuais de coding agêntico.
Pesquisa · web · benchmarks, code-retrieval, agentes-de-codigo, arxiv
OpenAI confirmou envio confidencial de S-1 à SEC (~US$852 bi), uma semana após a Anthropic (~US$965 bi, 1/jun). Em paralelo, Altman e Pachocki reformularam a meta de 2028: de pesquisador de IA 'totalmente autônomo' para um 'tandem' humano-IA, pedindo órgão internacional capaz de desacelerar a IA de fronteira.
O system card de 319 páginas revelou que o Fable 5 degradaria silenciosamente (steering vectors, PEFT, modificação de prompt) respostas sobre desenvolvimento de LLMs de fronteira, sem avisar o usuário. Forte reação negativa no HN e no X — que levou ao recuo da Anthropic em 11/06.
Comunidade · simonwillison.net · anthropic, fable-5, safety, polemica
Tribunal regional alemão decidiu que AI Overviews são 'palavras do próprio Google' — conteúdo gerado, não citação — tornando a empresa responsável por afirmações falsas. Precedente potencialmente enorme para responsabilidade civil de respostas de IA em buscadores; decisão ainda não final.
Comunidade · the-decoder.com · regulacao, google, ai-overviews, direito
Análise do front page do HN: demanda real por engenheiros de IA, agentes de código e dev tools seguros; preocupação crescente com ataques assistidos por IA, pacotes maliciosos e supply chain. O humor sobre 'AI coding' ficou mais ácido.
Comunidade · hackernews · hackernews, tendencias, seguranca, dev-tools, agentes
LeCun voltou a chamar LLMs de 'intrinsecamente inseguros' e prevê mudança de paradigma na robótica até 2027, apostando em JEPA via sua startup AMI (seed recorde de US$ 1,03 bi). Jim Fan defende o caminho oposto com o Cosmos 3 da NVIDIA (gerar o mundo como vídeo).
Comunidade · humanoidsdaily · lecun, jim-fan, world-models, robotica, jepa
Howard propõe que o lab com o melhor modelo deveria se proibir de usá-lo para pesquisa de fronteira, liberando-o para os demais — e critica a Anthropic por fazer o oposto. Thread que cristalizou o debate da semana sobre poder concentrado e recursive self-improvement.
Comunidade · x · jeremy-howard, rsi, anthropic, debate
A principal startup de IA da China está prestes a levantar ~50 bi de yuans (US$7,4 bi) com investidores como Tencent e CATL, avaliando a empresa entre US$52 bi e US$59 bi — sinal da aceleração do financiamento de IA na Ásia.
Comunidade · yahoo finance · deepseek, investimento, china
OpenAI afirmou que atores baseados na China provavelmente usaram o ChatGPT em operações encobertas para fomentar oposição a data centers nos EUA, e baniu o cluster de contas envolvido.
Comunidade · aljazeera.com · openai, influencia, china, seguranca
Grande interrupção do Gemini em 10/06, com pico de 1.168 relatos nos EUA e ~450 no Reino Unido. Google aplicou mitigações e reportou recuperação ao longo do dia.
Comunidade · techradar.com · google, gemini, outage