Anthropic lançou o Project Glasswing usando o modelo não-divulgado Claude Mythos Preview, que já encontrou mais de 10.000 zero-days de severidade alta/crítica em sistemas críticos. Parceiros incluem AWS, Apple, Cisco, CrowdStrike, Google, JPMorgan, Linux Foundation, Microsoft, NVIDIA e Palo Alto Networks. Anthropic está investindo USD 100M+ em créditos para defensores. Bug mais antigo: 27 anos no OpenBSD.
GPT-5.5 Instant virou o default do ChatGPT em 5 de maio: 52.5% menos alucinações em prompts de alto risco (medicina, direito, finanças) vs GPT-5.3 Instant. Disponível também na API como chat-latest. Inclui busca em conversas anteriores, arquivos e Gmail para personalização.
Família Gemma-4 (31B base + E4B) ultrapassa 14.5M downloads. Variante 26B A4B (3.8B ativos via MoE) emerge como melhor opção para uso local — Apache 2.0, contexto 256K, texto + imagem.
Lançado em 21/05 pela OpenBMB, o MiniCPM5-1B trending no HF (score 306, ~351 likes em poucos dias). 1B parâmetros, long-context, tool-calling nativo, focado em edge e on-device. Bilingue EN/ZH, treinado em Ultra-FineWeb / UltraData-SFT-2605.
Claude for Small Business é um pacote toggle-install que coloca Claude dentro das ferramentas que PMEs já usam: Intuit QuickBooks, PayPal, HubSpot, Canva, Docusign, Google Workspace e Microsoft 365. Workflows prontos por vertical, sem necessidade de configuração MCP manual.
MoonshotAI lançou kimi-code, CLI agentic para usar Kimi K2.6 como agente coder — concorrente direto de Claude Code, Codex CLI e Grok Build. 873 stars em poucos dias.
Modelos · github · kimi, moonshot, agents, cli, open-source
Marlin-2B (NemoStation, baseado em Qwen3.5-2B) é um VLM compacto para vídeo: video-text-to-text, video captioning, temporal grounding. 9.1K downloads e 395 likes em ~2 semanas. Apache 2.0.
Papa Leo XIV apresentou sua primeira encíclica sobre IA, Magnifica Humanitas, ao lado de Chris Olah (co-founder Anthropic). O Vaticano sinalizou deliberadamente qual laboratório considera parceiro crível em safety.
xAI lançou Grok Build em beta — um agente de codificação com TUI interativa e suporte a scripting headless, rivalizando diretamente com Claude Code e OpenAI Codex. Acompanha o Grok 4.3 (1M de contexto, vídeo nativo, USD 1.25/M tokens de entrada) e Connectors no Grok Web (SharePoint, Outlook, OneDrive, Workspace, Notion, GitHub).
Post no HN com 76 pontos detalha como usar Claude Code como ferramenta principal de trabalho: CLAUDE.md de projeto, skills sob medida, subagents especializados, plugins do marketplace e configuração de MCPs. Útil como referência rápida de padrões.
Proxy local + dashboard web que intercepta e mostra exatamente o que Claude Code, Codex ou Kimi enviam para o modelo. Ferramenta de observabilidade essencial para entender por que um agente fez algo.
Ferramentas e código · github · debug, proxy, observability, claude-code, codex, kimi
Integração permite usar modelos open-source hospedados no Hugging Face Inference dentro do GitHub Copilot Chat. Quebra o lock-in da Microsoft em OpenAI/Anthropic.
Ferramentas e código · devops.com · huggingface, copilot, oss, integracao
Fabio Akita (BR) lançou solução de memória persistente para agentes coding CLI, com handoff entre Claude Code, Codex e Kimi-Code. Resolve o problema de contexto que estoura entre sessões.
Ferramentas e código · github · memoria, claude-code, codex, handoff, brasileiro
Skill construída no Claude Agent SDK que implementa tree-of-thought com poda. Ideia: o agente explora múltiplas branches em paralelo e descarta as menos promissoras antes de gastar contexto.
Ferramentas e código · github · claude-agent-sdk, tree-of-thought, skill, reasoning
Skill do Claude Code que aplica princípios de Edward Tufte automaticamente a qualquer pedido de gráfico — alta razão dado-tinta, sem chartjunk, eixos limpos.
Ferramentas e código · github · claude-skill, tufte, visualizacao, grafico
Sistema multi-agente em LLM que automatiza descoberta + reprodução de vulnerabilidades. Paper na HN (38 pts). Linha direta com Claude Mythos / Glasswing.
PostHog (analytics OSS) publicou stack completa de treino de modelos próprios — dataset, hyperparams, custo, comparativo vs GPT-5. Caso prático raro de SaaS treinando model próprio.
Anthropic está fechando uma rodada de USD 30B a valuation USD 900B+, ultrapassando a OpenAI pela primeira vez. Projeção: USD 10.9B em receita no Q2 e primeiro trimestre operacional positivo. Investidores precificam caminho para USD 50B+ ARR em 18 meses.
Mercado · axios · anthropic, funding, valuation, openai, jobs
Post de Simon Willison foi #1 do Hacker News (552 pts). Tese: depois de 3 anos de hype, Anthropic e OpenAI atingiram PMF de verdade — não pelo chatbot, mas pelo agente que executa trabalho.
Comunidade · simonwillison.net · simon-willison, pmf, anthropic, openai, analise
DuckDuckGo registrou +28% de visitas na semana seguinte à declaração do Google de que 'usuários adoram' o AI Mode. HN #1 com 591 pts. Sinal claro de backlash ao AI-everywhere.
Comunidade · pcgamer · duckduckgo, google, ai-mode, backlash, search
Reportagem viralizada (HN 502 pts) sobre CEOs de tecnologia exibindo padrões de pensamento grandioso e detachment causados por uso intenso de LLMs como espelho. Termo 'AI psychosis' está virando vocabulário comum.
Comunidade · techcrunch · ai-psychosis, cultura, liderança, hype
YouTube anunciou rotulagem automática de conteúdo gerado por IA, usando sinais de procedência (C2PA) + classificador próprio. Primeira plataforma grande a tornar isso default.
Comunidade · youtube · youtube, ai-label, procedencia, c2pa
Simon Willison admite que a fronteira entre 'vibe coding' (não reviso, só rodo) e 'agentic engineering' (reviso cuidadosamente cada linha do agente) está sumindo no fluxo dele — mesmo em código de produção, à medida que Claude Code e Codex ficam mais confiáveis.
Comunidade · simonwillison-net · simon-willison, vibe-coding, agentic-engineering, claude-code, codex
CEO da NVIDIA, Jensen Huang, declarou em visita oficial que Taiwan é o epicentro da revolução de IA — referência direta à TSMC como fornecedora indispensável da pilha de compute. Discussão se conecta ao debate sobre soberania de IA (sem fábrica e energia próprias, não há soberania real).
Comunidade · reuters · nvidia, taiwan, tsmc, geopolítica, soberania-ia
Perfil da Fortune sobre Andrej Karpathy após migração para Anthropic em 19/05. Ele vai liderar um time focado em usar Claude para acelerar pesquisa de pretraining. O movimento confirma a tese de 'Anthropic como destino de elite' e dá contexto histórico para o termo 'vibe coding' que ele popularizou.
Comunidade · fortune · karpathy, anthropic, vibe-coding, talent-acquisition, pretraining
Ensaio do Simon Willison sobre a 'zombie internet': conteúdo que parece feito por humano mas é IA, multiplicando-se em produto, search e social. Conversa direta com o post 'I'm Tired of AI-Generated Answers' (HN top de hoje).
Comunidade · simonwillison-net · simon-willison, ai-slop, zombie-internet, ux, ai-fatigue
Andrew Gallant (autor do ripgrep) publicou AI Policy explícita para contribuições. Política: PRs precisam declarar uso de IA, e código gerado sem revisão humana é rejeitado.
Comunidade · github · ripgrep, ai-policy, oss, burntsushi, contribuicao
Post curto que está bombando no HN sobre fadiga com respostas geradas por IA — UX padrão (lista com bullets, hedging excessivo, longo demais) virou ruído. Sintetiza o sentimento crescente contra 'AI slop' em produto e em search.
Comunidade · hacker-news · opinião, ai-fatigue, slop, ux