Radar do FAROL29 notas

quarta-feira, 27 de maio de 2026

Modelos

Anthropic lança Project Glasswing com Claude Mythos para caçar zero-days

Anthropic lançou o Project Glasswing usando o modelo não-divulgado Claude Mythos Preview, que já encontrou mais de 10.000 zero-days de severidade alta/crítica em sistemas críticos. Parceiros incluem AWS, Apple, Cisco, CrowdStrike, Google, JPMorgan, Linux Foundation, Microsoft, NVIDIA e Palo Alto Networks. Anthropic está investindo USD 100M+ em créditos para defensores. Bug mais antigo: 27 anos no OpenBSD.

Modelos · anthropic · anthropic, claude-mythos, glasswing, segurança, zero-day, cibersegurança

OpenAI libera GPT-5.5 Instant: -52% de alucinações em prompts de alto risco

GPT-5.5 Instant virou o default do ChatGPT em 5 de maio: 52.5% menos alucinações em prompts de alto risco (medicina, direito, finanças) vs GPT-5.3 Instant. Disponível também na API como chat-latest. Inclui busca em conversas anteriores, arquivos e Gmail para personalização.

Modelos · techcrunch · openai, gpt-5-5, chatgpt, alucinação, modelo-default

Gemma 4 26B A4B vira recomendação prática para uso local (Apache 2.0, 256K context)

Família Gemma-4 (31B base + E4B) ultrapassa 14.5M downloads. Variante 26B A4B (3.8B ativos via MoE) emerge como melhor opção para uso local — Apache 2.0, contexto 256K, texto + imagem.

Modelos · huggingface · gemma-4, google, local, apache-2, 256k, multimodal

MiniCPM5-1B: modelo edge da OpenBMB com long-context e tool-calling

Lançado em 21/05 pela OpenBMB, o MiniCPM5-1B trending no HF (score 306, ~351 likes em poucos dias). 1B parâmetros, long-context, tool-calling nativo, focado em edge e on-device. Bilingue EN/ZH, treinado em Ultra-FineWeb / UltraData-SFT-2605.

Modelos · huggingface · openbmb, minicpm, edge-ai, on-device, long-context, tool-calling

Claude for Small Business: Anthropic mira PMEs com pacote de conectores prontos

Claude for Small Business é um pacote toggle-install que coloca Claude dentro das ferramentas que PMEs já usam: Intuit QuickBooks, PayPal, HubSpot, Canva, Docusign, Google Workspace e Microsoft 365. Workflows prontos por vertical, sem necessidade de configuração MCP manual.

Modelos · 9to5mac · anthropic, claude, smb, conectores, quickbooks, hubspot

MoonshotAI/kimi-code: 'starting point for next-gen agents' (873 stars em poucos dias)

MoonshotAI lançou kimi-code, CLI agentic para usar Kimi K2.6 como agente coder — concorrente direto de Claude Code, Codex CLI e Grok Build. 873 stars em poucos dias.

Modelos · github · kimi, moonshot, agents, cli, open-source

Marlin-2B: VLM de vídeo com temporal grounding e video captioning

Marlin-2B (NemoStation, baseado em Qwen3.5-2B) é um VLM compacto para vídeo: video-text-to-text, video captioning, temporal grounding. 9.1K downloads e 395 likes em ~2 semanas. Apache 2.0.

Modelos · huggingface · vlm, vídeo, marlin, qwen, temporal-grounding, multimodal

Ferramentas e código

Vaticano lança encíclica Magnifica Humanitas com Chris Olah (Anthropic) no palco

Papa Leo XIV apresentou sua primeira encíclica sobre IA, Magnifica Humanitas, ao lado de Chris Olah (co-founder Anthropic). O Vaticano sinalizou deliberadamente qual laboratório considera parceiro crível em safety.

Ferramentas e código · axios · vaticano, magnifica-humanitas, anthropic, safety, etica

xAI entra na corrida de coding agents com Grok Build

xAI lançou Grok Build em beta — um agente de codificação com TUI interativa e suporte a scripting headless, rivalizando diretamente com Claude Code e OpenAI Codex. Acompanha o Grok 4.3 (1M de contexto, vídeo nativo, USD 1.25/M tokens de entrada) e Connectors no Grok Web (SharePoint, Outlook, OneDrive, Workspace, Notion, GitHub).

Ferramentas e código · devops-com · xai, grok, grok-build, coding-agent, claude-code-rivals

Claude Code como Daily Driver: guia prático com Skills, Subagents, Plugins e MCPs

Post no HN com 76 pontos detalha como usar Claude Code como ferramenta principal de trabalho: CLAUDE.md de projeto, skills sob medida, subagents especializados, plugins do marketplace e configuração de MCPs. Útil como referência rápida de padrões.

Ferramentas e código · hacker-news · claude-code, skills, subagents, plugins, mcp, workflow

ccglass: veja o que seu coding agent realmente envia para o modelo (proxy local + web)

Proxy local + dashboard web que intercepta e mostra exatamente o que Claude Code, Codex ou Kimi enviam para o modelo. Ferramenta de observabilidade essencial para entender por que um agente fez algo.

Ferramentas e código · github · debug, proxy, observability, claude-code, codex, kimi

Hugging Face abre GitHub Copilot Chat para modelos open-source

Integração permite usar modelos open-source hospedados no Hugging Face Inference dentro do GitHub Copilot Chat. Quebra o lock-in da Microsoft em OpenAI/Anthropic.

Ferramentas e código · devops.com · huggingface, copilot, oss, integracao

akitaonrails/ai-memory: memória de longo prazo para agentes coding CLI (327 stars)

Fabio Akita (BR) lançou solução de memória persistente para agentes coding CLI, com handoff entre Claude Code, Codex e Kimi-Code. Resolve o problema de contexto que estoura entre sessões.

Ferramentas e código · github · memoria, claude-code, codex, handoff, brasileiro

ADHD: skill de tree-of-thought com poda para coding agents (341 stars)

Skill construída no Claude Agent SDK que implementa tree-of-thought com poda. Ideia: o agente explora múltiplas branches em paralelo e descarta as menos promissoras antes de gastar contexto.

Ferramentas e código · github · claude-agent-sdk, tree-of-thought, skill, reasoning

DeepSeek-GUI: workspace agentic para modelos DeepSeek com modos 'Code' e 'Claw

Workspace desktop para usar DeepSeek v4 com dois modos integrados: Code (estilo Cursor/Codex) e Claw (browse-and-act). 403 stars em poucos dias.

Ferramentas e código · github · deepseek, gui, workspace, local, open-source

tufte-claude-skill: skill do Claude Code que transforma 'me faz um gráfico' em gráfico Tufte-compliant

Skill do Claude Code que aplica princípios de Edward Tufte automaticamente a qualquer pedido de gráfico — alta razão dado-tinta, sem chartjunk, eixos limpos.

Ferramentas e código · github · claude-skill, tufte, visualizacao, grafico

Pesquisa

Multi-Agent LLM System for Automated Vulnerability Discovery and Reproduction (arXiv)

Sistema multi-agente em LLM que automatiza descoberta + reprodução de vulnerabilidades. Paper na HN (38 pts). Linha direta com Claude Mythos / Glasswing.

Pesquisa · arxiv · multi-agente, seguranca, vuln-discovery, reproduction

PostHog: treinando nossos próprios modelos de IA (post técnico — HN 187 pts)

PostHog (analytics OSS) publicou stack completa de treino de modelos próprios — dataset, hyperparams, custo, comparativo vs GPT-5. Caso prático raro de SaaS treinando model próprio.

Pesquisa · posthog · posthog, fine-tuning, sass, custom-model

Mercado

Anthropic fecha rodada de USD 30B a USD 900B+ de valuation e ultrapassa OpenAI

Anthropic está fechando uma rodada de USD 30B a valuation USD 900B+, ultrapassando a OpenAI pela primeira vez. Projeção: USD 10.9B em receita no Q2 e primeiro trimestre operacional positivo. Investidores precificam caminho para USD 50B+ ARR em 18 meses.

Mercado · axios · anthropic, funding, valuation, openai, jobs

Comunidade

Simon Willison: 'Acho que Anthropic e OpenAI encontraram product-market fit

Post de Simon Willison foi #1 do Hacker News (552 pts). Tese: depois de 3 anos de hype, Anthropic e OpenAI atingiram PMF de verdade — não pelo chatbot, mas pelo agente que executa trabalho.

Comunidade · simonwillison.net · simon-willison, pmf, anthropic, openai, analise

DuckDuckGo cresce 28% em uma semana após Google insistir que 'as pessoas amam o AI Mode

DuckDuckGo registrou +28% de visitas na semana seguinte à declaração do Google de que 'usuários adoram' o AI Mode. HN #1 com 591 pts. Sinal claro de backlash ao AI-everywhere.

Comunidade · pcgamer · duckduckgo, google, ai-mode, backlash, search

Tech CEOs estão sofrendo de 'AI psychosis', diz reportagem da TechCrunch

Reportagem viralizada (HN 502 pts) sobre CEOs de tecnologia exibindo padrões de pensamento grandioso e detachment causados por uso intenso de LLMs como espelho. Termo 'AI psychosis' está virando vocabulário comum.

Comunidade · techcrunch · ai-psychosis, cultura, liderança, hype

YouTube vai rotular automaticamente vídeos gerados por IA (HN 385 pts)

YouTube anunciou rotulagem automática de conteúdo gerado por IA, usando sinais de procedência (C2PA) + classificador próprio. Primeira plataforma grande a tornar isso default.

Comunidade · youtube · youtube, ai-label, procedencia, c2pa

Simon Willison: vibe coding e agentic engineering estão convergindo (mais do que eu gostaria)

Simon Willison admite que a fronteira entre 'vibe coding' (não reviso, só rodo) e 'agentic engineering' (reviso cuidadosamente cada linha do agente) está sumindo no fluxo dele — mesmo em código de produção, à medida que Claude Code e Codex ficam mais confiáveis.

Comunidade · simonwillison-net · simon-willison, vibe-coding, agentic-engineering, claude-code, codex

Jensen Huang: Taiwan é o epicentro da revolução de IA

CEO da NVIDIA, Jensen Huang, declarou em visita oficial que Taiwan é o epicentro da revolução de IA — referência direta à TSMC como fornecedora indispensável da pilha de compute. Discussão se conecta ao debate sobre soberania de IA (sem fábrica e energia próprias, não há soberania real).

Comunidade · reuters · nvidia, taiwan, tsmc, geopolítica, soberania-ia

Fortune: quem é Andrej Karpathy, o inventor de 'vibe coding' que migrou para a Anthropic

Perfil da Fortune sobre Andrej Karpathy após migração para Anthropic em 19/05. Ele vai liderar um time focado em usar Claude para acelerar pesquisa de pretraining. O movimento confirma a tese de 'Anthropic como destino de elite' e dá contexto histórico para o termo 'vibe coding' que ele popularizou.

Comunidade · fortune · karpathy, anthropic, vibe-coding, talent-acquisition, pretraining

Simon Willison: 'Your AI Use Is Breaking My Brain' — o zombie internet

Ensaio do Simon Willison sobre a 'zombie internet': conteúdo que parece feito por humano mas é IA, multiplicando-se em produto, search e social. Conversa direta com o post 'I'm Tired of AI-Generated Answers' (HN top de hoje).

Comunidade · simonwillison-net · simon-willison, ai-slop, zombie-internet, ux, ai-fatigue

Ripgrep adota AI Policy explícita (HN 32 pts, mas sintomático)

Andrew Gallant (autor do ripgrep) publicou AI Policy explícita para contribuições. Política: PRs precisam declarar uso de IA, e código gerado sem revisão humana é rejeitado.

Comunidade · github · ripgrep, ai-policy, oss, burntsushi, contribuicao

I'm Tired of AI-Generated Answers (HN)

Post curto que está bombando no HN sobre fadiga com respostas geradas por IA — UX padrão (lista com bullets, hedging excessivo, longo demais) virou ruído. Sintetiza o sentimento crescente contra 'AI slop' em produto e em search.

Comunidade · hacker-news · opinião, ai-fatigue, slop, ux