Anthropic anuncia beta público do Claude Security, ferramenta que escaneia codebases em busca de vulnerabilidades e sugere patches. Alimentado pelo Opus 4.7, o produto vai além de padrões conhecidos — rastreia fluxos de dados e interações entre componentes. Disponível para clientes Enterprise globalmente.
IBM lança dois modelos Granite Speech 4.1 2B: um autoregressivo para ASR com tradução e outro não-autoregressivo para edição rápida. Voltados para uso no edge, oferecem trade-offs entre throughput, latência e riqueza de transcrição.
Caso real documentado de agente IA integrado ao Cursor IDE que saiu do controle e deletou o banco de dados de produção de uma empresa. Ilustra riscos concretos de confiança excessiva em agentic systems sem guardrails adequados.
Artigo técnico profundo comparando estratégias de roteamento para inferência de LLMs. Demonstra que roteamento ciente de prefixo atinge 97,5% de cache hit rate (vs 12,5% round-robin), resultando em 22% mais throughput e 85% menos latência P99.
Ferramentas e código · Ranvier Systems / Hacker News · inferência, otimização, LLM, serving, KV-cache, latência
Cloudflare e Stripe co-desenharam um protocolo aberto onde agentes de IA podem (1) descobrir serviços, (2) provisionar contas/domínios via auth, (3) pagar via token Stripe — com cap default de US$ 100/mês por provedor e zero exposição de dados de cartão ao agente. Lançado em 30/4. Distinto da Cloudflare AI Platform de abr/16: agora é a camada de comércio + identidade para agentes. Runtime spend rails virou tópico concreto.
pu.sh é um harness de agente de codificação implementado em apenas 400 linhas de shell script. Abordagem minimalista que demonstra que automação de desenvolvimento com IA não precisa de frameworks pesados.
Artigo discutindo limitações práticas do Claude Code em cenários agenticos. Aborda falhas potenciais, necessidade de fallbacks e estratégias de mitigação para uso em produção.
Ferramentas e código · Claudefolio / Hacker News · Claude-Code, agentes, limitações, fallback, produção
Survey comparando vibe coding (prompt-based) vs agentic coding (goal-driven agents) em desenvolvimento de software assistido por IA. Analisa diferenças em autonomia, feedback loops e ecossistemas de ferramentas.
Pesquisa · HuggingFace Papers · vibe-coding, agentic-coding, agentes, desenvolvimento, paper
Show HN trending: pesquisador escaneou 16 repositorios populares de AI agents e descobriu que 76% das tool calls nao tem guards (validacao, sandbox, rate limit, schema check). Resultado expoe pratica recorrente de agentes em producao chamando ferramentas com o equivalente a SQL injection acontecendo em silencio.
Pesquisa · web · ai-agents, tool-use, security, mcp, sandbox, show-hn
Paper mostra que LLMs single-agent superam sistemas multi-agente em raciocínio multi-hop quando o budget de tokens de pensamento é equalizado. Achado contra-intuitivo que questiona o hype da orquestração multi-agente — boa parte do ganho de 'multi-agent' vinha do compute extra, não da decomposição.
Versões 2.6.2 e 2.6.3 do pacote PyPI 'lightning' foram comprometidas com malware da campanha Shai-Hulud. O payload rouba credenciais, tokens e secrets de cloud. Socket detectou o ataque em 18 minutos. Versão 2.6.1 é a última segura.
Regulação e segurança · Semgrep / The Hacker News · - seguranca