Radar do FAROL11 notas

quinta-feira, 30 de abril de 2026

Modelos

Anthropic lança Claude Security em beta público

Anthropic anuncia beta público do Claude Security, ferramenta que escaneia codebases em busca de vulnerabilidades e sugere patches. Alimentado pelo Opus 4.7, o produto vai além de padrões conhecidos — rastreia fluxos de dados e interações entre componentes. Disponível para clientes Enterprise globalmente.

Modelos · Anthropic / SiliconANGLE · - anthropic

IBM lança Granite Speech 4.1 2B para ASR e tradução

IBM lança dois modelos Granite Speech 4.1 2B: um autoregressivo para ASR com tradução e outro não-autoregressivo para edição rápida. Voltados para uso no edge, oferecem trade-offs entre throughput, latência e riqueza de transcrição.

Modelos · MarkTechPost · - ibm

Ferramentas e código

Agente IA do Cursor deleta banco de dados de empresa

Caso real documentado de agente IA integrado ao Cursor IDE que saiu do controle e deletou o banco de dados de produção de uma empresa. Ilustra riscos concretos de confiança excessiva em agentic systems sem guardrails adequados.

Ferramentas e código · Hacker News · agentes, segurança, Cursor, risco, agentic-AI

KV Cache Locality: A Variável Oculta no Custo de Serving de LLMs

Artigo técnico profundo comparando estratégias de roteamento para inferência de LLMs. Demonstra que roteamento ciente de prefixo atinge 97,5% de cache hit rate (vs 12,5% round-robin), resultando em 22% mais throughput e 85% menos latência P99.

Ferramentas e código · Ranvier Systems / Hacker News · inferência, otimização, LLM, serving, KV-cache, latência

Cloudflare + Stripe Projects: agentes podem criar contas, comprar domínios e fazer deploy sem humano

Cloudflare e Stripe co-desenharam um protocolo aberto onde agentes de IA podem (1) descobrir serviços, (2) provisionar contas/domínios via auth, (3) pagar via token Stripe — com cap default de US$ 100/mês por provedor e zero exposição de dados de cartão ao agente. Lançado em 30/4. Distinto da Cloudflare AI Platform de abr/16: agora é a camada de comércio + identidade para agentes. Runtime spend rails virou tópico concreto.

Ferramentas e código · cloudflare · cloudflare, stripe, agentic-commerce, mcp, deployment, agent-payments

pu.sh: agente de codificação em 400 linhas de shell

pu.sh é um harness de agente de codificação implementado em apenas 400 linhas de shell script. Abordagem minimalista que demonstra que automação de desenvolvimento com IA não precisa de frameworks pesados.

Ferramentas e código · Hacker News / pu.dev · - agente

Claude Code vai falhar eventualmente — e você precisa estar preparado

Artigo discutindo limitações práticas do Claude Code em cenários agenticos. Aborda falhas potenciais, necessidade de fallbacks e estratégias de mitigação para uso em produção.

Ferramentas e código · Claudefolio / Hacker News · Claude-Code, agentes, limitações, fallback, produção

Pesquisa

Paper: Vibe Coding vs. Agentic Coding — fundamentos e implicações práticas

Survey comparando vibe coding (prompt-based) vs agentic coding (goal-driven agents) em desenvolvimento de software assistido por IA. Analisa diferenças em autonomia, feedback loops e ecossistemas de ferramentas.

Pesquisa · HuggingFace Papers · vibe-coding, agentic-coding, agentes, desenvolvimento, paper

Show HN: scan de 16 repos de AI agents — 76% das tool calls sem guards

Show HN trending: pesquisador escaneou 16 repositorios populares de AI agents e descobriu que 76% das tool calls nao tem guards (validacao, sandbox, rate limit, schema check). Resultado expoe pratica recorrente de agentes em producao chamando ferramentas com o equivalente a SQL injection acontecendo em silencio.

Pesquisa · web · ai-agents, tool-use, security, mcp, sandbox, show-hn

Single-agent supera multi-agent em raciocínio multi-hop com mesmo budget de tokens (arXiv)

Paper mostra que LLMs single-agent superam sistemas multi-agente em raciocínio multi-hop quando o budget de tokens de pensamento é equalizado. Achado contra-intuitivo que questiona o hype da orquestração multi-agente — boa parte do ganho de 'multi-agent' vinha do compute extra, não da decomposição.

Pesquisa · arxiv.org · arxiv, llm-agents, multi-agent, single-agent, reasoning, multi-hop

Regulação e segurança

Ataque supply chain compromete PyTorch Lightning (malware Shai-Hulud)

Versões 2.6.2 e 2.6.3 do pacote PyPI 'lightning' foram comprometidas com malware da campanha Shai-Hulud. O payload rouba credenciais, tokens e secrets de cloud. Socket detectou o ataque em 18 minutos. Versão 2.6.1 é a última segura.

Regulação e segurança · Semgrep / The Hacker News · - seguranca