Anthropic anunciou no dia 13/05 que o uso do Agent SDK e do claude-p passa a consumir um credito dedicado, separado dos limites interativos das assinaturas Pro/Max/Team. Mudanca entra em vigor 15 de junho e impacta diretamente fluxos agenticos rodando 24/7.
ByteDance Research liberou em 15/05 o Lance: modelo any-to-any que combina geração de imagem, geração de vídeo, edição de imagem e compreensão de vídeo numa arquitetura única, com base no Qwen2.5-VL-3B-Instruct. Apache-2. Trending score #1 em HF nesta semana (706), 757 likes em 9 dias. Importa porque é o primeiro any-to-any 3B com peso aberto e licença permissiva — viabiliza fine-tuning em GPU consumer e pode acelerar pipeline criativo open source contra Sora/Veo proprietários.
Notion 3.5 (13/05) transforma o workspace em hub para agentes — Workers (runtime hosted para codigo custom em sandbox), External Agents API com integracao nativa para Claude, Codex e Decagon, database sync com Zendesk/Salesforce/Postgres, e webhooks bidirecionais. CLI para deploy: curl -fsSL | bash. Workers gratis ate 11/08, depois rodam em creditos Notion.
Show HN: a Sleuth lancou Sx, um package manager open-source para AI skills, MCPs e slash-commands. Resolve o problema de 'onde guardar e como compartilhar' artefatos de agentes — relevante para quem opera plugins de Claude Code.
Show HN viral: utilitario para queimar tokens de propósito — util para load test, benchmark de custo, ou estressar rate-limiting de providers de LLM antes que sua aplicacao chegue em prod.
Analise do memorando de 52 paginas que Ilya Sutskever produziu antes da tentativa de saida de Sam Altman em nov/2023 — material veio a publico via deposicao em processo judicial. Documenta tensoes de governanca que moldaram a estrutura atual da OpenAI.
Framework de RL game-theoretic para co-otimizar TTFT, emissoes de carbono, agua e custo energetico em inferencia LLM em datacenters cloud. Reducoes reportadas: -18% TTFT, -33% CO2, -43% agua, -11% energia. Submetido 13/05.
Framework de RL que treina um 'prompter' leve via destilacao iterativa de experiencia, otimizando politicas de prompt para maximizar reward de um LLM grande e congelado. Foco em raciocinio multi-passo e uso de ferramentas em black-box LLMs. Submetido 14/05.
Paper de 12/05 que ataca o problema de escolher topologia de comunicacao (chain, star, mesh) entre agentes LLM sem diagnostico previo. Propoe um espectro baseado em Successor Representation que prediz drift, consenso e robustez antes da inferencia.
Benchmark multi-agente que junta leilao, oferta oculta, barganha, blefe, modelagem de oponente e alocacao de recursos num jogo long-horizon — para avaliar LLMs como agentes estrategicos em informacao imperfeita e interacao adversaria.
Tweet de Mitchell Hashimoto (founder HashiCorp) viralizou no HN com 488 pontos: argumenta que empresas inteiras estao em 'psicose de IA' — adotando ferramentas e narrativas sem checar se geram valor real. Bom contraponto ao hype atual.
Investigacao motivada pelo viral assistente self-hosted 'ClawdBot' (com media de 2.6 CVEs por dia) varreu 1 milhao de servicos de IA expostos. Conclusao: infra de IA esta mais vulneravel, exposta e mal-configurada do que qualquer outro software ja investigado pelos autores.