Anthropic libera em research preview o Claude Dreaming: o sistema revisa o trabalho entre sessões, identifica padrões e atualiza arquivos com preferências do usuário e contexto.
Anthropic confirma que investiga acesso nao-autorizado ao Claude Mythos Preview por meio de uma conta de fornecedor (contractor). Bloomberg apurou que usuarios em forum privado conseguiram rodar prompts no modelo via credencial vazada. Mythos Preview e o frontier model com capacidades cyber de elite (encontrou RCE de 17 anos em FreeBSD/NFS sozinho). Caso reforca tese de que credenciais de terceiros sao o vetor mais fraco e levanta duvidas sobre os $100M em creditos do Project Glasswing prometidos a 40 organizacoes de software critico.
Grok 4.3 entra disponível via API com raciocínio integrado, 1M de contexto, entrada nativa de vídeo e preço $1.25/M tokens — 8 modelos legados serão aposentados em 15/maio.
OpenAI adiciona à API três novos modelos de voz: GPT-Realtime-2 para raciocínio em voz, GPT-Realtime-Translate para tradução simultânea (70+ idiomas) e GPT-Realtime-Whisper para transcrição streaming.
Modelos · web-search · openai, voice, realtime, whisper, translate, api
HiDream-AI publicou em 8/5 o HiDream-O1-Image, modelo image-text-to-image construido sobre arquitetura qwen3-vl, licenca MIT. Trending score 97 no Hub apos 24h. Combina geracao + edicao de imagem em pipeline unificado. Concorrente direto do Z-Image e do Tongyi-MAI/Z-Image que vinha dominando o trending da semana.
Anthropic estende o Claude ao Microsoft 365 com add-ins para Excel, PowerPoint e Word, com Outlook a caminho — disputando o terreno do Copilot dentro do Office.
Ferramentas e código · web-search · anthropic, claude, microsoft-365, excel, powerpoint, word
GitHub anunciou em 8/5 o Spec-Kit, toolkit open-source para spec-driven development com agentes de codigo (Claude Code, Cursor, Copilot agent). Ideia: voce escreve uma spec executavel em YAML/Markdown, o kit gera testes, scaffolding e tasks que o agente segue de forma estruturada — em vez de prompt cru. Tenta resolver o problema de 'agent reviewer' nao saber se mudanca esta dentro do escopo.
CISA, NSA, ASD ACSC (Australia), Centre for Cyber Security (Canada), NCSC-UK e NCSC-NZ publicaram advisory conjunto 'Careful Adoption of Agentic Artificial Intelligence (AI) Services'. Mensagem: agentes autonomos sao perigosos demais para rollout rapido em ambientes corporativos. Recomendam: sandboxing por padrao, principle-of-least-privilege em ferramentas, audit trail de toda chamada externa, kill-switch humano, threat-modeling especifico para prompt injection.
OpenAI libera Workspace Agents — agentes corporativos repetitiveis cruzando ChatGPT e Slack — para ChatGPT Enterprise com Enterprise Key Management. Empurra OpenAI para o territorio que o Anthropic acabou de ocupar com Claude Managed Agents.
Heretic 1.3, atualização de stack para rodar LLMs localmente, somou 273 upvotes e 47 comentários em 7 horas no r/LocalLLaMA — promete saídas reproduzíveis, benchmarking integrado e menor pico de VRAM.
Simon Willison liberou em 5-7 de maio múltiplas releases: llm-gemini 0.31 (Gemini provider para o LLM CLI), llm-echo 0.5a0 (mock provider), datasette-llm 0.1a7 e datasette-referrer-policy 0.1.
Ferramentas e código · blog · simon-willison, llm-cli, datasette, gemini, plugins
AgentScope (time da Alibaba) liberou em 9/5 a v1.1.6 do QwenPaw — assistente pessoal local-first construido em cima da familia Qwen3.6. Novidades: titulos de sessao gerados por LLM, dashboard de uso de tokens, render de diagramas Mermaid, CLI para instalar/desinstalar/testar skills, API de status de agente. Ponto importante: arquitetura modela colaboracao entre 'small + large' models — pequeno responde rapido, grande entra quando o pequeno declara incerteza.
Daniel Zheng, Ingrid von Glehn, Lars Buesing, Daniel M. Roy, Martin Wattenberg e outros publicaram em 8/5/2026 o paper 'AI Co-Mathematician: Accelerating Mathematicians with Agentic AI' (22 paginas, cs.AI). Apresenta agentes que conversam com matematicos profissionais durante a prova, gerenciam lemmas/conjecturas como contexto vivo, e recuperam literatura relevante. Continuacao da agenda Gemini Deep Think aplicada a matematica avancada.
Em 7 de maio, Google introduziu atualizações no AlphaEvolve, agente de código baseado em Gemini que projeta algoritmos avançados — agora avança em problemas abertos de matemática/CS e otimiza algoritmos já em produção.
Pesquisa · web-search · google, deepmind, alphaevolve, gemini, coding-agent, math
Pesquisadores publicaram em 5/5 o paper ARGUS, que introduz o benchmark **AgentLure** capturando ataques de prompt-injection conscientes de contexto contra agentes de LLM (nao mais o ataque ingenuo, mas adversario que ja sabe a estrutura do prompt do sistema). Junto com o benchmark, o paper propoe uma defesa baseada em verificacao redundante por agente independente. Resultados sugerem que agentes hoje em producao falham em 60-80 porcento dos casos contextuais.
Pesquisa · arxiv · argus, agentlure, prompt-injection, agents, security, paper
Paper publicado em 7 de maio apresenta o VibeServe, primeiro loop agentic que gera stacks inteiros de LLM serving end-to-end — outer loop planeja designs, inner loop implementa, valida e mede performance.
Moonshot AI (criadora do Kimi K2) levantou US$ 2 bilhões a um valuation reportado de US$ 20bi — sinal do apetite por modelos open-source chineses como alternativa mais barata aos frontier americanos.
Mercado · web-search · moonshot-ai, kimi, china, open-source, funding
Sierra, startup de agentes de atendimento fundada pelo ex-co-CEO da Salesforce e atual chairman do board da OpenAI Bret Taylor, levanta cerca de US$ 1 bilhão na nova rodada — semana mais forte de funding em IA enterprise.
Em 7 de maio, a Casa Branca anunciou planos de redigir uma ordem executiva para auditar novos modelos de IA — processo comparado à aprovação de drogas pelo FDA — em resposta direta ao Mythos da Anthropic, que encontra vulnerabilidades de rede.
No AI Ascent 2026 da Sequoia, Andrej Karpathy formaliza a ideia de \"Software 3.0\" — código escrito por prompts, contexto, agentes, ferramentas e verificação — e separa o vibe coding (raise the floor) do agentic engineering (manter qualidade profissional).
Comunidade · web-search · karpathy, sequoia, software-3-0, vibe-coding, agentic-engineering
Levantamento da CNBC: NVIDIA acumula US$ 40B+ em equity em 2026, financiando toda a cadeia de IA — US$ 30B em OpenAI, US$ 3.2B em Corning, US$ 2.1B em IREN — para garantir capacidade e bloquear concorrencia em silicio.
Comunidade · cnbc · nvidia, capex, equity-investments, ai-economy, supply-chain
Demis Hassabis (CEO DeepMind), no India AI Impact Summit, manteve a previsao de AGI em ~5 anos e disse que tera '10x o impacto da Revolucao Industrial em 1/10 do tempo'. Pediu guardrails cientificos urgentes e mais investimento em alinhamento.
Comunidade · yahoo-finance · deepmind, hassabis, agi, india-summit, regulacao
Simon Willison cobriu em 5/5 a abertura do cafe da Andon Labs em Stockholm — operacao integral comandada por IA: braco robotico para preparar bebidas, kiosk com agente conversacional para atendimento, sistema de visao para gerenciar estoque, e integracao com Claude para resolver casos fora do script. Sem barista humano em horario comercial. Item ganha tracao porque toca em duas teses: 'agentes operam o mundo fisico' e 'IA substitui empregos de servico'.
Comunidade · simonwillison · andon-labs, cafe, real-world-ai, stockholm, simon-willison, embodied-ai