swyx publicou no Latent Space (madrugada 20/05) o AINews consolidado do Google I/O 2026 — referência obrigatória pra quem quer entender o pacote sem ver o keynote. Cobre Gemini 3.5 Flash (motor padrão), Gemini Omni (NanoBanana for Video — geração/edição de vídeo multimodal), Spark (agentes background em VMs cloud, US$ 100/mês AI Ultra) e Antigravity 2.0 (desktop + CLI + SDK + Managed Agents). Linha narrativa do recap: Google não está mais 'atrás' — está montando o stack agentic mais completo entre os labs. Trade-off é Pro adiado pra junho, gerando groans na plateia.
Simon Willison publicou (19/05 noite) sua análise pós-I/O do Gemini 3.5 Flash. Ponto central: o modelo subiu pra US$ 1,50/US$ 9 por 1M tokens (input/output) — mais caro que o Flash anterior, mas Google declarou que vai usá-lo como motor padrão de praticamente tudo (Gemini app, Search, Antigravity 2.0, Gemini API). Willison nota que a velocidade prometida (4× outros frontier models, 12× numa variante otimizada) muda a economia de agentes: vale pagar mais por token se a latência colapsa o tempo de loop. Janela 'small fast workhorse model' tá fechando.
Claude Developer Platform adicionou Fast mode no Opus 4.7 (geração de tokens acelerada, research preview) e Cache Diagnostics em public beta — agora dá para explicar prompt cache misses no endpoint Messages. Diagnóstico explícito do cache reduz tempo de debug de prompts longos.
Google DeepMind anunciou na madrugada de 20/05 o Running Guide Agent — agente que ajuda atletas cegos e de baixa visão a correr de forma independente, sem linhas físicas no chão ou guias humanos. Combina zero-latency edge computing com deep-world understanding em tempo real. Atletas usam para 'navegar com confiança total não-assistida'. É o primeiro release pós-I/O 2026 e move o discurso DeepMind de hype agentic para aplicação humana mensurável. Casa com a linha 'human-AI collaboration' que o Demis tem defendido desde o I/O.
Snapshot do trending do HuggingFace às 20h — destaques que ainda não estavam na base. Lance da ByteDance-Research (any-to-any multimodal, 3B, base Qwen2.5-VL-3B) já era trending mas agora hospeda também o MiniCPM-V 4.6 (image-text-to-text on-device, 166K downloads), o Supertonic-3 (TTS multilíngue on-device, 31K downloads) e variantes Unsloth do Qwen3.6-27B-MTP-GGUF e Qwen3.6-35B-A3B-MTP-GGUF — referência ao "pelicano no laptop" que o Simon Willison destacou ontem.
Boris Siegenthaler, fundador da Infomaniak (provedora suíça de cloud), transferiu hoje (20/05) a maioria dos direitos de voto da empresa para a Infomaniak Foundation — movimento irrevogável que coloca um dos pioneiros da web europeia fora do alcance de takeover. A fundação tem dupla missão: financiar projetos de soberania digital/ambiente, e blindar a Infomaniak Group SA. A infra é 100% suíça, alimentada por energia renovável e com calor residual reaproveitado em distrital. Oferece API OpenAI-compatible com modelos open-source rodando dentro da Suíça — pitch direto contra hyperscalers americanos. Tópico subiu pra ~80 pontos no Hacker News na noite de 19/05.
A OpenAI virou C2PA Conforming Generator e está integrando o watermarking SynthID da Google DeepMind nas imagens geradas pelo ChatGPT, Codex e API. Lançou também, em preview, uma ferramenta pública de verificação onde qualquer um pode subir uma imagem e checar se saiu de modelos OpenAI. A lógica é redundância — C2PA carrega metadado rico, SynthID sobrevive a screenshot e transformações. Juntos, formam uma camada de proveniência mais resiliente do que cada um isolado.
Anthropic lançou Claude for Small Business — Claude entra diretamente em QuickBooks, PayPal, HubSpot, Canva, Docusign, Google Workspace e Microsoft 365, com workflows prontos para folha de pagamento, faturamento, vendas, marketing e fechamento de mês.
Ferramentas e código · anthropic · anthropic, claude, smb, workflows
Mais de 20 novos MCP connectors voltados a Direito (pesquisa, contratos, discovery, gestão de casos, legal aid) e 12 plugins por área de prática. Movimento simétrico ao lançamento Tax & Legal com KPMG.
Repo 'remove-ai-watermarks' (wiltodelta) bombou na frontpage do HN com 297 pontos — CLI + lib que detecta e remove marcas d'água visíveis e invisíveis (incluindo SynthID-style) em imagens geradas por IA. Reabre o debate sobre proveniência: Google SynthID, C2PA e o esforço setorial de 'invisible watermark' são tão fáceis de quebrar que ferramenta de uma pessoa derruba? Discussão na thread divide entre 'segurança por obscuridade não escala' e 'é fundamentalmente impossível, watermark robusto é miragem'. Sinal de que o stack de provenance precisa migrar pra cripto-assinatura na origem.
Simon Willison lançou ontem à noite a 0.32 do plugin llm-gemini para a sua CLI 'llm'. Cobre Gemini 3.5 Flash GA (com pricing novo), Gemini Omni para vídeo e suporte a tools nativos (function calling). Caminho mais rápido pra quem quer testar 3.5 Flash sem mexer no SDK do Google. Padrão Simon — release dentro de 2-3h após o keynote, com testes embutidos. Foi precedida pela 0.32a0 ('alpha zero') publicada minutos depois do anúncio do I/O.
VS Code 1.121 trouxe suporte nativo a "Remote Agents" — sessions de coding agent rodando em servidor remoto (não no laptop) com sincronização de estado pelo editor. Inclui preview built-in para HTML e Mermaid e melhorias na integração com Claude Code (background sessions, attach/detach estável no Windows Terminal). Movimento claro de adoção do paradigma agentic dentro de editores mainstream.
AAAS / Science anunciou (e Cornell repercutiu 19/05 noite) o Newcomb Cleveland 2026 — o prêmio de paper do ano da Science — para 'Durably reducing conspiracy beliefs through dialogues with AI' (DOI 10.1126/science.adq1814). Estudo com 2k+ pessoas: cada uma escreveu no que acreditava e que provas tinha, depois conversou 3× com chatbot GenAI. O bot não dizia 'isso é falso' — respondia ao argumento específico com paciência, exemplos, evidências. Resultado: ~20% saíram acreditando menos na teoria, efeito sustentado por meses. Item compartilhado na comunidade brasileira 'Aprendizados sobre IA e Educação' como coluna do Zero Hora — exemplo de uso pró-social que precisa entrar no léxico contra o discurso 'IA distorce realidade'.
Anthropic rastreia 6 semanas de complaints sobre qualidade do Claude Code até 3 mudanças sobrepostas — modificações em routing, cache e instrução de sistema que se reforçavam. Postmortem detalhado, raro no setor.
Cobertura InfoQ do Code with Claude London: Managed Agents (Anthropic gerencia ciclo de vida do agente, não só o turno), Proactive Workflows (agentes que disparam tarefas sem ser convocados) e o framework 'Capability Curve' que Anthropic usa internamente para projetar tarefas que LLMs vão dominar.
Paper publicado por Memtensor Research Group (18/05) e bombando no HF trending desde 19/05: SkillsVote — framework de governança para agentes LLM long-horizon que gerencia skills reutilizáveis via processo estruturado de coleta, recomendação e evolução. Resposta direta ao problema do 'context engineering' em escala: quando o agente tem +50 skills disponíveis, como escolher? Como evoluir? Como aposentar? SkillsVote propõe votação social entre skills baseada em performance histórica + recomendação contextual. Pareado com SemaClaw (item de 19/05) — sinal de que 'harness engineering' virou área de pesquisa estabelecida em maio/2026.
Segundo WSJ (via Reuters), OpenAI prepara filing para IPO em setembro de 2026, com avaliação esperada acima de US$ 500 bilhões. Movimento sela a transição de pesquisa para Big Cap, junto com plataforma de ads self-serve e Deployment Company.
Polymarket abriu uma seção 'Privates' com 23 mercados de previsão sobre IPO timing e valuation de empresas de capital fechado — Anthropic, OpenAI, SpaceX, Stripe, Kraken, Anduril, Canva, Databricks, Epic Games, Lambda, Neuralink e Perplexity. Dados de resolução exclusivos da Nasdaq Private Market. Mercados estruturados como 'valuation ladders' (múltiplas faixas). OpenAI até 31/Dez: US$500B a US$3T. SpaceX até 30/Jun: US$1,3T a US$4T. É a primeira vez que varejo consegue precificar sentimento sobre essas startups bilionárias sem deter equity.
Cohere (Canadá, US$ 6,8bi última rodada) absorve Aleph Alpha (Alemanha), criando o maior player ocidental de IA frontier fora do eixo OpenAI/Anthropic/Google. Sinal forte de que a janela para 'frontier independent' fechou.
Comunidade · web-search · cohere, aleph-alpha, m&a, europa, soberania
Em palestra no AI Ascent 2026 (Sequoia), Jim Fan — lead do Embodied Autonomous Research da NVIDIA — declarou que o "endgame" da robótica já é roadmap técnico definido, não visão distante. Tese central: "The Great Parallel" — a robótica vai seguir o caminho dos LLMs (pre-training, alignment, reasoning, auto-research). Paradigma mudando de VLAs (language- first) para WAMs (World-Action Models, video-first), com o DreamZero da NVIDIA como exemplo. Estratégia de dados: teleoperação humana sendo trocada por "sensorized human data" — EgoScale mostrou que 21.000 horas de vídeo egocêntrico bastam para prever sucesso robótico. Previsões: Physical Turing Test em 2-3 anos; Physical Auto-Research (robôs que projetam o próximo robô) em 2040.
Comunidade · humanoidsdaily.com · robotica, nvidia, jim-fan, vla, wam, embodied-ai
The Verge publicou (19/05 noite) ensaio-análise do Google Search pós-I/O 2026: a barra de busca virou interface universal — busca textual, voz, imagem, agentes 24/7, criação de widgets, geração de UI in-line, deep research, comparações de produto. Argumento central: Google reorganizou os últimos 25-30 anos de produto em torno de um único input. Risco: rasura a fronteira entre busca, chat, agente, ferramenta — usuário pode ficar perdido. Oportunidade: monopólio da intenção do usuário fica ainda mais consolidado. Ponto crítico de leitura para quem ainda enxerga 'search' como vertical separado de 'IA generativa'.
Comunidade · theverge · google, search, ai-mode, agentic-search, gemini-flash, verge
Simon Willison publicou os slides anotados da sua lightning talk no PyCon US 2026 — 'Os últimos 6 meses em LLMs em 5 minutos'. Tese central: novembro/2025 foi o ponto de inflexão (especialmente pra coding), e o que aconteceu desde então redefine o que esperar de modelos pequenos, agentes, e coding tools. Material vira referência rápida pra explicar pra time/board onde estamos. Vale pra quem perdeu o último semestre e quer pegar o fio em 10 min de leitura. Casa com o pacote do dia (Karpathy → Anthropic, Google I/O, Gemini 3.5).
Comunidade · simonwillison · simon-willison, pycon, recap, llm, november-2025-inflection, coding
A Anthropic está rodando hoje e amanhã (19-20 maio) o "Code with Claude London" — segunda etapa do tour pós-SF (que foi em 06 de maio). Foco em workshops hands-on, demos de produção e Day-1 keynote streamado ao vivo. Tópicos: o que os modelos de hoje fazem em produção, build de agentes long-horizon na Claude Platform, multi-repo work, parallel agents e infra de execução. Dia 20 também tem o "Code with Claude: Extended London" — versão para indie devs e early-stage founders. Tokyo vem em 5-6/junho.
Comunidade · claude.com · anthropic, claude-code, evento, london, devrel
Sarvam AI apresenta os óculos Kaze AI no India AI Impact Summit; primeiro-ministro Narendra Modi os experimenta publicamente. Rodam o modelo indígena da Sarvam e suportam 10+ línguas indianas. Soft-power tech a serviço de soberania de IA do BRICS.
Comunidade · web-search · india, sarvam, hardware, glasses, soberania-linguistica