Radar do FAROL25 notas

quarta-feira, 20 de maio de 2026

Modelos

[Latent Space AINews] Recap do Google I/O 2026: Gemini 3.5 Flash, Omni (NanoBanana for Video), Spark (background agents) e Antigravity 2.0

swyx publicou no Latent Space (madrugada 20/05) o AINews consolidado do Google I/O 2026 — referência obrigatória pra quem quer entender o pacote sem ver o keynote. Cobre Gemini 3.5 Flash (motor padrão), Gemini Omni (NanoBanana for Video — geração/edição de vídeo multimodal), Spark (agentes background em VMs cloud, US$ 100/mês AI Ultra) e Antigravity 2.0 (desktop + CLI + SDK + Managed Agents). Linha narrativa do recap: Google não está mais 'atrás' — está montando o stack agentic mais completo entre os labs. Trade-off é Pro adiado pra junho, gerando groans na plateia.

Modelos · latent-space · swyx, latent-space, google-io, gemini, antigravity, spark

xAI: Grok 4.3 com Skills + Connectors (SharePoint, Outlook, Notion, GitHub) + Grok Build TUI

Grok 4.3 ganha Skills (live em web/iOS/Android), Connectors para SharePoint/Outlook/OneDrive/Google Workspace/Notion/GitHub/Linear, Quality Mode no Imagine API (texto + realismo) e Grok Build beta — TUI interativa + headless scripting + Agent Client Protocol — para assinantes SuperGrok Heavy.

Modelos · releasebot · xai, grok, agents, mcp, acp

Simon Willison disseca Gemini 3.5 Flash: 'mais caro que 2.5 Flash, mas Google planeja usar pra tudo

Simon Willison publicou (19/05 noite) sua análise pós-I/O do Gemini 3.5 Flash. Ponto central: o modelo subiu pra US$ 1,50/US$ 9 por 1M tokens (input/output) — mais caro que o Flash anterior, mas Google declarou que vai usá-lo como motor padrão de praticamente tudo (Gemini app, Search, Antigravity 2.0, Gemini API). Willison nota que a velocidade prometida (4× outros frontier models, 12× numa variante otimizada) muda a economia de agentes: vale pagar mais por token se a latência colapsa o tempo de loop. Janela 'small fast workhorse model' tá fechando.

Modelos · simonwillison · simon-willison, gemini, google, pricing, analysis, llm

Anthropic libera Fast mode no Claude Opus 4.7 + cache diagnostics em beta

Claude Developer Platform adicionou Fast mode no Opus 4.7 (geração de tokens acelerada, research preview) e Cache Diagnostics em public beta — agora dá para explicar prompt cache misses no endpoint Messages. Diagnóstico explícito do cache reduz tempo de debug de prompts longos.

Modelos · releasebot · anthropic, claude, opus-4-7, cache, latency

Google DeepMind lança Running Guide Agent — agente de IA assistiva para corredores cegos/baixa visão (zero-latency edge + deep-world understanding)

Google DeepMind anunciou na madrugada de 20/05 o Running Guide Agent — agente que ajuda atletas cegos e de baixa visão a correr de forma independente, sem linhas físicas no chão ou guias humanos. Combina zero-latency edge computing com deep-world understanding em tempo real. Atletas usam para 'navegar com confiança total não-assistida'. É o primeiro release pós-I/O 2026 e move o discurso DeepMind de hype agentic para aplicação humana mensurável. Casa com a linha 'human-AI collaboration' que o Demis tem defendido desde o I/O.

Modelos · blog-google · google-deepmind, accessibility, edge-computing, vision, embodied-ai, running

HF trending — Mistral 3, ByteDance Lance, MiniCPM-V 4.6 e Supertonic-3 dominam a semana

Snapshot do trending do HuggingFace às 20h — destaques que ainda não estavam na base. Lance da ByteDance-Research (any-to-any multimodal, 3B, base Qwen2.5-VL-3B) já era trending mas agora hospeda também o MiniCPM-V 4.6 (image-text-to-text on-device, 166K downloads), o Supertonic-3 (TTS multilíngue on-device, 31K downloads) e variantes Unsloth do Qwen3.6-27B-MTP-GGUF e Qwen3.6-35B-A3B-MTP-GGUF — referência ao "pelicano no laptop" que o Simon Willison destacou ontem.

Modelos · huggingface.co · huggingface, trending, bytedance, minicpm, supertonic, mistral

Ferramentas e código

Infomaniak transfere controle da empresa para fundação suíça — sovereign cloud + API OpenAI-compatible com modelos open-source hospedados na Suíça

Boris Siegenthaler, fundador da Infomaniak (provedora suíça de cloud), transferiu hoje (20/05) a maioria dos direitos de voto da empresa para a Infomaniak Foundation — movimento irrevogável que coloca um dos pioneiros da web europeia fora do alcance de takeover. A fundação tem dupla missão: financiar projetos de soberania digital/ambiente, e blindar a Infomaniak Group SA. A infra é 100% suíça, alimentada por energia renovável e com calor residual reaproveitado em distrital. Oferece API OpenAI-compatible com modelos open-source rodando dentro da Suíça — pitch direto contra hyperscalers americanos. Tópico subiu pra ~80 pontos no Hacker News na noite de 19/05.

Ferramentas e código · infomaniak · infomaniak, sovereign-cloud, europa, soberania-digital, foundation-model, open-source

OpenAI entra no C2PA e adota SynthID da Google DeepMind como camada extra de proveniência

A OpenAI virou C2PA Conforming Generator e está integrando o watermarking SynthID da Google DeepMind nas imagens geradas pelo ChatGPT, Codex e API. Lançou também, em preview, uma ferramenta pública de verificação onde qualquer um pode subir uma imagem e checar se saiu de modelos OpenAI. A lógica é redundância — C2PA carrega metadado rico, SynthID sobrevive a screenshot e transformações. Juntos, formam uma camada de proveniência mais resiliente do que cada um isolado.

Ferramentas e código · openai.com · openai, c2pa, synthid, provenance, watermarking, deepfake

Claude for Small Business: integração com QuickBooks, PayPal, HubSpot, Canva, Docusign, GSuite, M365

Anthropic lançou Claude for Small Business — Claude entra diretamente em QuickBooks, PayPal, HubSpot, Canva, Docusign, Google Workspace e Microsoft 365, com workflows prontos para folha de pagamento, faturamento, vendas, marketing e fechamento de mês.

Ferramentas e código · anthropic · anthropic, claude, smb, workflows

Anthropic publica 20+ MCP connectors jurídicos e 12 plugins de prática

Mais de 20 novos MCP connectors voltados a Direito (pesquisa, contratos, discovery, gestão de casos, legal aid) e 12 plugins por área de prática. Movimento simétrico ao lançamento Tax & Legal com KPMG.

Ferramentas e código · anthropic · anthropic, mcp, legal, plugins, vertical

Remove-AI-Watermarks — CLI/biblioteca pra remover marca d'água de imagens IA bomba no HN (297 pontos)

Repo 'remove-ai-watermarks' (wiltodelta) bombou na frontpage do HN com 297 pontos — CLI + lib que detecta e remove marcas d'água visíveis e invisíveis (incluindo SynthID-style) em imagens geradas por IA. Reabre o debate sobre proveniência: Google SynthID, C2PA e o esforço setorial de 'invisible watermark' são tão fáceis de quebrar que ferramenta de uma pessoa derruba? Discussão na thread divide entre 'segurança por obscuridade não escala' e 'é fundamentalmente impossível, watermark robusto é miragem'. Sinal de que o stack de provenance precisa migrar pra cripto-assinatura na origem.

Ferramentas e código · hackernews · hackernews, watermark, ai-detection, provenance, c2pa, open-source

llm-gemini 0.32 (Simon Willison): plugin CLI já suporta Gemini 3.5 Flash, Omni e tools nativos

Simon Willison lançou ontem à noite a 0.32 do plugin llm-gemini para a sua CLI 'llm'. Cobre Gemini 3.5 Flash GA (com pricing novo), Gemini Omni para vídeo e suporte a tools nativos (function calling). Caminho mais rápido pra quem quer testar 3.5 Flash sem mexer no SDK do Google. Padrão Simon — release dentro de 2-3h após o keynote, com testes embutidos. Foi precedida pela 0.32a0 ('alpha zero') publicada minutos depois do anúncio do I/O.

Ferramentas e código · simonwillison · simon-willison, llm-cli, gemini, plugin, python, open-source

VS Code 1.121 adiciona Remote Agents e turbina Claude Code

VS Code 1.121 trouxe suporte nativo a "Remote Agents" — sessions de coding agent rodando em servidor remoto (não no laptop) com sincronização de estado pelo editor. Inclui preview built-in para HTML e Mermaid e melhorias na integração com Claude Code (background sessions, attach/detach estável no Windows Terminal). Movimento claro de adoção do paradigma agentic dentro de editores mainstream.

Ferramentas e código · webnews · vscode, claude-code, remote-agents, mermaid, html-preview, editor

Pesquisa

Science premia paper de Cornell com Newcomb Cleveland 2026 — chatbot reduz crença em conspirações em ~20% (efeito durável meses depois)

AAAS / Science anunciou (e Cornell repercutiu 19/05 noite) o Newcomb Cleveland 2026 — o prêmio de paper do ano da Science — para 'Durably reducing conspiracy beliefs through dialogues with AI' (DOI 10.1126/science.adq1814). Estudo com 2k+ pessoas: cada uma escreveu no que acreditava e que provas tinha, depois conversou 3× com chatbot GenAI. O bot não dizia 'isso é falso' — respondia ao argumento específico com paciência, exemplos, evidências. Resultado: ~20% saíram acreditando menos na teoria, efeito sustentado por meses. Item compartilhado na comunidade brasileira 'Aprendizados sobre IA e Educação' como coluna do Zero Hora — exemplo de uso pró-social que precisa entrar no léxico contra o discurso 'IA distorce realidade'.

Pesquisa · cornell · science, cornell, conspiracy-theories, chatbot, durably-reducing-conspiracy, newcomb-cleveland

Anthropic publica postmortem de 6 semanas de queixas sobre qualidade do Claude Code

Anthropic rastreia 6 semanas de complaints sobre qualidade do Claude Code até 3 mudanças sobrepostas — modificações em routing, cache e instrução de sistema que se reforçavam. Postmortem detalhado, raro no setor.

Pesquisa · infoq · anthropic, claude-code, postmortem, quality, transparencia

Code with Claude: Managed Agents, Proactive Workflows e a 'Capability Curve' da Anthropic

Cobertura InfoQ do Code with Claude London: Managed Agents (Anthropic gerencia ciclo de vida do agente, não só o turno), Proactive Workflows (agentes que disparam tarefas sem ser convocados) e o framework 'Capability Curve' que Anthropic usa internamente para projetar tarefas que LLMs vão dominar.

Pesquisa · infoq · anthropic, agents, managed-agents, capability-curve

Memtensor: SkillsVote — framework de governança para agentes LLM long-horizon com skills evolutivas

Paper publicado por Memtensor Research Group (18/05) e bombando no HF trending desde 19/05: SkillsVote — framework de governança para agentes LLM long-horizon que gerencia skills reutilizáveis via processo estruturado de coleta, recomendação e evolução. Resposta direta ao problema do 'context engineering' em escala: quando o agente tem +50 skills disponíveis, como escolher? Como evoluir? Como aposentar? SkillsVote propõe votação social entre skills baseada em performance histórica + recomendação contextual. Pareado com SemaClaw (item de 19/05) — sinal de que 'harness engineering' virou área de pesquisa estabelecida em maio/2026.

Pesquisa · huggingface · memtensor, skillsvote, long-horizon-agents, skills-management, governance, hf-paper

Mercado

OpenAI mira IPO em setembro de 2026

Segundo WSJ (via Reuters), OpenAI prepara filing para IPO em setembro de 2026, com avaliação esperada acima de US$ 500 bilhões. Movimento sela a transição de pesquisa para Big Cap, junto com plataforma de ads self-serve e Deployment Company.

Mercado · reuters · openai, ipo, mercado, finance

Polymarket lança 'Privates' — mercados de previsão sobre IPO e valuation de Anthropic, OpenAI, SpaceX, Stripe (powered by Nasdaq Private Market)

Polymarket abriu uma seção 'Privates' com 23 mercados de previsão sobre IPO timing e valuation de empresas de capital fechado — Anthropic, OpenAI, SpaceX, Stripe, Kraken, Anduril, Canva, Databricks, Epic Games, Lambda, Neuralink e Perplexity. Dados de resolução exclusivos da Nasdaq Private Market. Mercados estruturados como 'valuation ladders' (múltiplas faixas). OpenAI até 31/Dez: US$500B a US$3T. SpaceX até 30/Jun: US$1,3T a US$4T. É a primeira vez que varejo consegue precificar sentimento sobre essas startups bilionárias sem deter equity.

Mercado · cnbc · polymarket, anthropic, openai, spacex, stripe, prediction-markets

Comunidade

Cohere se funde com Aleph Alpha — consolidação de IA frontier fora dos EUA-China

Cohere (Canadá, US$ 6,8bi última rodada) absorve Aleph Alpha (Alemanha), criando o maior player ocidental de IA frontier fora do eixo OpenAI/Anthropic/Google. Sinal forte de que a janela para 'frontier independent' fechou.

Comunidade · web-search · cohere, aleph-alpha, m&a, europa, soberania

Jim Fan (NVIDIA) na AI Ascent 2026: 'endgame' da robótica é roadmap técnico, não visão distante

Em palestra no AI Ascent 2026 (Sequoia), Jim Fan — lead do Embodied Autonomous Research da NVIDIA — declarou que o "endgame" da robótica já é roadmap técnico definido, não visão distante. Tese central: "The Great Parallel" — a robótica vai seguir o caminho dos LLMs (pre-training, alignment, reasoning, auto-research). Paradigma mudando de VLAs (language- first) para WAMs (World-Action Models, video-first), com o DreamZero da NVIDIA como exemplo. Estratégia de dados: teleoperação humana sendo trocada por "sensorized human data" — EgoScale mostrou que 21.000 horas de vídeo egocêntrico bastam para prever sucesso robótico. Previsões: Physical Turing Test em 2-3 anos; Physical Auto-Research (robôs que projetam o próximo robô) em 2040.

Comunidade · humanoidsdaily.com · robotica, nvidia, jim-fan, vla, wam, embodied-ai

The Verge — 'O futuro do Google é uma barra de busca que faz tudo' (análise do Search 30-anos overhaul)

The Verge publicou (19/05 noite) ensaio-análise do Google Search pós-I/O 2026: a barra de busca virou interface universal — busca textual, voz, imagem, agentes 24/7, criação de widgets, geração de UI in-line, deep research, comparações de produto. Argumento central: Google reorganizou os últimos 25-30 anos de produto em torno de um único input. Risco: rasura a fronteira entre busca, chat, agente, ferramenta — usuário pode ficar perdido. Oportunidade: monopólio da intenção do usuário fica ainda mais consolidado. Ponto crítico de leitura para quem ainda enxerga 'search' como vertical separado de 'IA generativa'.

Comunidade · theverge · google, search, ai-mode, agentic-search, gemini-flash, verge

Simon Willison @ PyCon US 2026 — 'os últimos 6 meses em LLMs em 5 minutos' (slides anotados)

Simon Willison publicou os slides anotados da sua lightning talk no PyCon US 2026 — 'Os últimos 6 meses em LLMs em 5 minutos'. Tese central: novembro/2025 foi o ponto de inflexão (especialmente pra coding), e o que aconteceu desde então redefine o que esperar de modelos pequenos, agentes, e coding tools. Material vira referência rápida pra explicar pra time/board onde estamos. Vale pra quem perdeu o último semestre e quer pegar o fio em 10 min de leitura. Casa com o pacote do dia (Karpathy → Anthropic, Google I/O, Gemini 3.5).

Comunidade · simonwillison · simon-willison, pycon, recap, llm, november-2025-inflection, coding

Code with Claude London (19-20/maio) e Extended London — Anthropic abre sua segunda parada do tour 2026

A Anthropic está rodando hoje e amanhã (19-20 maio) o "Code with Claude London" — segunda etapa do tour pós-SF (que foi em 06 de maio). Foco em workshops hands-on, demos de produção e Day-1 keynote streamado ao vivo. Tópicos: o que os modelos de hoje fazem em produção, build de agentes long-horizon na Claude Platform, multi-repo work, parallel agents e infra de execução. Dia 20 também tem o "Code with Claude: Extended London" — versão para indie devs e early-stage founders. Tokyo vem em 5-6/junho.

Comunidade · claude.com · anthropic, claude-code, evento, london, devrel

Sarvam AI lança óculos Kaze AI no India AI Impact Summit — Modi é o primeiro usuário

Sarvam AI apresenta os óculos Kaze AI no India AI Impact Summit; primeiro-ministro Narendra Modi os experimenta publicamente. Rodam o modelo indígena da Sarvam e suportam 10+ línguas indianas. Soft-power tech a serviço de soberania de IA do BRICS.

Comunidade · web-search · india, sarvam, hardware, glasses, soberania-linguistica