Radar do FAROL22 notas

segunda-feira, 18 de maio de 2026

Modelos

Google I/O 2026 — véspera do keynote (19/05 10h PT) com Gemini 4 e agentic coding

A 24h do keynote do Google I/O 2026 (19/05, 10h PT, Shoreline Amphitheatre), agregadores consolidam o que esperar: nova versão Gemini (provável Gemini 4 ou variante nomeada), preview de Android XR glasses com Samsung e Warby Parker, timeline do Aluminium OS, pricing do Google Cloud agentic toolkit, e foco confirmado pela Google em 'agentic coding'. Pré-anúncios já saíram em paralelo: GEAR (programa de capacitação de agentes empresariais) e AI-enabled pointer da DeepMind. É o maior single evento de IA de maio.

Modelos · TechCrunch / Sources / EWeek / BuildFastWithAI · google-io, gemini-4, agentic-coding, android-xr, aluminium-os, keynote

Google I/O 2026 começa amanhã (19/05) com Gemini e agentic coding no centro

Keynote do Google I/O 2026 começa terça (19/05) às 10h PT. Google confirmou foco em nova versão do Gemini (provável 3.5/4.0) e em agentic coding como tema central. Acontece num momento em que o Gemini ficou atrás de Mythos da Anthropic e do GPT-5.5 nos benchmarks recentes.

Modelos · TechTimes · google, google-io, gemini, agentic-coding, keynote

Gemini 3 Deep Think recebe upgrade para ciência, matemática e engenharia

Google anunciou em 17/05 atualização do modo de raciocínio Gemini 3 Deep Think com foco em pesquisa científica, matemática avançada e engenharia. Movimento antecipa o I/O e tenta recuperar terreno em reasoning longo, área dominada por Opus 4.7 e GPT-5.5 nos últimos benchmarks.

Modelos · Google Blog · google, gemini, deep-think, reasoning, ciencia

MiniCPM-V-4.6: VLM multimodal on-device dispara em trending no Hugging Face

Modelo MiniCPM-V-4.6 da OpenBMB lidera o trending de modelos no Hugging Face (trending score 663) com 80,6k downloads e 744 likes. VLM compacto, image-text-to-text, otimizado para uso on-device — Apache 2.0, sem peças proprietárias.

Modelos · Hugging Face · huggingface, minicpm, vlm, on-device, openbmb

Sulphur-2-base: novo modelo text-to-video chega ao trending do HF com 1M de downloads

Sulphur-2-base, modelo text-to-video da SulphurAI publicado em 03/05, atingiu 1,0M de downloads e 1.101 likes no Hugging Face (trending score 477). Distribuído em diffusers + GGUF, sinaliza maturidade da geração local de vídeo conversacional fora da Runway/Pika.

Modelos · Hugging Face · huggingface, sulphur-ai, text-to-video, diffusers, gguf

Meta Avocado escorrega para junho após testes abaixo de GPT-5.5 e Opus 4.7

Modelo Avocado da Meta, esperado para maio segundo a Reuters, não foi anunciado. Testes internos teriam colocado o Avocado abaixo de GPT-5.5 e Claude Opus 4.7 em benchmarks de dev — janela mais provável agora é junho. Soma-se ao Muse Spark (15/05) como sinal de reorganização da estratégia de modelos da Meta.

Modelos · BuildFastWithAI · meta, avocado, llama, lancamento, atraso

Cohere lança Command-A-Plus 05-2026 quantizado W4A4 — multilíngue (60+ línguas) no HF

Cohere publica Command-A-Plus 05-2026 com quantização agressiva W4A4 (4-bit weights, 4-bit activations) — modelo image-text-to-text multilíngue cobrindo 60+ idiomas. Trending Score 109 no HF. Português, espanhol, francês, árabe e chinês incluídos.

Modelos · huggingface · cohere, command-a, quantization, multilingual, w4a4

Ferramentas e código

Microsoft tira Claude Code de divisão interna e força migração para Copilot CLI

O grupo Experiences + Devices da Microsoft (Windows, Office, Teams, Outlook, Surface) deve migrar do Claude Code para o GitHub Copilot CLI até 30/06. Motivos declarados: unificação de toolchain, parceria com o GitHub e corte de custos. Sinaliza tensão crescente entre Anthropic e a parceria histórica com a Microsoft.

Ferramentas e código · TechGenYZ · microsoft, anthropic, claude-code, copilot-cli, github

OpenAI x Dell: Codex roda on-prem e hybrid em enterprise — primeiro deal de coding agent corporativo de larga escala

Em 18/05, OpenAI fechou com Dell Technologies pra levar Codex a ambientes on-prem e hybrid enterprise. Sinal claro: dados sensíveis (defense, finance, healthcare) precisam de coding agent rodando dentro do datacenter do cliente. Combina com a OpenAI atingindo 1M+ devs no Codex CLI no primeiro mês. Espelha o movimento Anthropic Managed Agents → Self-Hosted Sandboxes do mesmo dia (item 19/05). Enterprise virou o novo campo de batalha dos coding agents.

Ferramentas e código · openai-news · openai, codex, dell, on-prem, enterprise, hybrid

pi-mono: toolkit unificado de agentes de IA (Mario Zechner) cresce rápido no GitHub

Repo pi-mono, de Mario Zechner (badlogic), oferece CLI de coding agent, API unificada de LLM, libs TUI/web UI, bot Slack e pods vLLM em um só monorepo. Cresce rápido (43,9k stars) como alternativa pragmática e self-hosted para quem prefere não amarrar com Claude Code, Codex ou LangGraph.

Ferramentas e código · GitHub · github, pi-mono, agents, open-source, toolkit

Parallel Web Systems (ex-CEO do Twitter) capta US$ 100M para busca focada em agentes

Parallel Web Systems, startup de Parag Agrawal (ex-CEO do Twitter), levantou US$ 100M liderada pela Sequoia (total de US$ 230M) para construir infraestrutura de busca web nativa para agentes de IA. Aposta clara em search-for-agents como camada autônoma — competindo com o crawl/index legado do Google/Bing/Perplexity.

Ferramentas e código · Crescendo AI · parallel, agentes, busca, sequoia, funding

Pesquisa

Modelo de raciocínio da OpenAI supera médicos experientes em estudo da Science

Pesquisa da Harvard Medical School e Beth Israel Deaconess, publicada na Science, mostrou que um modelo de raciocínio da OpenAI superou médicos experientes em diagnóstico e gestão de pacientes em casos clínicos curados. Resultado realimenta a discussão sobre quem fica com a responsabilidade clínica quando o modelo erra menos.

Pesquisa · Science / Beth Israel Deaconess · openai, medicina, reasoning, harvard, science

ComplexMCP: benchmark de agentes LLM em sandbox MCP de larga escala

Paper apresenta benchmark com 300+ ferramentas validadas em 7 sandboxes stateful sobre Model Context Protocol, expondo a 'última milha' onde agentes capazes de chamar APIs isoladas falham em automação comercial real (composição, estado, recuperação de erro).

Pesquisa · arXiv · arxiv, mcp, agents, benchmark, tool-use

CAST: calibração adaptativa do raciocínio para uso de ferramentas

Paper trata trajetórias históricas de execução como casos estruturados para estimar a profundidade ótima de raciocínio antes de chamar uma ferramenta. Trade-off explícito entre custo de tokens e validade estrutural da chamada — útil para quem está calibrando 'thinking budget' de agentes em produção.

Pesquisa · arXiv · arxiv, tool-use, reasoning, calibration, agents

Mercado

Anthropic negocia rodada de US$ 30B com valuation acima de US$ 900B

Anthropic estaria fechando rodada de US$ 30B a um valuation acima de US$ 900B, sustentada por ARR de >US$ 44B no Q1/26 e mais de 1.000 clientes pagando US$ 1M+/ano. Confirma que a barra de captação para frontier labs migrou para o regime de centena de bilhão.

Mercado · BuildFastWithAI / agregadores · anthropic, funding, valuation, investidores, claude

Anthropic compra a Stainless por mais de US$300M — toda OpenAI/Google usavam

A Anthropic adquiriu a Stainless — empresa fundada pelo ex-Stripe Alex Rattray, cujo software gera SDKs, CLIs e servidores MCP para praticamente todo o ecossistema (OpenAI, Google, Cloudflare e a própria Anthropic). Valor não divulgado, mas The Information reportou tratativas acima de US$300M (a Stainless tinha Sequoia e a16z na cap table). A Anthropic vai descontinuar os produtos hospedados da Stainless — clientes mantêm os SDKs já gerados mas precisam migrar a tooling. Lance estratégico para fechar o pacote agente + connector + SDK.

Mercado · anthropic.com · anthropic, stainless, sdk, mcp, m&a, devtools

Comunidade

Mustafa Suleyman ao FT: IA automatiza quase todo trabalho de colarinho-branco em 18 meses

CEO de Microsoft AI declarou ao Financial Times que IA atingirá performance humana em quase todas as tarefas de colarinho-branco (contabilidade, jurídico, marketing, gestão de projetos) em 12-18 meses. Frase viralizou em 17/05 e dialoga com a discussão de empregos da Economist no mesmo fim de semana.

Comunidade · Fortune · microsoft-ai, mustafa-suleyman, trabalho, automacao, previsoes

Google DeepMind revela 'AI-enabled pointer' que entende intenção do usuário na tela

Em projeto de pesquisa divulgado às vésperas do I/O, DeepMind apresenta o 'AI-enabled pointer' — sistema que entende não só onde o usuário está apontando na tela, mas o que ele quer fazer. Combina consciência de cursor, voz e raciocínio contextual: usuário aponta para uma imagem ou bloco de texto e diz coisas curtas como 'move isso', 'mescla esses', 'adiciona aquilo'. Demo experimental no Google AI Studio. Sinaliza migração de chatbot para 'AI ambient' embutida no fluxo de trabalho.

Comunidade · Your Story / MIT Technology Review · google, deepmind, gemini, pointer, agentic-ui, research-preview

Novo Nordisk fecha parceria estratégica com OpenAI para descoberta de drogas

Farmacêutica dinamarquesa anunciou parceria estratégica com a OpenAI para integrar IA em descoberta de drogas, ensaios clínicos, manufatura, supply chain e operações comerciais. Deployment completo até fim de 2026, mirando tratamentos para obesidade e diabetes. Outro contrato grande capturado pela OpenAI Deployment Co.

Comunidade · BuildFastWithAI · novo-nordisk, openai, farma, drug-discovery, enterprise

JPMorgan reclassifica IA como infraestrutura core (orçamento de US$ 19,8B em 2026)

JPMorgan Chase tirou IA do bucket de R&D experimental e a colocou como infraestrutura core, com orçamento tech de ~US$ 19,8B em 2026 e cerca de 2.000 funcionários dedicados. Projeção interna fala em US$ 2,5B/ano em valor gerado por essa frente. Marca simbólica de quando enterprise AI deixa de ser piloto e vira commodity de TI.

Comunidade · BuildFastWithAI · jpmorgan, enterprise-ai, orcamento, infraestrutura, financas

Trump dividido sobre dar mais poder a agências de inteligência sobre modelos de fronteira

Reportagem do Washington Post detalha que, na véspera da viagem de Trump à China, o governo está rachado sobre dar às agências de inteligência papel maior em avaliação de modelos de fronteira. Motor da disputa: descobertas de zero-days pelo Mythos da Anthropic e pressão por uma 'janela estreita' de 6-12 meses.

Comunidade · Washington Post · trump, regulacao, inteligencia, anthropic, mythos

CNBC: custo de energia ameaça corrida europeia de IA — MWh no Reino Unido custa 4x o dos EUA

Matéria da CNBC mostra MWh no Reino Unido a US$ 111,65 contra US$ 28 nos EUA. Custos de operação de data center nos cinco grandes hubs europeus devem subir 12% em 2026 — comprometendo a competição com EUA e China em infraestrutura de IA.

Comunidade · CNBC · europa, energia, data-center, regulacao, competitividade