Radar do FAROL36 notas

segunda-feira, 1 de junho de 2026

Modelos

Anthropic lança Claude Opus 4.8 com efeito control, workflows dinâmicos e fast mode mais barato

Anthropic anunciou Claude Opus 4.8 com benchmarks superiores ao 4.7, controle explícito de 'effort' na claude.ai, workflows dinâmicos no Claude Code com múltiplos subagentes em paralelo, e um fast mode mais acessível — preço mantido vs. Opus 4.7.

Modelos · axios.com · anthropic, claude, opus, modelo-frontier, agentes

Anthropic divide assinaturas Claude e cria crédito mensal de Agent SDK a partir de 15 de junho

A partir de 15/jun a Anthropic separa assinaturas Claude (uso humano) e cria um crédito mensal específico para Agent SDK. Pega de jeito indie hackers e devs solo que usavam o plano Pro para automações — agora há cobrança separada por uso programático.

Modelos · devtoolpicks.com · anthropic, claude, agent-sdk, pricing, indie

Google Cloud no I/O 2026: Gemini 3.5 Flash supera 3.1 Pro, Gemini Omni multimodal e Developer Tier por US$100/mês

Google I/O 2026 trouxe Gemini 3.5 Flash (bate o 3.1 Pro em benchmarks-chave), Gemini Omni (vídeo dinâmico misturando texto+áudio+imagem+vídeo), Ultra cai de US$250 para US$200/mês e novo Developer Tier de US$100. DeepMind também licenciou ~20 pesquisadores da Contextual AI por US$80-90mi.

Modelos · cloud.google.com · google, deepmind, gemini, multimodal, pricing

PaddleOCR-VL-1.6: OCR multimodal com ERNIE 4.5 para documentos, tabelas, fórmulas e gráficos

Baidu/PaddlePaddle lançou PaddleOCR-VL-1.6 — VLM baseado em ERNIE 4.5 para parsing completo de documentos: layout, tabelas, fórmulas, gráficos, selos. Multilíngue (en/zh). Trending 128 na HF.

Modelos · huggingface.co · paddleocr, ernie, ocr, document-parse, multimodal

Google encerra Gemini 2.0 — EOL em 01/06/2026, família 3.x vira baseline

Google declara end-of-life para todos os modelos da família Gemini 2.0 a partir de 01/06/2026, empurrando integrações para Gemini 3.x (com 3.5 Flash recém-promovido a GA). Equipes com cargas em 2.0 — tipicamente chatbots customer-facing e pipelines de extração — precisam migrar agora. Quebra é grande no comportamento (3.5 Flash usa tokenizer e prompt cache distintos).

Modelos · Google Cloud / Vertex AI Release Notes · google, gemini, deprecation, vertex-ai

StepFun lança Step-3.7-Flash: VLM MoE com forte performance multimodal

StepFun publicou Step-3.7-Flash, modelo vision-language MoE open-source no HF (Apache 2.0). Trending score 174, 9.3K downloads. Conversational, image-text-to-text, custom code.

Modelos · huggingface.co · stepfun, vlm, moe, vision-language, opensource

Tencent Hy-MT2-30B-A3B: modelo MoE multilíngue de tradução em 30+ idiomas

Tencent publicou Hy-MT2-30B-A3B, MoE multilíngue dedicado à tradução em 30+ idiomas (inclui pt). Likes 440, downloads 4.5K. Mais um sinal da especialização vertical de modelos MoE para tarefas específicas.

Modelos · huggingface.co · tencent, hunyuan, traducao, moe, multilingue

ByteDance Bernini-R: renderizador image-text-to-video em alta no HuggingFace

Novo modelo da ByteDance para geração de vídeo a partir de imagem+texto ('bernini_renderer'), publicado em 1/jun sob licença Apache-2.0 e já entre os repositórios em alta no HuggingFace. Acompanha o paper arXiv:2605.22344.

Modelos · Hugging Face (ByteDance) · bytedance, video, image-to-video, generativo, huggingface

OpenAI atualiza GPT-5.5 Instant: respostas mais naturais e melhor cadência

OpenAI publica atualização do GPT-5.5 Instant no ChatGPT e na API focada em estilo: respostas mais legíveis, conversação mais natural, melhor ritmo em tarefas práticas de help. Não muda capabilities subjacentes — é tuning de estilo, não de inteligência. Vale notar para times com prompts engessados em prompts que dependem do tom anterior.

Modelos · OpenAI Help Center / Releasebot · openai, gpt-5.5, chatgpt, api

OpenAI frontier models e Codex agora disponíveis na AWS

OpenAI anunciou disponibilidade dos seus frontier models e do Codex via AWS — um movimento de distribuição multi-cloud que rompe a exclusividade histórica com a Azure/Microsoft.

Modelos · hacker-news · openai, codex, aws, distribuicao, cloud

NVIDIA Nemotron 3 Ultra (550B) — maior open weights US

NVIDIA anunciou Nemotron 3 Ultra em 01/jun, 550B parâmetros (55B ativos), apresentado como o modelo open weights mais inteligente dos EUA e o maior da família Nemotron 3.

Modelos · wavespeed-ai · nvidia, nemotron, open-weights, moe, llm

Ferramentas e código

Robinhood agora deixa agentes de IA negociarem ações pelo usuário

Robinhood abriu API para agentes de IA executarem ordens em nome do usuário. Marca um divisor de águas em finanças: pela primeira vez uma corretora retail dos EUA expõe trading agêntico como recurso de produto, antecipando a discussão de quem é responsável pelas decisões automatizadas.

Ferramentas e código · techcrunch.com · robinhood, agentes, fintech, automacao, governanca

Mastra: framework TypeScript para apps de IA cresce para 24,6k★ (time do Gatsby)

Framework TypeScript do time que criou o Gatsby para construir apps de IA — agentes, RAG, workflows, evals. Atualizado hoje, 24.6k★. Concorrente direto do Vercel AI SDK e LangChain.js.

Ferramentas e código · github.com · mastra, typescript, agentes, framework, opensource

GitHub Copilot migra para faturamento por consumo com 'GitHub AI Credits

A partir de 1º de junho de 2026, o GitHub Copilot deixa de cobrar por requisição e passa a usar 'GitHub AI Credits' — moeda virtual a US$ 0,01 por crédito. Mudança consolida o movimento de billing por consumo nas plataformas de IA para devs e desloca a competição entre Copilot e Claude Code (que já o ultrapassou em uso) para o eixo custo-eficiência. Implicações: previsibilidade de custo cai, mas teto deixa de existir; equipes precisam instrumentar consumo por agente.

Ferramentas e código · GitHub / llm-stats · github-copilot, billing, ai-credits, developer-tools

TanStack/ai: SDK TypeScript provider-agnóstico do criador do TanStack Query

O time do TanStack Query/Router lançou o TanStack/ai — SDK TypeScript type-safe e provider-agnóstico para chat streaming e tool calling. 2.707★ desde o anúncio. Concorre direto com Vercel AI SDK.

Ferramentas e código · github.com · tanstack, typescript, sdk, ai-sdk, streaming

JetBrains lança Koog: framework JVM (Java/Kotlin) para agentes previsíveis e tolerantes a falhas

JetBrains abriu o Koog, framework JVM (Java/Kotlin) para construir agentes 'predictable, fault-tolerant'. 4.282★, atualizado hoje. Posicionamento explícito contra o caos de frameworks pythonistas em produção corporativa Java.

Ferramentas e código · github.com · jetbrains, koog, kotlin, java, jvm, agentes

Netflix e Wiz criam app para cortar contas de IA — e abrem o código

Netflix e Wiz lançam app open-source para reduzir gastos com IA — atacando o problema de FinOps em LLMs (custo por chamada, tracking por equipe, otimização de provider). Sinal claro de que custo virou pauta executiva.

Ferramentas e código · theregister.com · netflix, wiz, finops, cost-optimization, opensource

LLM Gateway: roteador open-source para múltiplos providers de LLM (1.258★)

LLM Gateway é um proxy open-source que padroniza chamadas a múltiplos providers (OpenAI, Anthropic, Google, etc.), com routing, observabilidade e analytics em uma API unificada. 1.258★ e crescendo.

Ferramentas e código · github.com · llm-gateway, opensource, routing, observability, fallback

Dust: plataforma de agentes customizados open-source ganha tração (1.368★)

Dust é uma plataforma open-source para criar agentes customizados focada em produtividade — 1.368★ e atualizada hoje. Concorre com Glean e plataformas corporativas de 'AI assistants' por enterprise.

Ferramentas e código · github.com · dust, agentes, opensource, plataforma

CS336 (Stanford) publica CLAUDE.md como guideline oficial para agentes

O curso CS336 (Language Modeling from Scratch) de Stanford adotou CLAUDE.md como diretriz oficial de uso de agentes para os assignments — viralizou no HN com 423 pontos.

Ferramentas e código · hacker-news · stanford, cs336, claude-code, agents, context-engineering, education

Microsoft Surface Laptop Ultra com NVIDIA — rival do MacBook Pro

HN destacando o Surface Laptop Ultra da Microsoft com GPU NVIDIA — aposta da Microsoft no segmento AI-PC para confrontar diretamente o MacBook Pro M-series.

Ferramentas e código · hacker-news · microsoft, surface, nvidia, ai-pc, hardware

Pesquisa

AutoResearchBench: agentes de IA atingem só 9,39% em descoberta científica profunda

Novo benchmark sobre 3+ milhões de papers do arXiv com full-text e ferramentas de busca atualizadas. Modelos frontier atingem apenas 9,39% de acurácia em 'Deep Research' e 9,31% de IoU em 'Wide Research'. Resultado coloca em xeque entusiasmo recente com agentes de pesquisa científica (DOVA, autoresearch loops) e oferece teto de comparação para Claude/Gemini/GPT em tarefas reais sobre literatura.

Pesquisa · arXiv · benchmark, agentes, arxiv, scientific-discovery, deep-research

VerlTool: framework unificado para Agentic RL com tool use (81 upvotes na HF)

Paper VerlTool propõe framework modular para Agentic Reinforcement Learning com Tool Use, com APIs padronizadas, rollouts assíncronos e trajetórias multi-turn. 81 upvotes na HF e discussão ativa com os autores.

Pesquisa · huggingface.co · paper, rl, agentic, tool-use, verl, framework

SkillsBench: skills curadas dão +16,2pp em média a agentes (arXiv)

SkillsBench avalia configurações agent+skill em 84 tarefas. Curadoria de skills melhora desempenho em média +16,2 pontos percentuais. Validação empírica do paradigma 'Claude Skills' / 'agent skill libraries' que Anthropic vem promovendo. Reforça a tese de que prompt + tool selection > model swap em muitas tarefas práticas.

Pesquisa · arXiv · benchmark, agent-skills, claude-skills, arxiv

Survey de raciocínio e sistemas agênticos em séries temporais com LLMs

Survey categoriza raciocínio em séries temporais com LLMs por topologia (direto, cadeia linear, ramificado) e objetivos (explicação, causal, decisão, geração). Trata de tool use, multimodalidade, agent loops e práticas de avaliação.

Pesquisa · huggingface.co · paper, time-series, agentes, llm, survey

Mercado

Cognition (Devin) capta US$ 1B em valuation de US$ 26B

Cognition, dona do agente Devin, fechou rodada de US$ 1B a um valuation de US$ 26B — reforço da tese de que 'AI software engineer' é a categoria de maior dinheiro queimado em 2026.

Mercado · buildfastwithai · cognition, devin, ai-agent, funding, coding

SoftBank investirá €75B em 5 GW de infra de IA na França

SoftBank comprometeu €75B para construir 5 gigawatts de capacidade de IA na França — soberania de cómputo europeia ganha musculatura.

Mercado · buildfastwithai · softbank, ai-infra, europa, franca, datacenter

Comunidade

Anistia Internacional: 'Unlawful by Design' — IA generativa e custos em direitos humanos

Anistia Internacional publicou relatório 'Unlawful by Design: Exposing the Human Rights Costs of Generative AI'. Já subiu no HN com 33pts. Argumenta que o design atual de sistemas generativos é estruturalmente incompatível com direitos humanos.

Comunidade · amnesty.org · amnesty, governanca, direitos-humanos, ia-generativa, regulacao

MIT Tech Review: Code with Claude expôs o futuro do desenvolvimento — gostando ou não

MIT Tech Review cobriu o evento Code with Claude (Londres) e argumenta que o futuro do desenvolvimento já começou a se materializar — gostando ou não, devs vão escrever menos código manual e gerenciar mais agentes.

Comunidade · technologyreview.com · anthropic, claude-code, mit, programacao, futuro-trabalho

The Guardian: a religião transhumanista que move parte do Vale do Silício

Long-read interativo do Guardian sobre como o discurso transhumanista — superinteligência, longevidade radical, colonização espacial — virou narrativa quase religiosa entre líderes do Vale do Silício. Leitura útil para entender o pano de fundo ideológico das decisões de produto.

Comunidade · theguardian.com · transhumanismo, vale-silicio, ideologia, cultura, ai

Simon Willison: 'agent' finalmente ganha definição útil + coletânea de Agentic Engineering Patterns

Willison consolida uma definição prática de agente ('um LLM roda ferramentas em loop para atingir um objetivo') e publica uma coletânea de 'Agentic Engineering Patterns' — práticas para extrair o melhor dos agentes de código.

Comunidade · Simon Willison · simon-willison, agentes, context-engineering, padroes, definicoes

Alphabet anuncia raise de US$ 80B em equity para expandir infra de IA

Alphabet propôs uma captação primária de equity de US$ 80B para acelerar a expansão de infraestrutura de IA e capacidade de cómputo — uma das maiores ofertas equity do setor.

Comunidade · hacker-news · alphabet, google, capex, ai-infra, compute

Microsoft e Google miram coding models contra Anthropic e OpenAI

CNBC: Microsoft (com modelo MAI próprio para coding) e Google (Gemini Code Assist) vão usar Build 2026 para tentar reduzir a vantagem de Claude Code e Codex no segmento de IA para programação.

Comunidade · cnbc · microsoft, google, anthropic, openai, coding, build-2026

Sysdig documenta primeiro ataque real com LLM agent exfiltrando AWS

Sysdig publicou o primeiro caso confirmado de ciberataque ao vivo em que um LLM agent exfiltrou de forma autônoma uma base AWS em menos de 1 hora — marco para a discussão de safety de tool use.

Comunidade · buildfastwithai · security, llm-agent, sysdig, aws, ataque-real

Michael Burry diz que nem SpaceX nem Anthropic valem US$ 1T

Michael Burry (The Big Short) publica posição contrária às valuations de Anthropic e SpaceX, em pleno momento de IPO da Anthropic. Contraponto de risco no ar trillion-dollar-AI.

Comunidade · hacker-news · bubble, anthropic, spacex, valuation, contra-corrente

Apple Intelligence — próxima geração revelada em WWDC26

Integração de Foundation Models em iOS, iPadOS, macOS, watchOS, visionOS, tvOS; expansão Siri

Comunidade · web_search · apple, on-device, ecosystem