Radar do FAROL26 notas

sábado, 20 de junho de 2026

Modelos

VibeThinker-3B: modelo de raciocínio denso de 3B sobre Qwen2.5-Coder-3B

VibeThinker-3B é um modelo de raciocínio denso de 3 bilhões de parâmetros construído sobre o Qwen2.5-Coder-3B, usando um pipeline de pós-treino chamado 'Spectrum-to-Signal'.

Modelos · news · vibethinker, modelo-pequeno, raciocinio, qwen, open-weights

Liquid AI lança LFM2.5-Embedding-350M e ColBERT-350M para busca multilíngue

A Liquid AI apresentou dois modelos de 350M — LFM2.5-Embedding (bi-encoder denso) e LFM2.5-ColBERT (late interaction) — para busca rápida e multilíngue em 11 idiomas.

Modelos · news · liquid-ai, embeddings, colbert, busca, multilingue, rag

Ferramentas e código

Anthropic 'pausa' a cobrança por tokens do Claude Agent SDK

A Anthropic pausou o modelo de cobrança baseado em tokens para o Claude Agent SDK, mexendo na economia de quem constrói agentes sobre o ecossistema — tema que dominou o Hacker News (19/06).

Ferramentas e código · web · anthropic, claude-agent-sdk, billing, agentes, dev

OpenAI lança 'Record & Replay' no Codex: demonstre uma vez, o agente repete sozinho

A OpenAI liberou 'Record & Replay' no app Codex (macOS): o usuário demonstra um fluxo uma vez, o Codex o converte numa 'skill' reutilizável e passa a executá-lo de forma autônoma.

Ferramentas e código · web · openai, codex, automacao, agentes, skills, dev

Cloudflare lança contas temporárias para agentes de IA

A Cloudflare lançou contas temporárias/efêmeras desenhadas para agentes de IA: credenciais de curta duração para que um agente atue sem expor chaves permanentes.

Ferramentas e código · web · cloudflare, agentes, identidade, seguranca, credenciais-efemeras

Simon Willison: o 'formato ideal' do MCP é ser um gateway de autenticação

Willison destacou (citando Sean Lynch) que o valor real do MCP sobre skills/CLI é isolar o fluxo de autenticação para fora da janela de contexto do agente — talvez o MCP idealizado seja apenas um gateway de auth para APIs.

Ferramentas e código · web · mcp, context-engineering, skills, willison, agentes

ChatGPT avança como assistente pessoal com novos controles de tarefas agendadas

O ChatGPT ganhou novos controles para tarefas agendadas, dando mais um passo na direção de virar um assistente pessoal que executa rotinas automaticamente.

Ferramentas e código · news · chatgpt, openai, tarefas-agendadas, assistente, automacao

NVIDIA apresenta SpatialClaw: agente sem treino que usa código como interface de ação

A NVIDIA introduziu o SpatialClaw, um agente 'training-free' que trata código como interface de ação para resolver tarefas de raciocínio espacial.

Ferramentas e código · news · nvidia, spatialclaw, agente, raciocinio-espacial, code-as-action, training-free

Magnitude: agente de código que roda em modelos abertos

Novo coding agent posicionado explicitamente para rodar sobre modelos open-weights, não amarrado a uma API fechada — parte de uma onda de ferramentas de código 'agnósticas de modelo'.

Ferramentas e código · web · coding-agent, modelos-abertos, open-weights, dev, agnostico-de-modelo

Cosine pós-treina Kimi K2.6 para fazer pentest em vez de recusar

A Cosine (YC W23) pós-treinou um Kimi K2.6 open-weights (SFT em writeups de CTF + RL com recompensa verificável) numa CLI que faz security scan e pentest sem os guardrails que fazem modelos fundacionais recusarem tarefas ofensivas.

Ferramentas e código · web · pentest, kimi-k2, open-weights, multi-agente, post-training, seguranca-ofensiva

Data2Story transforma um CSV em reportagem interativa verificada usando sete agentes de IA

O sistema Data2Story converte um arquivo CSV em uma reportagem interativa e verificada usando um pipeline de sete agentes de IA especializados.

Ferramentas e código · news · data2story, agentes, jornalismo-de-dados, verificacao, multiagente

TimeCopilot: pipeline de previsão com modelos de fundação e detecção de anomalias

Tutorial mostra como montar um pipeline de previsão de séries temporais com o TimeCopilot, combinando modelos de fundação e detecção automática de anomalias.

Ferramentas e código · news · timecopilot, forecasting, series-temporais, foundation-models, anomalias

Pesquisa

Novo benchmark expõe como a IA ainda falha no trabalho de conhecimento realista

Um novo benchmark mostra que mesmo os melhores modelos resolvem apenas uma fração das tarefas realistas de trabalho de conhecimento de múltiplas etapas — um contraponto ao hype agêntico.

Pesquisa · news · benchmark, trabalho-de-conhecimento, agentes, limitacoes, avaliacao

OpenAI: pequenas doses de treino de 'traço benéfico' deixam modelos mais seguros

Pesquisadores da OpenAI mostram que pequenas doses de treino voltado a 'traços benéficos' tornam os modelos amplamente mais seguros e mais difíceis de manipular.

Pesquisa · news · openai, seguranca, alinhamento, robustez, manipulacao

DeepMind: agentes de IA deveriam ser tratados como 'ameaças internas'; Hassabis pede pesquisa urgente de contenção

Demis Hassabis defendeu pesquisa urgente para conter riscos da IA; em paralelo, a DeepMind argumenta que agentes de IA deveriam ser tratados, do ponto de vista de segurança, como 'ameaças internas' (insider threats).

Pesquisa · web · hassabis, deepmind, seguranca-de-agentes, insider-threat, alinhamento

DVD-JEPA: um world model JEPA open-source e totalmente reproduzível

Demonstração mínima e reproduzível da arquitetura JEPA (LeCun): um logo de DVD quicando num quadro 16x16 em que o modelo prevê a representação do futuro sem decoder nem labels; roda no browser em ~40 linhas de JS.

Pesquisa · web · jepa, world-models, lecun, reproducibilidade, pedagogia

Position paper (ICML 2026): séries temporais precisam de uma perspectiva de sistemas dinâmicos

Position paper aceito no ICML 2026 defende abandonar transformers e voltar a RNNs modernas para séries temporais, com pré-treino em simulações de sistemas dinâmicos caóticos em vez de funções artificiais.

Pesquisa · arxiv · series-temporais, sistemas-dinamicos, rnn, transformers, icml-2026

Mercado

OpenAI triplica receita para US$ 5,7 bi no 1º tri, mas queima US$ 3,7 bi para chegar lá

A OpenAI teria triplicado a receita para ~US$ 5,7 bilhões no 1º trimestre, mas consumiu cerca de US$ 3,7 bilhões em caixa no mesmo período — um retrato do custo de crescer no ritmo atual.

Mercado · news · openai, receita, burn-rate, financas, the-decoder

Regulação e segurança

Trump recua: não vê mais a Anthropic como ameaça à segurança nacional

Em entrevista, Trump disse que na semana anterior via a Anthropic como ameaça à segurança nacional, mas sinalizou distensão após considerar Dario Amodei 'simpático' e 'inteligente' no G7.

Regulação e segurança · web · trump, anthropic, amodei, regulacao, eua, governo

Comunidade

Google DeepMind perde o Nobel John Jumper (AlphaFold) para a Anthropic

John Jumper, co-criador do AlphaFold e Nobel de Química de 2024, estaria deixando o Google DeepMind para se juntar à Anthropic — mais uma baixa de peso no time do DeepMind.

Comunidade · news · anthropic, deepmind, john-jumper, alphafold, nobel, contratacao

Yann LeCun chama a xAI de 'fracasso' e alerta para bolha de IA

Yann LeCun afirmou que a xAI de Musk é 'meio que um fracasso' por causa da debandada do time fundador, reforçou que LLMs são um beco sem saída e voltou a alertar para uma bolha de IA prestes a estourar.

Comunidade · web · lecun, xai, world-models, bolha-ia, llm-ceticismo

Noruega proíbe IA generativa no ensino fundamental para proteger aprendizado básico

A Noruega proibiu ferramentas de IA generativa em escolas de ensino fundamental, argumentando que é preciso proteger o desenvolvimento de habilidades básicas de aprendizado das crianças.

Comunidade · news · noruega, educacao, regulacao, criancas, ia-generativa, escola

Debate no HN: 'GPT-5.5 alucina 3x mais que o GLM-5.2 (licença MIT)

Post nº1 de IA no HN nas últimas 24h (488 pts, 242 comentários) argumenta que o GPT-5.5 proprietário alucina ~3x mais que o open-weights GLM-5.2 em testes de fidelidade, virando um grande debate sobre modelos fechados × abertos.

Comunidade · hackernews · glm-5.2, gpt-5.5, open-weights, alucinacao, confiabilidade, open-vs-closed

Google recorre de decisão que o responsabiliza diretamente por conteúdo do AI Overview

O Google recorre de uma decisão judicial que o torna diretamente responsável pelo conteúdo gerado por IA nos resumos de busca (AI Overview).

Comunidade · news · google, ai-overview, responsabilidade, justica, busca

Mais gente consome notícia via chatbots de IA, mas a confiança continua baixa

Cresce o número de pessoas que se informam por chatbots de IA, mas a confiança nesse tipo de fonte segue baixa — um descompasso entre adoção e credibilidade.

Comunidade · news · chatbots, noticias, confianca, adocao, midia

Google, Anthropic, Salesforce e outros prometem ~US$ 1 bi em remoção de carbono

Coalizão de grandes empresas (Google, Anthropic, Salesforce e outras) comprometeu-se a comprar créditos futuros de remoção de carbono somando quase US$ 1 bilhão; a Anthropic é citada como primeira startup de IA a aderir à coalizão Frontier.

Comunidade · web · anthropic, google, salesforce, sustentabilidade, data-centers, frontier