Radar do FAROL26 notas

segunda-feira, 29 de junho de 2026

Modelos

Anthropic e Newsom fecham acordo: governo da Califórnia usará o Claude pela metade do preço

A Anthropic e o governador Gavin Newsom anunciaram (29/jun) um acordo que dá a todas as agências estaduais e governos locais da Califórnia acesso ao Claude com 50% de desconto, além de treinamento e suporte. Contrasta com o atrito da Anthropic com o governo federal (DoD).

Modelos · techcrunch · anthropic, claude, governo, california, newsom, setor-publico

\"Qwen 3.6 27B é o ponto ideal para desenvolvimento local\" vira o assunto nº 1 do Hacker News

Post da Quesma argumentando que um modelo DENSO de 20-30B é o ponto ideal para o dev solo rodar localmente — e o Qwen 3.6-27B fica no meio desse sweet spot. Chegou ao topo do HN (515 pts / 453 comentários).

Modelos · hackernews · qwen, modelo-denso, local-llm, coding, moe, fine-tuning

Google publica o TabFM 1.0, foundation model para dados tabulares com classificação/regressão zero-shot

O Google publicou no Hugging Face o TabFM 1.0, um foundation model para dados tabulares que faz classificação e regressão em modo zero-shot / in-context learning, sem treino específico por tabela. É a aposta do Google em levar o paradigma 'foundation model' para o domínio tabular (a área mais comum em empresas), na esteira de abordagens tipo TabPFN.

Modelos · huggingface · google, tabfm, tabular, foundation-model, zero-shot, in-context-learning

Sophon PFG-1: ASIC de IA 3D-monolítico com 330 GB de DRAM on-die e sem HBM

Whitepaper de uma empresa chamada Phantafield descreve o Sophon PFG-1, um ASIC de IA com arquitetura 3D-monolítica e 330 GB de DRAM no próprio die — dispensando memória HBM. A proposta ataca o gargalo de banda/custo de memória da inferência de LLMs. É um anúncio de projeto/whitepaper (ainda não validado de forma independente), mas chamou atenção no Hacker News pela abordagem fora do padrão NVIDIA/HBM.

Modelos · phantafield · hardware, asic, inferencia, dram-on-die, sem-hbm, 3d-monolitico

Geração de imagem personalizada do Gemini fica gratuita para usuários nos EUA

O Google liberou gratuitamente, para usuários nos EUA, a geração de imagens personalizada do Gemini (que usa fotos/feições do próprio usuário). Movimento de produto que pressiona o mercado de geração de imagem.

Modelos · techcrunch · google, gemini, geracao-de-imagem, multimodal, produto, gratuito

Ferramentas e código

HackerRank abre o código do seu ATS — e o score do mesmo currículo oscila (90 → 74 → 88)

Post (no topo do Hacker News, 510 pts) analisa o ATS open-sourced pela HackerRank: ao reenviar o mesmo currículo, o score dado por IA variou (90, depois 74, depois 88). Vira um estudo de caso sobre o não-determinismo e a fragilidade de usar LLMs para pontuar candidatos — com implicações sérias de justiça em recrutamento.

Ferramentas e código · blog · ats, recrutamento, llm-scoring, confiabilidade, nao-determinismo, rh

Godcoder: coding agent local-first e open-source que monta o próprio harness

Godcoder é um coding agent open-source local-first (escrito em Rust): o código fica na máquina e só sai para o provedor do modelo que você escolher (BYO key); o agente constrói seu próprio "harness" de execução. Cresceu rápido no GitHub (~248 estrelas em poucos dias), surfando a onda de agentes que priorizam privacidade.

Ferramentas e código · github · coding-agent, local-first, open-source, rust, privacidade, byok

vLLM propõe \"Micro-Agent\": superar modelos de fronteira com colaboração dentro da própria API

Post do vLLM (29/jun): transformar uma única chamada de API de modelo numa colaboração limitada dentro da camada de serving (no router). O usuário vê um nome de modelo; operadores controlam a 'receita'. Promete igualar/superar baselines de modelo único mantendo uma só superfície de API.

Ferramentas e código · vllm · vllm, inference, router, multi-agente, serving, agentic

Cursor lança app mobile para guiar seu agente de código de qualquer lugar

A Cursor lançou um app mobile que permite acompanhar e direcionar o agente de código pelo celular — mais um sinal de que os coding agents estão saindo da IDE para fluxos assíncronos/ambientes.

Ferramentas e código · techcrunch · cursor, coding-agent, mobile, async, orquestracao, dev-tools

Herdr: multiplexador de agentes que vive no seu terminal

Herdr é uma ferramenta open-source que roda no terminal para "pastorear" vários agentes de código ao mesmo tempo — criar, acompanhar e alternar entre múltiplos agentes em paralelo numa única interface. Estreou no Hacker News (75 pts) e se encaixa na onda de "harness" para orquestração de coding agents.

Ferramentas e código · github · coding-agent, terminal, orquestracao, multiplexador, dev-tools, open-source

OpenAI provoca com novo hardware… para o Codex

A OpenAI deu pistas de um novo hardware voltado ao Codex, seu agente de código. Combina com o app mobile da Cursor: coding agents migrando para fora do desktop, em direção a dispositivos dedicados.

Ferramentas e código · theverge · openai, codex, hardware, coding-agent, dispositivo

Lore: dar ao seu coding agent as decisões que o time já tomou

Lore (rac-core) é um projeto open-source para alimentar coding agents com as decisões técnicas que a equipe já tomou — o "porquê" por trás do código (estilo ADRs consultáveis pelo agente), reduzindo retrabalho e escolhas que contrariam o histórico do time. Estreia no Hacker News, tema de context engineering.

Ferramentas e código · github · coding-agent, contexto, memoria-de-decisoes, context-engineering, dev-tools, open-source

sim-use: 'olhos e mãos' para agentes de IA em simuladores iOS e emuladores Android

sim-use (da LY Corp, Japão) dá a agentes de IA a capacidade de "ver" e "operar" simuladores de iOS e emuladores/dispositivos Android — útil para automação de testes e fluxos de UI mobile. Mais um item na tendência de GUI/computer-use agents, agora voltada ao mobile.

Ferramentas e código · github · gui-agents, computer-use, mobile, ios-simulator, android-emulator, qa

\"Você realmente não deveria colar erros direto no Claude Code\

Post (em alta no HN) argumenta que colar stack traces/erros crus no Claude Code polui o contexto e desvia o agente; melhor curar o que entra. Mais um caso prático de context engineering.

Ferramentas e código · hackernews · claude-code, context-engineering, debugging, praticas, produtividade

Pesquisa

Estados atratores' emergem em conversas multi-turno de LLMs — e Claude Haiku puxa os outros

Paper (arXiv, ~29/jun) com 7 LLMs e 20 tópicos controversos mostra que debates multi-turno convergem para "estados atratores" específicos de cada modelo — regiões estáveis no espaço latente para onde a conversa é puxada. Achado notável: o Claude Haiku arrasta outros modelos para os próprios traços, enquanto o GPT-4.1 nano se mostra altamente maleável. Tem implicações para orquestração multi-agente e para o comportamento de LLMs em interações longas.

Pesquisa · arxiv · arxiv, llm, multi-turno, comportamento, alinhamento, espaco-latente

Microsoft Research apresenta Memora: representação de memória que equilibra abstração e especificidade

A Microsoft Research publicou a Memora, uma representação 'harmônica' de memória para sistemas de IA que busca equilibrar abstração (generalizar) e especificidade (lembrar o detalhe certo). Tema quente de memória para agentes.

Pesquisa · microsoft-research · microsoft-research, memoria, agentes, context-engineering, representacao, abstracao

Os LLMs passam no 'teste do espelho'?

Ensaio que adapta o clássico "teste do espelho" (autorreconhecimento, usado em etologia) para LLMs: o modelo reconhece a própria saída como sua quando confrontado com textos? Discute o que isso diz — e o que não diz — sobre "autoconsciência" de modelos, sem antropomorfizar. Bom item de reflexão metodológica.

Pesquisa · blog · autorreconhecimento, mirror-test, avaliacao, introspeccao, llm, cognicao

DiScoFormer: um único transformer para densidade e score, entre distribuições

Post da AllenAI no blog da Hugging Face apresentando o DiScoFormer: um único transformer capaz de estimar tanto densidade quanto score através de distribuições. Contribuição de modelagem generativa.

Pesquisa · huggingface · allen-ai, transformer, modelos-generativos, density-estimation, score-matching, pesquisa

Regulação e segurança

Bernie Sanders propõe plano de US$ 7 tri para dar aos americanos 'controle' da indústria de IA

O senador Bernie Sanders apresentou um plano de US$ 7 trilhões para dar aos americanos mais 'controle' sobre a indústria de IA. Soma-se a outra frente legislativa para barrar a venda de dados de saúde por empresas de IA.

Regulação e segurança · arstechnica · politica, regulacao, bernie-sanders, eua, trabalho, poder-publico

Comunidade

Banqueiros centrais alertam: boom de IA arrisca um crash financeiro global

Reportagem do Telegraph (28/jun) reúne alertas de banqueiros centrais de que a concentração de valor de mercado e o capex bilionário em torno da IA criam risco sistêmico: uma correção brusca nas ações de tecnologia poderia disparar um choque financeiro global. Subiu ao topo do Hacker News (134 pts), sinal de que o debate "bolha de IA" voltou com força à pauta econômica mainstream.

Comunidade · telegraph · bolha-ia, mercado, risco-sistemico, banqueiros-centrais, capex, datacenters

Ford recontrata engenheiros veteranos ('gray beards') depois que a IA ficou aquém

TechCrunch (28/jun): a Ford voltou a contratar engenheiros experientes ("gray beards") depois que ferramentas de IA não entregaram o esperado em tarefas de engenharia que exigem conhecimento tácito e julgamento. Caso concreto do contramovimento "IA não substitui o sênior", que viralizou no Hacker News.

Comunidade · techcrunch · limites-da-ia, trabalho, engenharia, automacao, reality-check, industria

SemiAnalysis: restrições da rede elétrica dos EUA podem empurrar 40 GW+ de data centers para 'behind-the-meter' até 2028

Análise da SemiAnalysis (29/jun) argumenta que os gargalos de conexão à rede elétrica nos EUA devem empurrar mais de 40 GW de capacidade de data center para geração própria "behind-the-meter" (gás, solar, baterias on-site) até 2028, porque esperar a rede ficou inviável para o ritmo da IA. Energia virou o verdadeiro limitante do compute.

Comunidade · semianalysis · datacenters, energia, rede-eletrica, behind-the-meter, compute, capex

Gigantes sul-coreanas comprometem US$ 550 bi+ contra a 'RAMageddon'; país planeja US$ 1 tri em memória e robôs

Empresas sul-coreanas comprometem mais de US$ 550 bi para aliviar a escassez de memória ('RAMageddon'); em paralelo, o país anuncia plano de ~US$ 1 tri em produção de chips de memória e robôs humanoides. Memória/HBM segue como gargalo central da IA.

Comunidade · techcrunch · coreia-do-sul, memoria, hbm, ramageddon, chips, robos-humanoides

Tidal deixa de pagar royalties sobre música gerada por IA (sem banir de vez)

O serviço de streaming Tidal vai parar de pagar royalties sobre faixas geradas por IA — sem proibi-las totalmente; planeja detectar e rotular esse conteúdo. Marco na tensão entre música e IA generativa.

Comunidade · theverge · tidal, musica, ia-generativa, royalties, streaming, direitos

Hacker News pede 'fontes de notícias de tecnologia que excluam IA' — a fadiga continua

Thread no topo do Hacker News (28/jun, 121 pts) pedindo fontes de notícias de tecnologia que filtrem conteúdo de IA — sintoma recorrente de "AI fatigue" na comunidade dev: não é rejeição à tecnologia, e sim cansaço da saturação. Soma-se ao eixo de backlash do dia (Economist, Ford).

Comunidade · hackernews · fadiga-ia, ai-fatigue, comunidade-dev, sentimento, midia, hacker-news

A Arena, leaderboard de IA que todo mundo usa, agora é um negócio de US$ 100 mi

A LMArena (Chatbot Arena), o ranking de modelos por votação humana que virou referência da indústria, se consolidou como um negócio de US$ 100 milhões. Levanta questões sobre avaliação e incentivos quando o 'juiz' vira empresa.

Comunidade · techcrunch · lmarena, chatbot-arena, benchmark, leaderboard, avaliacao, negocio