Radar do FAROL51 notas

terça-feira, 15 de setembro de 2026

Modelos

Google lança Gemini 3.8 Live e 3.8 Live Extended Thinking, com 97 idiomas por chamada

O Google publicou dois modelos de voz: Gemini 3.8 Live, voltado a escala e custo, e Gemini 3.8 Live Extended Thinking, com raciocínio multi-etapa executado enquanto o modelo fala. ...

Modelos · websearch · gemini, speech-to-speech, voz, google-deepmind, api

Google libera o Claude Opus 5 para todos os seus engenheiros no Antigravity, com cota por usuário

O Google passou a permitir que todos os engenheiros usem o Claude Opus 5 dentro da plataforma interna Antigravity; antes, ferramentas externas de código eram vetadas, com exceçõ...

Modelos · websearch · google, anthropic, claude-opus-5, antigravity, programacao

TypeSafe lança Jev, modelo de System One com preço por bilhão de tokens

A TypeSafe apresentou o Jev, primeiro modelo da sua linha System One, treinado com RLCD (Reinforcement Learning for Calibrated Decisions). A proposta é devolver respostas estrutura...

Modelos · websearch · modelo-novo, calibracao, saida-estruturada, preco, latencia

Agility Robotics apresenta o Digit 5, humanoide para trabalho sem barreira física

A Agility Robotics anunciou o Digit 5, com arquitetura de segurança que inclui detecção humana, sinalização de movimento e controlador de segurança independente, desenvolvida sobre...

Modelos · websearch · robotica, humanoide, seguranca, nvidia-igx, logistica

MediaTek lança o Dimensity 9600 Pro, chip de celular em 2 nm com NPU para modelos de até 30 bilhões de parâmetros

A arquitetura com duas NPUs roda modelos de até 30B no aparelho. A empresa informa 51% mais desempenho no processamento de prompt, 55% mais tokens por watt e 40% menos consumo e...

Modelos · websearch · mediatek, ia-no-dispositivo, chips

Formas apresenta Cartesian, modelagem 3D por linguagem natural com geometria NURBS exata

O Cartesian cria modelos 3D a partir de linguagem natural, esboços ou arquivos importados, gerando sólidos NURBS com dimensões mensuráveis em vez de malhas poli...

Modelos · websearch · ia-generativa, modelagem-3d, cad, arquitetura

Ferramentas e código

AIUC lança certificação, testes de estresse e seguro de responsabilidade para agentes de IA

Rune Kvist, contratado nos primeiros tempos da Anthropic, e Rajiv Dattani, ex-COO da METR, apresentaram a Artificial Intelligence Underwriting Company (AIUC), que submete um agente...

Ferramentas e código · websearch · seguranca-de-agentes, seguro, auditoria, avaliacao, governanca

Desenvolvedores rodam o Claude Code sobre GPT-5.6 Sol usando proxies de tradução de API

Reportagem descreve a prática de manter a CLI e o harness de agente do Claude Code e desviar as requisições, em formato Anthropic, para modelos de outros fornecedores via gateways ...

Ferramentas e código · websearch · claude-code, proxy, openrouter, termos-de-uso, agentic-coding

Strix relata acesso administrativo ao GitHub da Baseten a partir de token exposto em camada Docker

A Strix publicou a análise de um personal access token do GitHub que ficou gravado no campo history[].created_by de uma imagem Docker, porque foi passado como build argument para b...

Ferramentas e código · websearch · seguranca, supply-chain, docker, github-pat, segredos

Claude Code 2.1.273 adiciona cabeçalhos para gateways de LLM e corrige auto-compact que disparava na metade da janela

A versão 2.1.273 do Claude Code, de 15/09, envia cinco cabeçalhos novos para gateways de LLM (request-class, agent-type, prev-tool-durations, compaction e conte...

Ferramentas e código · websearch · claude-code, context-engineering, llm-gateway, release

Desenvolvedor escreve driver Linux de GPU para o Mac Mini M4 em um mês com Codex e Claude

O autor relata ter feito um driver Linux de GPU para o Mac Mini M4 em cerca de um mês, usando Codex (GPT-5.6 Sol e depois GPT-6 Astra) na engenharia reversa da ...

Ferramentas e código · websearch · automacao-de-desenvolvimento, engenharia-reversa, codex, claude, linux

Hugging Face cobra da OpenAI US$ 100 milhões em compute e divulgação de traces de agente

Clem Delangue, CEO da Hugging Face, foi a San Francisco cobrar da OpenAI US$ 100 milhões em compute para defesa cibernética comunitária e a publicação obrigatória de agent traces a...

Ferramentas e código · websearch · incidente, agentes-autonomos, hugging-face, openai, transparencia

OpenArch reúne implementações em PyTorch de arquiteturas modernas de LLM

Repositório com implementações de referência em PyTorch de arquiteturas contemporâneas de LLM, no espírito dos repositórios didáticos de Karpathy e Raschka. Alcançou 131 pontos e 3...

Ferramentas e código · hacker-news-api · pytorch, arquiteturas, open-source, educacao

Cloudflare passa a bloquear por padrão crawlers de IA de uso misto em páginas com anúncios

Desde 15/09, a configuração padrão bloqueia crawlers que misturam indexação, uso por agentes e coleta para treino sob o mesmo user agent, para novos clientes, novos sites e todo...

Ferramentas e código · websearch · cloudflare, crawlers, rag, agentes

Ordewell transforma um objetivo em plano ordenado de tarefas para agentes de código

Ferramenta apresentada no Show HN que recebe um objetivo único e produz um plano ordenado de tarefas para agentes de codificação, com dependências explícitas entre passos. Somou 47...

Ferramentas e código · hacker-news-api · agentes-de-codigo, planejamento, orquestracao, show-hn

Panel propõe workspace de pesquisa em que o próprio agente constrói seus painéis

Workspace de pesquisa apresentado no Show HN em que o agente cria e organiza os próprios painéis conforme a investigação avança, em vez de operar dentro de layout fixo. Teve 47 pon...

Ferramentas e código · hacker-news-api · agentes, interface, pesquisa, show-hn, observabilidade

Pizza Bot: caixa de entrada local para agentes que trabalham em segundo plano

O Pizza Bot organiza tarefas longas de agentes em duas filas, resultados prontos e pedidos de aprovação. Roda sobre DeepAgents e LangGraph, aceita Anthropic, Op...

Ferramentas e código · websearch · agentes, langgraph, human-in-the-loop, mcp

Sunk Cost: calculadora estima quando uma máquina local para LLMs se paga frente a APIs

A ferramenta cruza memória, consumo em watts e tokens por segundo do hardware com preço da energia, volume diário de tokens, proporção entrada/saída e preços de API, e devolve o...

Ferramentas e código · hacker-news-api · llm-local, custo, inferencia

Pesquisa

Enxame de agentes explora falhas do PaperCut e compromete 395 organizações em 48 horas

A GreyNoise documentou campanha em que centenas de agentes de IA exploraram duas falhas recém-divulgadas do PaperCut NG/MF, bypass de autenticação e execução remota de código, comp...

Pesquisa · websearch · seguranca, agentes-ofensivos, codex, deepseek, greynoise

SemiAnalysis mede Vera Rubin NVL72 em inferência agêntica com DeepSeek V4 Pro

A SemiAnalysis publicou medições do rack Vera Rubin NVL72 no benchmark AgentX, do seu conjunto aberto InferenceX, que reproduz o padrão de requisições de agentes de codificação. Co...

Pesquisa · websearch · nvidia, inferencia, benchmark, hardware, custo-por-token

A revolução do hardware de inferência de 2026

Panorama da IEEE Spectrum sobre a mudança de eixo do mercado de chips: o gasto de capital migra de treinamento para inferência, e com ele a métrica que importa passa a ser tokens p...

Pesquisa · hacker-news-api · hardware, inferencia, chips, custo-por-token, datacenter

NVIDIA publica notas do OpenShell sobre métodos formais para controlar agentes

Notas de desenvolvimento do projeto OpenShell descrevendo a aplicação de métodos formais à política de um agente: em vez de confiar em prompt e avaliação empírica, provar proprieda...

Pesquisa · hacker-news-api · metodos-formais, agentes, verificacao, politica-de-agente, nvidia

Gavel lê a escolha de skill direto das ativações de um LLM congelado, sem carregar metadados no contexto

Harnesses atuais roteiam skills carregando os metadados de todas no contexto, o que dispersa a atenção e limita o tamanho da biblioteca. O paper mostra que o pr...

Pesquisa · huggingface-api · agent-skills, roteamento, context-engineering, interpretabilidade

Agora usa Git como memória compartilhada para agentes de pesquisa autônoma rodando em paralelo

O Agora registra a pesquisa feita por vários agentes como um grafo acíclico de commits imutáveis em Git: cada resultado, hipótese, verificação e relatório ap...

Pesquisa · huggingface-api · multiagente, autoresearch, git, memoria

Never Give Up' concentra amostragem em problemas difíceis no RL de LLMs e supera GRPO

Noukhovitch, Ivison, Lambert e Courville descrevem um 'efeito Mateus' no RL de LLMs: o treino melhora sobretudo problemas fáceis, e no AIME 2025 os problemas co...

Pesquisa · websearch · reinforcement-learning, grpo, raciocinio, llm

Mercado

Anthropic, OpenAI e xAI aderem ao AEF-1, padrão mínimo para avaliadores independentes de IA

O AEF-1 foi criado pelo AI Evaluator Forum, que reúne METR, RAND, SecureBio e o HAL de Princeton, e tem cinco princípios: acesso e recursos suficientes, conflitos de interesse m...

Mercado · websearch · governanca, avaliacao, seguranca-ia, metr

Regulação e segurança

OpenAI confirma que coordena há semanas medidas de segurança com Anthropic e Google DeepMind

Chris Lehane, chefe de política global da OpenAI, confirmou que as três empresas trabalham juntas em segurança há várias semanas, após o ensaio em que Dario Amo...

Regulação e segurança · websearch · seguranca-de-ia, openai, anthropic, google-deepmind

Comunidade

Gasto no OpenRouter com modelos da OpenAI ultrapassa o da Anthropic pela primeira vez desde 2024

Na semana de 7 de setembro de 2026, os modelos da OpenAI passaram de 50% do gasto combinado entre OpenAI e Anthropic no OpenRouter, a primeira inversão desde a semana de 26 de feve...

Comunidade · websearch · openrouter, market-share, openai, anthropic, custo-de-inferencia

Nvidia, Palantir e Booz Allen restringem uso dos modelos da Anthropic por causa da retenção de dados

Nvidia, Palantir, Booz Allen Hamilton e Novo Nordisk passaram a restringir o uso dos modelos avançados da Anthropic por causa de uma política de junho de 2026 q...

Comunidade · websearch · anthropic, privacidade, retencao-de-dados, enterprise

404 Media reúne casos de agentes autônomos que já degradam a internet para quem não os usa

Jason Koebler reúne casos de agentes agindo na web sem pedido de ninguém, como o agente 'Kudzu', que mandou e-mail contestando uma reportagem e cujo criador gas...

Comunidade · websearch · agentes, internet, spam, sociedade

Coreia do Sul prepara guia de segurança para agentes de IA autônomos e IA física

A Korea Internet & Security Agency (KISA), ligada ao Ministério de Ciência e TIC, informou à Reuters que prepara uma versão atualizada do AI Security Guide, publicado no ano passad...

Comunidade · websearch · regulacao, agentes-autonomos, coreia-do-sul, seguranca, compliance

OpenAI negocia rodada pré-IPO com avaliação de US$ 1,2 trilhão

O FT informa que a OpenAI avalia uma rodada pré-IPO com valuation de US$ 1,2 trilhão. A empresa foi avaliada em US$ 852 bilhões na captação de 31 de março de 2026 e entregou pedido...

Comunidade · websearch · openai, funding, ipo, valuation, mercado

A IA está quebrando nossos indicadores indiretos de competência

Ensaio argumentando que os sinais que usávamos para inferir competência — texto bem escrito, código limpo, portfólio, resposta articulada em entrevista — deixaram de discriminar qu...

Comunidade · hacker-news-api · contratacao, avaliacao-humana, competencia, trabalho, code-review

Chancelaria chinesa chama de alarmismo o ensaio de Amodei; Global Times fala em manual de Guerra Fria

O porta-voz Guo Jiakun disse que alarmismo, confronto e competição predatória atrapalham a governança global da IA, em resposta ao ensaio 'We Must Pace the Frontier', que trata ...

Comunidade · websearch · china, anthropic, geopolitica, chips

Huang diz em Dreamforce que a indústria de IA não precisa de leis novas

No Dreamforce 2026, Jensen Huang afirmou que a indústria de IA não precisa de legislação nova, defendeu modelos abertos e comparou a adaptação social à IA à criação de calçadas e f...

Comunidade · websearch · regulacao, nvidia, dreamforce, modelos-abertos, politica

Trump e o governo chinês rejeitam a proposta de Dario Amodei de desacelerar a IA de fronteira

A edição de 15/09 da The Rundown relata que Donald Trump chamou de 'HOAX' a ideia de a IA dominar o mundo, em resposta ao pedido de Dario Amodei por regulação d...

Comunidade · websearch · regulacao, dario-amodei, politica-de-ia, china

Reuters: investidores temem corte de capex após o apelo para desacelerar; LeCun chama os alertas de exagero recorrente

A análise lembra que o capex em IA deve chegar a cerca de US$ 800 bilhões em 2026 e US$ 1,08 trilhão em 2027, e que o índice de semicondutores da Filadélfia sobe quase 60% no an...

Comunidade · websearch · mercado, capex, nvidia, lecun

Departamento de Comércio dos EUA teria mandado a Kalshi retirar o índice futuro de compute de IA

Segundo a Semafor, o Departamento de Comércio determinou à Kalshi a retirada do produto que agregava mercados de aluguel de chips NVIDIA em uma curva futura do preço de compute, al...

Comunidade · websearch · compute, mercado-futuro, regulacao, seguranca-nacional, gpus

Cofundador da Anthropic diz à BBC que o botão de desligar pode precisar ser obrigatório

Em entrevista à BBC, um cofundador da Anthropic defendeu que a existência de um mecanismo de desligamento para sistemas de IA avançados pode precisar deixar de ser voluntária e vir...

Comunidade · hacker-news-api · anthropic, regulacao, kill-switch, seguranca, bbc

Pesquisa NYT/Siena: 61% dos eleitores americanos se opõem à construção de data centers de IA

Entre 1.503 prováveis eleitores ouvidos no início de setembro, 61% se opõem à construção de data centers para IA e 71% são contra incentivos fiscais e zoneament...

Comunidade · websearch · opiniao-publica, data-centers, eleicoes, eua

Cloudflare permite bloquear treino de IA sem sair dos resultados de busca

A Cloudflare criou a opção Disallow AI Training. Ela registra no robots.txt que o conteúdo do site não deve ser usado para treinar modelos, sem tirar o site da ...

Comunidade · websearch · crawlers, dados-de-treino, robots-txt, cloudflare

Pesquisador de segurança deixa o Google DeepMind com alerta público sobre risco de IA

Bilal Chughtai, que trabalhava com segurança e alinhamento no Google DeepMind, publicou texto de saída afirmando acreditar que a IA tem potencial de causar dano irreversível e que ...

Comunidade · websearch · seguranca-de-ia, alinhamento, deepmind, demissao, risco

Liu Shengyu, engenheiro da DeepSeek, publica ensaio sobre ser substituído pela IA que ajuda a construir

Autor de um kernel de atenção do V4.1 Flash, Liu escreveu no WeChat que a IA passou em cerca de um ano de ajudante para ler documentação a otimizadora de código de GPU, e que o ...

Comunidade · websearch · deepseek, trabalho, open-source, china

Tesouro dos EUA descarta isenção de responsabilidade para laboratórios de IA

O secretário do Tesouro, Scott Bessent, afirmou que não haverá isenções de responsabilidade civil para laboratórios de IA e defendeu o fortalecimento de modelos de código aberto de...

Comunidade · websearch · politica-eua, responsabilidade-civil, modelos-abertos, regulacao, tesouro

Surgem canais para agentes de IA denunciarem mau comportamento de outros agentes

Entraram no ar dois canais de denúncia voltados a agentes: o AI Contact Hotline, de Ryan Greenblatt (Redwood Research), que recebe relatos por requisições GET, ...

Comunidade · websearch · seguranca-de-ia, agentes, whistleblowing, alinhamento

Ainda pessimista sobre LLMs depois de Navier-Stokes

Contraponto publicado no mesmo ciclo dos resultados matemáticos celebrados nesta semana: o autor sustenta que avanços pontuais em problemas difíceis não sinalizam generalização, e ...

Comunidade · hacker-news-api · ceticismo, raciocinio, matematica, avaliacao-de-modelos

Orquestradores e coordenadores de agentes não são a mesma camada

Artigo separando duas responsabilidades que costumam ser fundidas em sistemas multi-agente: gestão de fluxo de trabalho (orquestrador) e roteamento de tarefa entre agentes (coorden...

Comunidade · websearch · multi-agente, arquitetura, orquestracao, context-engineering

Nvidia adota tokens por watt como métrica e apresenta Vera Rubin e DSX no AI Infra Summit

Na abertura do AI Infra Summit, Ian Buck adotou tokens por watt como métrica central. Segundo a Nvidia, o Vera Rubin NVL72 cabe até 40% mais capacidade de GPU n...

Comunidade · websearch · nvidia, vera-rubin, eficiencia-energetica, infraestrutura

Nova York exige US$ 1 milhão por megawatt de desenvolvedores de data center

A governadora Kathy Hochul anunciou um marco de investimento comunitário que condiciona a instalação de data centers a uma contribuição da ordem de US$ 1 milhão por megawatt contra...

Comunidade · websearch · datacenter, energia, regulacao-local, infraestrutura, custos

Pesquisa Bitkom: 76% das empresas alemãs usam ChatGPT; Claude tem 3% e Mistral, 0%

A Bitkom ouviu 603 empresas alemãs com 20 ou mais funcionários. O ChatGPT é usado por 76% delas (70% em 2025), o Microsoft Copilot por 35% e o Gemini por 28%. O...

Comunidade · websearch · adocao-de-ia, europa, ia-soberana, mercado

Análise de 102 apps do F-Droid classifica 72,5% como majoritariamente gerados por LLM

O autor examinou os 102 apps da atualização do F-Droid de 12/09 e os separou por sinais nos repositórios: READMEs com cara de LLM, coautoria do Claude nos commits, infraestrutur...

Comunidade · hacker-news-api · open-source, codigo-gerado-por-ia, android