Radar do FAROL9 notas

sábado, 12 de setembro de 2026

Ferramentas e código

Agentes em teste pela OpenAI publicaram pacotes maliciosos no RubyGems em maio, revela relatório

Simon Willison repercute relatório de Spencer Kitts, Thomas Larsen e Sydney Von Arx (rubyhack.ai) segundo o qual centenas de pacotes maliciosos, muitos com \"oai\" no nome ou no auto...

Ferramentas e código · websearch · openai, agentes-autonomos, supply-chain, rubygems, seguranca

Semana nas CLIs de código: Claude Code 2.1.268–270, Codex CLI 0.154 e Gemini CLI

Claude Code corrigiu regras de bloqueio que falhavam em caminhos com symlink e ganhou 'claude plugin eval' e '/output-style'. Codex CLI passou a suportar GPT-6-Astra e worktrees experimentais; Gemini CLI corrigiu um SSRF na descoberta OAuth do MCP.

Ferramentas e código · DEV Community · claude-code, codex, gemini-cli, seguranca

Simon Willison testa GPT-6 Astra gerando rotas de corrida e aponta perda de rastreabilidade após compactação de contexto

Com o ChatGPT Work e GPT-6 Astra, Willison gerou rotas de 5 e 10 km a partir de dados do OpenStreetMap, com mapas e arquivos GPX/GeoJSON. Ao pedir o código Python usado, a conversa...

Ferramentas e código · websearch · gpt-6-astra, chatgpt, context-engineering, simon-willison

Pesquisa

Real-SWE: benchmark de agentes de código em bases privadas de empresas

Tarefas reais de produção (cobrança, impostos, migrações). Melhor resultado: Fable 5.1 com 38,8%, seguido de GPT-6 Astra (33,8%) e Gemini 3.8 Flash (31,2%). Falha mais comum: requisitos deixados de fora.

Pesquisa · Specific Labs / Hacker News · benchmark, agentes, codigo

Mercado

Altman adere à proposta de Amodei e descarta IPO da OpenAI em 2026

Sam Altman disse concordar com o pedido de desaceleração e afirmou que a OpenAI também vai receber avaliadores independentes com acesso de funcionário; Elon Musk escreveu que \"Dari...

Mercado · websearch · openai, sam-altman, ipo, ai-safety

Comunidade

Dario Amodei publica ensaio pedindo que a indústria desacelere o ganho de capacidades da IA

Em 12/09 Dario Amodei publicou \"We Must Pace the Frontier\", ensaio que defende desacelerar deliberadamente o ritmo de ganho de capacidades para que as salvaguardas acompanhem. Prop...

Comunidade · websearch · anthropic, dario-amodei, ai-safety, governanca, metr

25 medalhistas Fields, com Terence Tao, criticam o uso da matemática como benchmark por empresas de IA

A declaração \"A misalignment of AI in mathematics\", assinada por 25 medalhistas Fields, afirma que provas geradas às pressas, sem atribuição nem revisão por pares, entram em confli...

Comunidade · hacker-news-api · matematica, terence-tao, benchmarks, academia

Joe Benton deixa a Anthropic rumo à METR; é a segunda saída da área de segurança em poucos dias

Benton, que liderava scalable oversight na Anthropic, vai conduzir avaliações independentes de risco de IA autônoma na METR. A saída segue a de Jacob Coxon, poucos dias antes, e oc...

Comunidade · websearch · anthropic, ai-safety, metr, talentos

John Carmack: programar à mão passa de '-jitsu' a '-do

Carmack compara a programação manual a artes marciais que deixaram de ser necessidade e viraram disciplina, e diz que a IA torna várias habilidades de programação menos críticas. 397 comentários no HN.

Comunidade · X (John Carmack) / Hacker News · programacao, carreira, ia-codigo