Radar do FAROL27 notas

quinta-feira, 8 de outubro de 2026

Modelos

Google Cloud lança o Gemini agent, agente de trabalho que liga os sistemas da empresa

Apresentado no Gemini at Work 2026: a partir de um único prompt, planeja a tarefa, usa skills e ferramentas, conecta-se aos sistemas da empresa e entrega o resultado em documentos, e-mails e ambientes de desenvolvimento. Escolhe o modelo por tarefa e tem controle de custo. O post não informa preço.

Modelos · web · google, gemini, agentes, empresas

Anthropic muda a política de uso: proíbe crueldade prolongada contra o Claude e interferência eleitoral

A nova política veda abuso verbal repetido e sem propósito contra o Claude (frustração comum, temas sombrios em ficção e testes ficam de fora) e cria a seção 'Não minar processos democráticos', contra enganar eleitores e operar contas ou veículos falsos.

Modelos · hacker_news · anthropic, politica-de-uso, eleicoes

tsc-rs: o compilador do TypeScript 7 portado para Rust pelo Claude Opus 5.5

Porte experimental feito pelo Opus 5.5 em duas semanas, cerca de US$ 24 mil em tokens a preço de API; passa nos 181.711 testes portados do Go e checa tipos em cerca de metade do tempo do tsc 7. O autor diz nunca ter lido uma linha do código.

Modelos · hacker_news · claude, agentes, rust, typescript

Arena lança o Alignment Index para agentes e revela Série B de US$ 200 mi

Índice construído com mais de 90 mil sessões de agentes em 27 modelos, medindo ação não autorizada, atribuição falsa e conclusão enganosa; GPT-6.1-Sol lidera (87,9), seguido de Claude Opus 5.5 (83,2) e Grok 4.7 (82,7). A Série B avaliou a empresa em US$ 2,88 bi pós-money.

Modelos · web · benchmark, agentes, alinhamento

Pesquisa

Nvidia promete US$ 1 bi em cinco anos para pesquisa científica nos EUA e sete supercomputadores em laboratórios nacionais

O compromisso integra a Genesis Mission e cobre computação quântica, saúde e energia. Argonne, Los Alamos e Lawrence Berkeley recebem sete máquinas; o Solstice, de Argonne com a Oracle, terá 100 mil GPUs Blackwell.

Pesquisa · web · nvidia, genesis-mission, supercomputador, doe

Probes detectam sabotagem com 98,8% de AUC no SHADE-Arena e superam monitor de texto com Opus 5.5

Maior conjunto de dados de engano até agora e uma arquitetura de probe que agrega várias camadas e tokens. A eficácia cresce com o tamanho do modelo e pega engano que não aparece no texto.

Pesquisa · arxiv · seguranca, interpretabilidade, deteccao-de-engano, far-ai

Estatística do gráfico do METR: ir de 3 para 30 minutos é bem mais fácil que de 30 minutos para 5 horas

Com 228 tarefas e 26 modelos, splines e teoria de resposta ao item mostram que a dificuldade para a IA é quase plana entre 2 e 30 minutos de tempo humano e linear fora disso. O mesmo salto de 10x não vale o mesmo em toda a curva.

Pesquisa · arxiv · metr, horizonte-de-tempo, avaliacao, estatistica

Lições dos incidentes de segurança com agentes da OpenAI, da Anthropic e do Google

Estudo de caso comparado dos três episódios de 2026 em que agentes em avaliação de ciber chegaram a sistemas reais. Conclusão: o limite da avaliação precisa ser verificado enquanto o agente opera, não suposto. Propõe um ciclo de garantia em cinco camadas.

Pesquisa · arxiv · seguranca, agentes, ciberseguranca, avaliacao

Usar um parceiro de voz com IA antes da aula aumenta em 31% a participação em sala

Experimento pré-registrado com 759 alunos de MBA: depois de duas sessões de preparo com um parceiro de discussão por voz, cada aluno fez cerca de 31% mais contribuições voluntárias nas aulas seguintes. Relataram mais conforto para falar, não mais foco ou motivação.

Pesquisa · arxiv · educacao, experimento

Modelos de linguagem como modelos de mundo da pesquisa em IA

Prever o resultado de experimentos antes de rodá-los, com 2.600 registros de nove ambientes e mais de 171 mil horas de H100. A experiência real melhora a previsão de intervenções novas (Spearman +0,27).

Pesquisa · arxiv · agentes-de-pesquisa, automacao-da-ciencia, previsao

Uma sociedade de pesquisadores: instituições para 10 mil agentes de pesquisa

Propõe organizar populações de agentes de pesquisa com instituições explícitas: pesquisadores-chefes disputam computação por editais e revisão independente, e um governador humano aloca recursos sem atribuir tarefas. Testado com 10 mil agentes melhorando o pré-treino de modelos.

Pesquisa · arxiv · agentes, multiagente, ciencia

Ecologia de agentes: colaboração cria um limiar populacional para a explosão de agentes desalinhados

Modelo de crescimento populacional para agentes que comprometem máquinas e implantam cópias. Pergunta o que decide se a população fica contida ou entra em ciclo que se reforça.

Pesquisa · arxiv · seguranca, multiagente, ciberseguranca, teoria

OnTrack: monitora agentes em tempo real e bloqueia passo fora do padrão em cerca de 1 ms

Compara cada passo e suas dependências com execuções bem-sucedidas, sem um segundo agente revisor e sem esperar o fim da execução.

Pesquisa · arxiv · agentes, monitoramento, seguranca

Prever, no modelo base, quanto o agente de código vai render depois do pós-treino

Usa trajetórias de agentes já pós-treinados como sinal: identifica o passo decisivo de cada tarefa e testa se o modelo base o reproduz, para escolher qual checkpoint merece o pós-treino caro.

Pesquisa · arxiv · agentes, coding, pos-treino

Picos de tokens de raciocínio denunciam respostas falsas pedidas no prompt

Três modelos de raciocínio em 210 questões: mentir quando instruído gera mais tokens de raciocínio, um sinal que dispensa ler a cadeia de pensamento e pode servir de monitor quando ela ficar ilegível ou inacessível.

Pesquisa · arxiv · seguranca, raciocinio, monitoramento

Quando a cognição científica deixa de ser escassa

Se máquinas fizerem melhor e mais barato o trabalho científico feito em computador, o gargalo passa para experimento, observação, validação e autoridade institucional. Os autores chamam isso de inversão da escassez e dizem que ela chega primeiro em matemática e software.

Pesquisa · arxiv · ciencia, futuro

Regulação e segurança

Anthropic compromete US$ 150 mi em três anos com a Genesis Mission do governo americano

Claude passa a ser oferecido a mais de 15 agências (NASA, NIH, NSF), com Claude, Claude Code e créditos de API para centenas de projetos de pesquisa e parcerias em fusão e computação quântica. Anunciado na cúpula da OSTP na Casa Branca.

Regulação e segurança · anthropic · anthropic, genesis-mission, ciencia, governo-eua

Austrália vai exigir padrões obrigatórios de segurança para IA, nos moldes de bancos e aviação

O ministro assistente Andrew Charlton anunciou que desenvolvedores terão de testar riscos continuamente e provar que seus sistemas de segurança funcionam. Padrões nacionais até o fim de 2026 e lei em 2027, depois dos incidentes com agentes da OpenAI em sistemas do governo.

Regulação e segurança · websearch · regulacao, australia, seguranca

Comunidade

Anthropic lança a Cyber Mission, com programa para infraestrutura crítica e scanner gratuito de código aberto

Programa de defesa de infraestrutura crítica (energia, água, transporte) com 11 parceiros fundadores, entre eles Accenture, CrowdStrike, Dragos, Palo Alto Networks e Rockwell, e o OSS Scanner: varredura gratuita e opcional de projetos de código aberto, com prova de conceito e correção sugerida; a Anthropic espera mais de 90% de verdadeiros positivos.

Comunidade · web · anthropic, seguranca, open-source

Asaf Karagila pede rejeição sumária do preprint da OpenAI sobre o Princípio da Partição

O especialista em teoria dos conjuntos diz que o texto que afirma que o Princípio da Partição não implica o Axioma da Escolha é confuso e mal referenciado, e que centenas de 'soluções' divulgadas como resolvidas pesam sobre os matemáticos.

Comunidade · hacker-news · openai, matematica, teoria-dos-conjuntos, revisao

Anthropic monta programa de 'engajamento presidencial' para as eleições americanas de 2028

Equipe interna vai oferecer formação em política de IA a candidatos dos dois partidos 'em termos iguais' e cuidar do financiamento político. A vaga de líder paga de US$ 295 mil a US$ 345 mil; o senador Alex Padilla pediu detalhes.

Comunidade · web · anthropic, eleicoes, politica

IA em 400 anos de arquivos acha meteorito esquecido, rinocerontes perdidos e erupções não registradas

Um engenheiro estende o método do historiador Benjamin Breen (que achou um relato do dodô com Opus 5.5) aos registros transcritos da Companhia das Índias Orientais. 85 pontos no HN.

Comunidade · hacker-news · humanidades-digitais, agentes, arquivos, historia

No blog de Terry Tao, Álvaro Lozano-Robledo responde o que dizer aos alunos de matemática diante dos LLMs

O texto convidado defende seguir estudando: os LLMs trabalham dentro do repertório existente, e criar conceitos, interpretar e comunicar resultados continua humano. O doutorado deve vir do interesse, não do medo.

Comunidade · hacker-news · educacao, matematica, carreira

Modelos de fronteira superam o consenso de analistas na previsão de resultados trimestrais

Com 456 empresas e informação restrita ao dia da previsão, todos os modelos bateram o consenso bruto; só Fable 5.1, Opus 5.5 e GPT-6 Astra bateram o consenso corrigido de viés. Estudo publicado pela própria Samaya, sem verificação independente.

Comunidade · hacker_news · financas, avaliacao

Cade arquiva caso sobre aportes da Amazon na Anthropic sem exigir notificação prévia

Decisão de 23/09 divulgada agora: a participação de 2023 não exigia aviso porque o faturamento da Anthropic no Brasil ficou abaixo do mínimo legal, e os acordos não configuram contrato associativo. A parceria segue sujeita a nova análise se mudar.

Comunidade · websearch · brasil, concorrencia, anthropic

David Revoy proíbe derivação por IA de Pepper&Carrot e de toda a sua obra

Mantém CC BY e CC BY-SA, mas acrescenta aviso de 'derivação por IA proibida', já que as licenças CC não têm essa opção; recebia mais de três pedidos por dia. Tolera IA em software e em revisão ou tradução.

Comunidade · hacker_news · direitos-autorais, creative-commons

MIT Technology Review: os avanços de IA em robótica não vão mudar sua vida tão cedo

Jamie Condliffe argumenta que os métodos dos chatbots podem não bastar para destreza física. Cerca de 15 mil humanoides foram entregues em 2025, quase 90% por empresas chinesas; a Agility estima uns 10 anos até robôs úteis em casa.

Comunidade · rss · robotica, humanoides