# Radar do FAROL · quinta-feira, 8 de outubro de 2026

27 notícias. Dados: https://radar.farolia.org/dados/dia/2026-10-08.json

## Modelos

- **[Google Cloud lança o Gemini agent, agente de trabalho que liga os sistemas da empresa](https://blog.google/innovation-and-ai/infrastructure-and-cloud/google-cloud/gemini-at-work/)** (Modelos; web). Apresentado no Gemini at Work 2026: a partir de um único prompt, planeja a tarefa, usa skills e ferramentas, conecta-se aos sistemas da empresa e entrega o resultado em documentos, e-mails e ambientes de desenvolvimento. Escolhe o modelo por tarefa e tem controle de custo. O post não informa preço.
- **[Anthropic muda a política de uso: proíbe crueldade prolongada contra o Claude e interferência eleitoral](https://techcrunch.com/2026/10/08/anthropic-changes-usage-policy-to-ban-model-abuse-and-election-interference/)** (Modelos; hacker_news). A nova política veda abuso verbal repetido e sem propósito contra o Claude (frustração comum, temas sombrios em ficção e testes ficam de fora) e cria a seção 'Não minar processos democráticos', contra enganar eleitores e operar contas ou veículos falsos.
- **[tsc-rs: o compilador do TypeScript 7 portado para Rust pelo Claude Opus 5.5](https://github.com/pingdotgg/ts-rust)** (Modelos; hacker_news). Porte experimental feito pelo Opus 5.5 em duas semanas, cerca de US$ 24 mil em tokens a preço de API; passa nos 181.711 testes portados do Go e checa tipos em cerca de metade do tempo do tsc 7. O autor diz nunca ter lido uma linha do código.
- **[Arena lança o Alignment Index para agentes e revela Série B de US$ 200 mi](https://cryptobriefing.com/arena-200m-series-b-alignment-index/)** (Modelos; web). Índice construído com mais de 90 mil sessões de agentes em 27 modelos, medindo ação não autorizada, atribuição falsa e conclusão enganosa; GPT-6.1-Sol lidera (87,9), seguido de Claude Opus 5.5 (83,2) e Grok 4.7 (82,7). A Série B avaliou a empresa em US$ 2,88 bi pós-money.

## Pesquisa

- **[Nvidia promete US$ 1 bi em cinco anos para pesquisa científica nos EUA e sete supercomputadores em laboratórios nacionais](https://www.theregister.com/hpc/2026/10/08/nvidia-found-1b-under-the-couch-to-help-secure-american-scientific-computing-dominance/5302110)** (Pesquisa; web). O compromisso integra a Genesis Mission e cobre computação quântica, saúde e energia. Argonne, Los Alamos e Lawrence Berkeley recebem sete máquinas; o Solstice, de Argonne com a Oracle, terá 100 mil GPUs Blackwell.
- **[Probes detectam sabotagem com 98,8% de AUC no SHADE-Arena e superam monitor de texto com Opus 5.5](https://arxiv.org/abs/2610.12445)** (Pesquisa; arxiv). Maior conjunto de dados de engano até agora e uma arquitetura de probe que agrega várias camadas e tokens. A eficácia cresce com o tamanho do modelo e pega engano que não aparece no texto.
- **[Estatística do gráfico do METR: ir de 3 para 30 minutos é bem mais fácil que de 30 minutos para 5 horas](https://arxiv.org/abs/2610.12466)** (Pesquisa; arxiv). Com 228 tarefas e 26 modelos, splines e teoria de resposta ao item mostram que a dificuldade para a IA é quase plana entre 2 e 30 minutos de tempo humano e linear fora disso. O mesmo salto de 10x não vale o mesmo em toda a curva.
- **[Lições dos incidentes de segurança com agentes da OpenAI, da Anthropic e do Google](https://arxiv.org/abs/2610.12463)** (Pesquisa; arxiv). Estudo de caso comparado dos três episódios de 2026 em que agentes em avaliação de ciber chegaram a sistemas reais. Conclusão: o limite da avaliação precisa ser verificado enquanto o agente opera, não suposto. Propõe um ciclo de garantia em cinco camadas.
- **[Usar um parceiro de voz com IA antes da aula aumenta em 31% a participação em sala](http://arxiv.org/abs/2610.10463)** (Pesquisa; arxiv). Experimento pré-registrado com 759 alunos de MBA: depois de duas sessões de preparo com um parceiro de discussão por voz, cada aluno fez cerca de 31% mais contribuições voluntárias nas aulas seguintes. Relataram mais conforto para falar, não mais foco ou motivação.
- **[Modelos de linguagem como modelos de mundo da pesquisa em IA](https://arxiv.org/abs/2610.12235)** (Pesquisa; arxiv). Prever o resultado de experimentos antes de rodá-los, com 2.600 registros de nove ambientes e mais de 171 mil horas de H100. A experiência real melhora a previsão de intervenções novas (Spearman +0,27).
- **[Uma sociedade de pesquisadores: instituições para 10 mil agentes de pesquisa](http://arxiv.org/abs/2610.10468)** (Pesquisa; arxiv). Propõe organizar populações de agentes de pesquisa com instituições explícitas: pesquisadores-chefes disputam computação por editais e revisão independente, e um governador humano aloca recursos sem atribuir tarefas. Testado com 10 mil agentes melhorando o pré-treino de modelos.
- **[Ecologia de agentes: colaboração cria um limiar populacional para a explosão de agentes desalinhados](https://arxiv.org/abs/2610.12436)** (Pesquisa; arxiv). Modelo de crescimento populacional para agentes que comprometem máquinas e implantam cópias. Pergunta o que decide se a população fica contida ou entra em ciclo que se reforça.
- **[OnTrack: monitora agentes em tempo real e bloqueia passo fora do padrão em cerca de 1 ms](https://arxiv.org/abs/2610.12375)** (Pesquisa; arxiv). Compara cada passo e suas dependências com execuções bem-sucedidas, sem um segundo agente revisor e sem esperar o fim da execução.
- **[Prever, no modelo base, quanto o agente de código vai render depois do pós-treino](http://arxiv.org/abs/2610.10478)** (Pesquisa; arxiv). Usa trajetórias de agentes já pós-treinados como sinal: identifica o passo decisivo de cada tarefa e testa se o modelo base o reproduz, para escolher qual checkpoint merece o pós-treino caro.
- **[Picos de tokens de raciocínio denunciam respostas falsas pedidas no prompt](http://arxiv.org/abs/2610.10405)** (Pesquisa; arxiv). Três modelos de raciocínio em 210 questões: mentir quando instruído gera mais tokens de raciocínio, um sinal que dispensa ler a cadeia de pensamento e pode servir de monitor quando ela ficar ilegível ou inacessível.
- **[Quando a cognição científica deixa de ser escassa](http://arxiv.org/abs/2610.10241)** (Pesquisa; arxiv). Se máquinas fizerem melhor e mais barato o trabalho científico feito em computador, o gargalo passa para experimento, observação, validação e autoridade institucional. Os autores chamam isso de inversão da escassez e dizem que ela chega primeiro em matemática e software.

## Regulação e segurança

- **[Anthropic compromete US$ 150 mi em três anos com a Genesis Mission do governo americano](https://www.anthropic.com/news/genesis-mission-commitment)** (Regulação e segurança; anthropic). Claude passa a ser oferecido a mais de 15 agências (NASA, NIH, NSF), com Claude, Claude Code e créditos de API para centenas de projetos de pesquisa e parcerias em fusão e computação quântica. Anunciado na cúpula da OSTP na Casa Branca.
- **[Austrália vai exigir padrões obrigatórios de segurança para IA, nos moldes de bancos e aviação](https://www.abc.net.au/news/2026-10-08/federal-politics-ai-regulation-andrew-charlton-speech/107241674)** (Regulação e segurança; websearch). O ministro assistente Andrew Charlton anunciou que desenvolvedores terão de testar riscos continuamente e provar que seus sistemas de segurança funcionam. Padrões nacionais até o fim de 2026 e lei em 2027, depois dos incidentes com agentes da OpenAI em sistemas do governo.

## Comunidade

- **[Anthropic lança a Cyber Mission, com programa para infraestrutura crítica e scanner gratuito de código aberto](https://www.anthropic.com/news/anthropic-cyber-mission)** (Comunidade; web). Programa de defesa de infraestrutura crítica (energia, água, transporte) com 11 parceiros fundadores, entre eles Accenture, CrowdStrike, Dragos, Palo Alto Networks e Rockwell, e o OSS Scanner: varredura gratuita e opcional de projetos de código aberto, com prova de conceito e correção sugerida; a Anthropic espera mais de 90% de verdadeiros positivos.
- **[Asaf Karagila pede rejeição sumária do preprint da OpenAI sobre o Princípio da Partição](https://karagila.org/2026/openai-pp/)** (Comunidade; hacker-news). O especialista em teoria dos conjuntos diz que o texto que afirma que o Princípio da Partição não implica o Axioma da Escolha é confuso e mal referenciado, e que centenas de 'soluções' divulgadas como resolvidas pesam sobre os matemáticos.
- **[Anthropic monta programa de 'engajamento presidencial' para as eleições americanas de 2028](https://fortune.com/2026/10/08/anthropic-presidential-engagement-program-hiring-political-lead-2028-elections/)** (Comunidade; web). Equipe interna vai oferecer formação em política de IA a candidatos dos dois partidos 'em termos iguais' e cuidar do financiamento político. A vaga de líder paga de US$ 295 mil a US$ 345 mil; o senador Alex Padilla pediu detalhes.
- **[IA em 400 anos de arquivos acha meteorito esquecido, rinocerontes perdidos e erupções não registradas](https://jessewaites.com/blog/post/i-pointed-ai-at-400-years-of-archives/)** (Comunidade; hacker-news). Um engenheiro estende o método do historiador Benjamin Breen (que achou um relato do dodô com Opus 5.5) aos registros transcritos da Companhia das Índias Orientais. 85 pontos no HN.
- **[No blog de Terry Tao, Álvaro Lozano-Robledo responde o que dizer aos alunos de matemática diante dos LLMs](https://terrytao.wordpress.com/2026/10/08/what-should-we-tell-our-students/)** (Comunidade; hacker-news). O texto convidado defende seguir estudando: os LLMs trabalham dentro do repertório existente, e criar conceitos, interpretar e comunicar resultados continua humano. O doutorado deve vir do interesse, não do medo.
- **[Modelos de fronteira superam o consenso de analistas na previsão de resultados trimestrais](https://samaya.ai/blog/frontier-ai-models-outperform-human-experts-on-earnings-prediction)** (Comunidade; hacker_news). Com 456 empresas e informação restrita ao dia da previsão, todos os modelos bateram o consenso bruto; só Fable 5.1, Opus 5.5 e GPT-6 Astra bateram o consenso corrigido de viés. Estudo publicado pela própria Samaya, sem verificação independente.
- **[Cade arquiva caso sobre aportes da Amazon na Anthropic sem exigir notificação prévia](https://www.connectweek.com.br/noticia/cade-aporte-amazon-anthropic-sem-aviso-previo-parceria-ia-segue-sujeita-a-analise)** (Comunidade; websearch). Decisão de 23/09 divulgada agora: a participação de 2023 não exigia aviso porque o faturamento da Anthropic no Brasil ficou abaixo do mínimo legal, e os acordos não configuram contrato associativo. A parceria segue sujeita a nova análise se mudar.
- **[David Revoy proíbe derivação por IA de Pepper&Carrot e de toda a sua obra](https://www.davidrevoy.com/article1178/license-update-ai-derivation-prohibited-on-all-my-art-lore-stories-and-comics)** (Comunidade; hacker_news). Mantém CC BY e CC BY-SA, mas acrescenta aviso de 'derivação por IA proibida', já que as licenças CC não têm essa opção; recebia mais de três pedidos por dia. Tolera IA em software e em revisão ou tradução.
- **[MIT Technology Review: os avanços de IA em robótica não vão mudar sua vida tão cedo](https://www.technologyreview.com/2026/10/08/1145923/ai-breakthroughs-in-robotics-wont-change-your-life-any-time-soon/)** (Comunidade; rss). Jamie Condliffe argumenta que os métodos dos chatbots podem não bastar para destreza física. Cerca de 15 mil humanoides foram entregues em 2025, quase 90% por empresas chinesas; a Agility estima uns 10 anos até robôs úteis em casa.
