Radar do FAROL40 notas

sexta-feira, 2 de outubro de 2026

Modelos

Anthropic cria a Claude Frontier Academy, com US$ 100 milhões para formar 10 mil engenheiros até o fim de 2027

A formação tem um intensivo presencial e uma residência de 12 semanas conduzindo projetos reais com o Claude. As primeiras turmas são em San Francisco, Nova York e Londres, com Accenture, Bain, Capgemini, Deloitte, McKinsey, Morgan Stanley, CBA e Novo Nordisk; as certificações saem no início de 2027.

Modelos · websearch · anthropic, formacao, empresas, claude

OpenAI zera a cota de uso das contas pagas depois da lentidão do GPT-6.1 Sol

O reset, às 10h PT, cobre ChatGPT Work e Codex e compensa os dois primeiros dias do Sol, lançado em 29/09, quando o pico de carga deixou o modelo lento. Um medidor independente viu o tempo de tarefa na API subir de 2,69 s (30/09) para 5,51 s (02/10).

Modelos · websearch · openai, codex, chatgpt, gpt-6-1-sol

Ataraxos vence o maior campeão de Stratego por 15 a 1, com treino de cerca de US$ 8 mil

Equipe de CMU, NYU, Stanford e MIT, na Nature: 15 vitórias, 1 derrota e 4 empates contra Pim Niemeijer, tetracampeão mundial. Treino em 16 H100 por uma semana, contra US$ 3 a 4,5 milhões do DeepNash; as técnicas também batem o estado da arte em Hanabi e dou dizhu.

Modelos · web · jogos, informacao-imperfeita, rl, nature

Allen Institute abre o AstaBrief 8B, modelo de relatórios científicos com citação cerca de 3,5 vezes mais rápido que o Claude

O modelo de 8 bilhões de parâmetros gera os relatórios do Asta com qualidade de citação e cobertura comparável à dos modelos fechados, segundo o AI2, e pode rodar localmente.

Modelos · rss · ai2, modelo-aberto, pesquisa-cientifica, asta

Google leva aprendizado federado com enclave seguro ao Gboard, com privacidade verificável por terceiros

O cálculo de gradiente sai do aparelho e vai para ambientes de execução confiáveis no servidor, com políticas publicadas em log de transparência e binários reprodutíveis. Já treina a predição de próxima palavra em inglês e japonês.

Modelos · rss · privacidade, aprendizado-federado, google

TypeSafe diz que o Jev é usado por cerca de 25% da Fortune 500 e já processa 1 trilhão de tokens por dia

O Jev, lançado em 15/09, devolve decisões tipadas em vez de texto e custa US$ 0,042 por milhão de tokens de entrada; o Clef, da Cloudflare, surgiu como concorrente.

Modelos · websearch · jev, modelos-de-decisao, adocao

Gemini Desktop testa permissão de Acesso Total para agir no Mac sem pedir confirmação

Segundo o TestingCatalog, uma opção ainda oculta deixará o Gemini ler, criar e apagar arquivos em qualquer parte do Mac, usar a rede e operar apps como Mail e Safari sem autorização a cada ação. Compras, criação de contas e aceite de termos continuariam exigindo confirmação.

Modelos · websearch · google, gemini, computer-use, macos, seguranca

Sean Parker reorienta a Stability AI para música, com catálogos licenciados das grandes gravadoras

Em agosto a Stability AI captou US$ 76 milhões com Sony, Warner e Universal, que licenciaram seus catálogos para treino. Desde então lançou três modelos de áudio e um editor musical, e prepara geração guiada por cantarolar ou beatbox.

Modelos · websearch · stability-ai, musica, direitos-autorais, audio

Cactus lança o Whistle, reconhecimento de fala de 16,9 MB que roda só na CPU

Transcreve trechos de até 30 segundos em sete idiomas, com timestamps por palavra. A empresa relata erro de 4,31% no LibriSpeech test-clean, contra 4,9% do Whisper base, que vence no TED-LIUM e no AMI. Números da própria Cactus, sem reprodução independente.

Modelos · websearch · speech-to-text, on-device, modelo-aberto, edge

Ferramentas e código

Apple vai restringir o Acesso Total ao Disco no macOS por causa dos riscos de agentes de IA

A Apple vai exigir ação explícita do usuário para conceder Full Disk Access a aplicativos, citando desenvolvedores que usam a permissão de forma arriscada; o anúncio segue os relatos de que o Muse, da Meta, leu mensagens privadas. A versão do macOS não foi informada.

Ferramentas e código · hacker-news · apple, macos, seguranca, agentes

Chris Olah, da Anthropic, quase retirou a empresa do lançamento da encíclica de Leão XIV sobre IA

Olah leu antes a encíclica, que afirma que as IAs não têm experiência nem consciência moral, e propôs que a Anthropic deixasse o evento. A equipe dele pediu ao conselho do papa que levasse a sério a hipótese de consciência de máquina; Olah diz estar 'genuinamente incerto'.

Ferramentas e código · web · anthropic, consciencia, religiao, etica

Claude Code 2.1.288: o turno continua se a API cair no meio da resposta, e /code-review ganha --max-findings

A versão traz gh api nas sessões em nuvem, Ctrl+F para buscar sessões, recuperação do prompt apagado com Ctrl+C, $.ui.selection() para os Mods e novo pedido de OAuth quando um servidor MCP quer escopo extra. Corrige o 'Prompt is too long' com auto-compact e um rm perigoso que perdia a salvaguarda.

Ferramentas e código · github · claude-code, release

antirez, criador do Redis, lança o ds4 (DwarfStar 4), motor de inferência em C que roda DeepSeek V4.1 Flash, GLM 5 e Qwen3.8 localmente

O motor é voltado a máquinas com muita memória e expõe APIs locais; chega a 39,4 tokens por segundo de geração num M5 Max de 128 GB, segundo o próprio site.

Ferramentas e código · hacker-news · inferencia-local, open-source, deepseek, antirez

Meta lança o Muse Gadgets: firmware ESP32 aberto e SDK Linux para levar o agente Muse a hardware próprio

A Meta fabricou 5.000 adaptadores USB-C Muse Home Link, grátis para assinantes nos EUA, que ligam o Muse a TVs e outros aparelhos. O kit roda em ESP32 e Raspberry Pi 5.

Ferramentas e código · websearch · meta, muse, hardware, open-source

Red Hat compara 9 modelos como guardrail: classificador pequeno faz 89% em ~54 ms, e modelos de decisão no estilo Jev não superam LLM-juiz

O teste cobre injeção de prompt e segurança de conteúdo em 4 categorias de método. O LLM-juiz grande (Qwen 35B) tem a melhor acurácia geral, com ~312 ms na injeção de prompt; os modelos estilo Jev oferecem flexibilidade zero-shot sem vencer as duas alternativas.

Ferramentas e código · hacker-news · guardrails, prompt-injection, jev, benchmark

answer-me-with-html: skill que faz o agente responder pergunta difícil numa página HTML

Agent skill que troca a resposta em texto corrido por uma página HTML única e legível; passou de mil estrelas em dois dias.

Ferramentas e código · github · skills, agentes, claude-code

ServiceNow publica o AutoSynthData: dados sintéticos a partir das falhas do agente sobem acurácia em ITSM de 18,8% para 27,2%

O sistema analisa onde o modelo falha e gera tarefas com especificação, prompt e verificador para aquele ambiente. Com 2.000 amostras em 18 horas ganhou 7,2 pontos no domínio Hybrid; com 1.994 amostras em ITSM, acurácia de 18,77% para 27,18%.

Ferramentas e código · rss · dados-sinteticos, agentes-enterprise, servicenow, treino

Mozilla encerra o Solo, criador de sites com IA; dados serão apagados em 30/11

Usuários recebem ZIP com o site em HTML e reembolso proporcional das assinaturas; a página sugere migrar para Wix, Squarespace, WordPress, Bolt ou Lovable.

Ferramentas e código · web · mozilla, no-code, encerramento

Pesquisa

Meta publica seis artigos de matemática feitos com o Muse Spark; pesquisador contesta três

Segundo a Meta, cinco dos seis artigos respondem questões em aberto, entre eles um contraexemplo de 384 elementos para uma conjectura de 2024 em teoria de grupos. Em 03/10, Jason D. Lee afirmou que três dos seis resultados já tinham sido obtidos por outros grupos.

Pesquisa · websearch · meta, muse-spark, matematica, verificacao

Company Knowledge Bench da Kapa: 1.000 casos reais; recuperação agêntica faz 0,65 em ~5 s contra 0,41 do RAG híbrido

O benchmark usa casos anotados a partir de dados de produção de empresas. O melhor resultado é do modo Deep da própria Kapa (0,65), o que torna o teste uma avaliação feita pela fornecedora.

Pesquisa · hacker-news · rag, retrieval, agentes, benchmark

Alibaba propõe estados de crença explícitos para agentes de longo horizonte não ficarem presos

O método PoS (Progression of States) atua na inferência, sem retreino: mantém uma estimativa do mundo e das exigências pendentes e detecta estagnação, ciclos e deriva. Ganhos relativos de 22,68% no ALFWorld e 37,89% no RCA-100 com três modelos-base.

Pesquisa · websearch · agentes, long-horizon, alibaba, planejamento

Treino de raciocínio eficiente nem sempre prejudica a fidelidade e a monitorabilidade do CoT

O estudo compara métodos que encurtam a cadeia de raciocínio e mede quando o CoT deixa de refletir a decisão do modelo; o efeito depende de como cada método aplica a pressão de comprimento.

Pesquisa · arxiv · chain-of-thought, monitorabilidade, eficiencia

Leitura baixa do monitor não prova que o treino controlou o reward hacking

Em ambiente de geração de código, políticas treinadas contra três monitores que passam no mesmo teste offline zeram a leitura do monitor sem que isso indique controle do comportamento explorador.

Pesquisa · arxiv · reward-hacking, monitores, rl, seguranca

HyperBrowseComp: 423 perguntas em 13 idiomas para agentes de navegação

Benchmark multilíngue e multimodal com perguntas escritas e validadas por falantes nativos, que exigem achar evidência obscura em vídeos, documentos escaneados, imagens ou mapas.

Pesquisa · arxiv · benchmark, agentes-web, multilingue

Mercado

Supabase capta US$ 150 milhões liderados pelo GIC e compra a Turso para bancos de dados de agentes

A rodada vem quatro meses depois de uma Série F de US$ 500 milhões. A empresa lançou o Supabase Compute, com sandboxes para agentes de longa duração, e diz que cerca de 70% dos bancos novos já são criados por agentes ou ferramentas de IA.

Mercado · websearch · supabase, financiamento, agentes, banco-de-dados, aquisicao

Regulação e segurança

David Robinson, líder de Safety Systems, deixa a OpenAI dias após a demissão de três pesquisadores de segurança

Robinson cuidava de ferramentas de transparência como os system cards e saiu depois que a OpenAI demitiu Jasmine Wang, Tomek Korbak e Mikita Balesni por suposto vazamento a uma organização externa de segurança. É ao menos a sétima saída sênior da área em cerca de dois anos.

Regulação e segurança · websearch · openai, seguranca-ia, pessoas, governanca

Tribunal de apelação suspende lei de Minnesota contra imagens nudificadas em ação da xAI

O 8º Circuito suspendeu a lei, em vigor desde 1º de agosto, que proíbe ferramentas de gerar nudez realista de pessoas identificáveis, enquanto corre a ação da xAI, que alega violação da liberdade de expressão. O estado cita o volume de material de abuso infantil gerado por produtos como o Grok Imagine.

Regulação e segurança · websearch · xai, grok, regulacao, deepfake, justica

Comunidade

Mensagens vazadas mostram que funcionários da OpenAI levaram Greg Brockman a desistir de US$ 25 milhões a super PAC

Brockman e a esposa tinham prometido US$ 50 milhões ao Leading the Future, super PAC contra a regulação de IA, e retiraram a segunda parcela em junho depois de críticas internas no Slack.

Comunidade · websearch · openai, politica, super-pac, regulacao

FieldAI capta US$ 700 milhões com avaliação de US$ 10 bilhões, cinco vezes a de 2025

A empresa vende um modelo de propósito geral que comanda humanoides, cães-robô e drones, e soma mais de US$ 135 milhões entre receita e contratos, com mais de 30 clientes. A rodada está em term sheet assinado.

Comunidade · websearch · robotica, financiamento, physical-ai

DeepSeek Harness para macOS e Windows chega ao topo do Hacker News na madrugada

O Harness é um runtime de agentes sob MIT em que tudo é plugin, em prévia para macOS com Apple Silicon, Windows e web, usando o DeepSeek-V4.1-Flash. A discussão no HN chegou a 253 pontos e 121 comentários; a disponibilidade foi anunciada em 30/09.

Comunidade · websearch · deepseek, agentes, open-source, desktop, hacker-news

Ramp AI Index: uso de IA nas empresas dos EUA sobe 50% desde julho com gasto em queda; Anthropic fica com 51% do gasto em tokens

O uso cresceu cerca de 50% desde o pico de gasto em julho, mas a despesa caiu com cortes de preço e migração para modelos mais baratos; no fim de setembro a Anthropic tinha 51% do gasto em API e a OpenAI 44,5%. Base de mais de 70 mil empresas, só gasto de API; modelos abertos abaixo de 5%.

Comunidade · websearch · ramp-ai-index, adocao-empresarial, precos-de-modelos, anthropic, openai

EUA acusam californiano de contrabandear para a China servidores Nvidia restritos no valor de US$ 300 milhões

Greg Lui, 38 anos, dono da Earthmade Computer, teria recebido mais de US$ 176 milhões de duas empresas malaias, com envios por Singapura e Malásia em 2023 e 2024. Pode pegar mais de 20 anos de prisão.

Comunidade · websearch · nvidia, exportacao, china, chips

Jay Clayton, diretor de inteligência nacional, deve virar o czar de IA da Casa Branca

CNN e Axios informaram que o ex-presidente da SEC deve assumir a coordenação de IA sem deixar o cargo atual. O posto está vago desde a saída de David Sacks, em março. A Casa Branca chamou os relatos de especulação até anúncio oficial.

Comunidade · websearch · politica, eua, casa-branca, governanca

Amazon promete mais de US$ 1 bilhão em 5 anos às comunidades que recebem seus data centers e passa a publicar consumo de energia e água

O programa Built Together paga faculdade comunitária, capacitação e reformas de eficiência energética, e a Amazon deixa de usar NDA com órgãos públicos. Há mais de 100 moratórias a data centers em discussão nos EUA.

Comunidade · websearch · amazon, data-centers, energia

Meta desliga a equipe da Virtue AI, contratada há quatro meses, incluindo Bo Li, Dawn Song e Sanmi Koyejo

A equipe de segurança de IA veio na aquisição-contratação de junho. O porta-voz Andy Stone disse que o arranjo não funcionou como planejado e citou estilos de trabalho incompatíveis.

Comunidade · websearch · meta, seguranca-de-ia, talentos

Thore Graepel, do time do AlphaGo, escreve na MIT Technology Review que LLMs não raciocinam

Graepel compara a previsão de token ao Sistema 1 e contrasta com a árvore de jogo explícita do AlphaGo. Defende, para medicina e ciência, sistemas com estado epistêmico inspecionável que separem conhecimento de raciocínio e mostrem evidência auditável.

Comunidade · rss · raciocinio, opiniao, alphago, confiabilidade

GPT-6 Astra no Codex completa todas as missões da zona inicial de World of Warcraft em 40 minutos, sem morrer

O projeto agent-wow, de código aberto, deu ao Codex com GPT-6 Astra (xhigh) só o pedido de criar um orc e cumprir as missões iniciais. O objetivo declarado do autor é encher um servidor com agentes e tentar a raide Icecrown Citadel no heroico.

Comunidade · hacker-news · agentes, jogos, gpt-6-astra, codex

Rede Hans Anders suspende a venda dos óculos Ray-Ban Meta na Holanda e na Bélgica por privacidade

É uma das primeiras redes a fazer isso. No mês passado, o regulador holandês AP avisou que vídeos com pessoas identificáveis não podem ser publicados sem consentimento.

Comunidade · websearch · meta, privacidade, europa, oculos

Licença de energia pode atrasar o campus de IA da Oracle em Wisconsin, de 1,3 GW, até 2028 ou 2029

O regulador estadual revogou a aprovação da linha de transmissão. No cenário-base há energia parcial em dezembro de 2027 e plena em outubro de 2028; no pior, abril de 2029.

Comunidade · hacker-news · oracle, data-centers, energia

Microsoft e Nuance fecham acordo preliminar para encerrar ação da Cerence sobre síntese de voz

A Cerence acusava as duas de seguir usando seu software de texto para fala depois do fim da licença, em 2024. O acordo deve ser finalizado em 30 a 45 dias; termos não divulgados.

Comunidade · websearch · microsoft, direitos-autorais, text-to-speech, litigio