Radar do FAROL6 notas

quinta-feira, 10 de setembro de 2026

Modelos

Anthropic publica relatório de ameaças de setembro: células usaram Claude Code em mísseis, drones e pesquisa biológica de uso dual

O relatório \"Detecting and countering misuse of AI: September 2026\" cobre casos interrompidos entre dezembro de 2025 e agosto de 2026 em sete áreas, de ciberoperações a destilação....

Modelos · websearch · anthropic, threat-intelligence, claude-code, seguranca, armas

DeepSeek-V4.1-Flash: 552B de parâmetros, 1M de contexto, licença MIT e cache KV quatro vezes menor

O modelo mais em alta no Hugging Face nesta semana tem 552B de parâmetros no backbone, ativando 8B no processamento da entrada e 16B na geração, com contexto de 1 milhão de tokens ...

Modelos · huggingface · deepseek, open-weights, moe, long-context, agentes

Pesquisa

Amazon Science: agentes de pesquisa em ML não sofrem overfitting porque as estratégias vencedoras cabem em 16 a 32 tokens

Aaron Roth e Martin Bertran Lopez usaram um agente explorador que otimiza contra a validação por centenas de rodadas, um compressor que resume a estratégia e um reprodutor sem a...

Pesquisa · hacker-news-api · agentes-de-pesquisa, generalizacao, compressao, avaliacao

COBRA-Skills otimiza skills de agentes com bandits contextuais e reduz o custo em 55% a 58%

O método trata a otimização de skills como busca com orçamento: um bandit contextual escolhe quais candidatas avaliar e as skills evoluem a partir do resultado das execuções. Te...

Pesquisa · huggingface-api · agent-skills, otimizacao, bandits, agentes

Benchmark Radar: base viva e buscador de benchmarks de IA com 1.283 registros e coleta diária

O catálogo reúne 1.283 registros de benchmarks de modelos, agentes, código, raciocínio e segurança, com 12.916 observações numéricas, alimentado diariamente por 37 fontes. Acomp...

Pesquisa · huggingface-api · benchmarks, avaliacao, dados-abertos

Comunidade

Erkan Saka argumenta que o discurso apocalíptico dos líderes de IA funciona como hype

O texto aponta que estimativas de risco de extinção variam de 3% a 20% sem convergência, que alertas convivem com lançamentos de modelos na mesma semana e que previsões de corte...

Comunidade · hacker-news-api · risco-existencial, discurso, regulacao