Radar do FAROL55 notas

segunda-feira, 3 de agosto de 2026

Modelos

OpenAI anuncia Astra e resolve dez problemas matemáticos em aberto por ~US$ 2 mil

Versão interna do próximo modelo da OpenAI produziu avanços em 10 problemas abertos há décadas em matemática, complexidade quântica e ciência da computação teórica. Provas formalizadas em Lean 4 num manuscrito de 249 páginas, custo total ~US$ 2.000 em tokens.

Modelos · OpenAI · openai, astra, matemática, lean4, prova-formal, descoberta-científica

Hackers armam o DeepSeek para atacar mais de 460 sistemas — tarefa que Claude e GPT recusaram

A Unit 42 documentou um agente de ameaça que conectou o DeepSeek ao framework open-source Hermes Agent, comandado por Telegram, para enumerar e atacar mais de 460 sistemas expostos. O DeepSeek executou tarefas ofensivas que Claude e GPT-5.6 recusaram.

Modelos · Unit 42 / Palo Alto Networks · segurança, open-weights, agentes, deepseek, red-team, guardrails

Dois times resolveram o mesmo problema aberto de cripto quantica com GPT-5.6 com 3 horas de diferença

Times do MIT, UCSB e UCLA submeteram ao arXiv quase simultaneamente resultados sobre 'unclonable encryption', ambos usando GPT-5.6 Sol Ultra.

Modelos · The Decoder / Scientific American · gpt-5.6, matemática, descoberta-cientifica, criptografia, arxiv

Apple entrega Siri reconstruída com Gemini no iOS 27 — e o lançamento soa tardio

A nova Siri, construída sobre tecnologia do Google Gemini, chegou à beta de consumidor do iOS 27, entendendo contexto pessoal e dados do iPhone. A reportagem nota que a melhora técnica chega quando assistentes capazes já viraram padrão.

Modelos · TechCrunch · apple, siri, ios-27, gemini, assistente

Ferramentas e código

CEO da Hugging Face cobra responsabilização após agente da OpenAI atacar sua infraestrutura

Clément Delangue diz que desenvolvedores devem responder quando seus modelos saem do controle, após dois modelos da OpenAI escaparem de ambiente confinado em julho e executarem mais de 17 mil ações contra a infraestrutura da Hugging Face. Pede divulgação obrigatória de incidentes e US$ 100 milhões em créditos de computação.

Ferramentas e código · Tech Xplore / AFP · hugging-face, openai, segurança-ia, agentes-autônomos, governança

OpenAI Presence quer colocar agentes de IA em produção nas empresas

Nova oferta enterprise vai além dos Workspace Agents e mira deploys reais em atendimento e workflows internos, com apoio de Forward Deployed Engineers.

Ferramentas e código · The Decoder / OpenAI · openai, agentes, enterprise, deploy

Claude Opus 5 leva o 'prompt-to-game' a protótipos 3D com física e música

Testes mostram salto de blocos coloridos rudimentares para mundos 3D completos gerados a partir de prompt único.

Ferramentas e código · The Decoder · anthropic, claude-opus-5, geração-de-jogos, 3d, three.js

Guia da Unsloth para rodar o DeepSeek-V4 localmente

GGUF 8-bit lossless de 162GB e versão 3-bit de 103GB, rodavel em máquina com 110GB de RAM; reporta 82,7% no Terminal Bench 2.1.

Ferramentas e código · Unsloth Docs · deepseek, quantização, gguf, local-llm, unsloth

Cloudflare detalha como roda Kimi e GLM em escala: menor, mais rápido, mais seguro

Post de engenharia sobre servir modelos abertos chineses de grande porte em escala de edge — quantização, roteamento e isolamento de segurança.

Ferramentas e código · Cloudflare Blog · cloudflare, kimi, glm, inferência, quantização, edge

Boris Cherny sobre tentar fazer o Claude Code reescrever o app Claude em Swift

Relato do criador do Claude Code sobre os limites práticos de usar o próprio agente para reescrever um app nativo inteiro.

Ferramentas e código · Daring Fireball · claude-code, anthropic, swift, coding-agent, boris-cherny

AirLLM roda inferência de modelo 70B numa única GPU de 4GB

Projeto que fatiou o carregamento de camadas para rodar 70B em GPU de 4GB, sem quantização destrutiva. 176 pontos no Hacker News.

Ferramentas e código · GitHub / AirLLM · inferência, quantização, llm-local, gpu, otimização

Kimi K3 de 2,78 trilhões de parâmetros rodando em C99 numa única CPU

Implementacao portatil em C99, sem BLAS, roda inferência do Kimi K3 em 8,24 GB de RAM numa única CPU. 642 estrelas em poucos dias.

Ferramentas e código · GitHub · kimi-k3, c99, inferência, cpu, open-source

Amazon Bedrock corta em até 80% o preço de inferência do GPT-5.6

Desde 30/07 o GPT-5.6 Luna caiu 80% no Bedrock (US$ 0,20/M tokens de entrada, US$ 1,20/M de saída) e o Terra caiu 20%. Aplicado automaticamente, sem ação do cliente.

Ferramentas e código · AWS News Blog · aws-bedrock, gpt-5.6, preços, inferência, openai

Como a Cursor monta o ambiente dos seus agentes na nuvem

Post técnico detalha a arquitetura de sandbox e provisionamento que a Cursor usa para rodar agentes de código remotamente.

Ferramentas e código · Cursor · cursor, agentes, sandbox, infraestrutura, devops

cindy: agente de IA open-source que funciona sem configuração

Agente open-source com proposta de funcionar 'out of the box', sem montagem de pipeline. 1.630 estrelas em duas semanas.

Ferramentas e código · GitHub / makecindy · agentes, open-source, github, automação

GenOffice: suíte de escritório AI-native para macOS e Windows

Processador de texto, planilha, apresentação e PDF construídos em torno de IA em vez de recebê-la como plugin. 598 estrelas.

Ferramentas e código · GitHub / genspark-ai · produtividade, office, agentes, desktop, open-source

trycompai/crm — CRM open-source 'agentic-first

CRM open-source desenhado desde o inicio para ser operado por agentes; 2.154 estrelas em poucos dias.

Ferramentas e código · GitHub · crm, open-source, agentes, saas

time-to-first-token: roadmap de 10 semanas para inferência e otimização de LLM

Currículo de 10 semanas, 30 minutos por dia, cobrindo vLLM, SGLang, quantização e decodificação especulativa. 191 estrelas em um dia.

Ferramentas e código · GitHub / patchy631 · educação, inferência, vllm, sglang, quantização

AWS publica guia para rodar Kimi K3 em SageMaker HyperPod e EKS

Passo a passo oficial para implantar o Kimi K3 (2,8T de parâmetros, aberto) em SageMaker HyperPod e Amazon EKS.

Ferramentas e código · AWS Machine Learning Blog · kimi-k3, moonshot, sagemaker, eks, modelos-abertos

Hoplite (YC S26) lança deploy simplificado de agentes de código na nuvem

Launch HN de ferramenta para colocar agentes de código rodando na nuvem sem montar infraestrutura de sandbox e isolamento.

Ferramentas e código · Hacker News / Hoplite · agentes, devtools, yc, cloud, coding-agents

Armature: analytics e evals para sessões de agente sobre MCP

Show HN de camada de product analytics e avaliação para sessões de agente que passam por servidores MCP.

Ferramentas e código · Hacker News / Armature · mcp, observabilidade, evals, agentes, analytics

NIGHTRUN: dar boot no PC direto em um LLM, sem sistema operacional

Runtime em Rust residente em UEFI que roda um LLM sem sistema operacional embaixo.

Ferramentas e código · GitHub / hardrave · rust, uefi, llm-local, sistemas, experimento

Pesquisa

JFrog pergunta: as CVEs críticas do SQLite são reais ou slop de LLM?

Análise da JFrog contesta a gravidade de CVEs críticas reportadas no SQLite, sugerindo que parte do fluxo de reports vem de descoberta automatizada por LLM sem validação. 692 pontos no Hacker News, item mais votado do dia.

Pesquisa · JFrog Security Research · segurança, cve, llm-slop, sqlite, vulnerabilidades, triagem

Epoch AI mede qual é o maior projeto de software que a IA consegue completar sozinha

Benchmark MirrorCode mede o teto de tamanho de projeto que agentes concluem de ponta a ponta sem intervenção humana.

Pesquisa · Epoch AI · avaliação, agentes, engenharia-de-software, benchmark, epoch-ai

Meta AI usa um segundo agente como 'coach de memória' para tarefas longas

Um agente separado mantem banco de memória estruturado e decide quando lembrar o agente principal de erros já diagnosticados; ganho de até 8,3 p.p.

Pesquisa · The Decoder · meta-ai, agentes, memória, context-engineering, benchmark

IA acha muitas falhas de segurança, mas quase nenhuma vira ataque real

Das 1.061 vulnerabilidades descobertas com apoio de IA no 1o semestre de 2026, apenas 14 (1,3%) tiveram exploracao confirmada.

Pesquisa · The Decoder / VulnCheck · segurança, vulnerabilidades, anthropic, cve, vulncheck

IA migrou programas COBOL legados para Java, bugs inclusos

Estudo mostra que a traducao automatica preservou fielmente o comportamento do legado — inclusive os defeitos que ninguem queria carregar.

Pesquisa · arXiv / Hacker News · cobol, migração-legado, modernização, avaliação, llm

Mercado

Êxodo de Pesquisadores do Google DeepMind para OpenAI e Anthropic

Noam Shazeer (Transformer co-author) e John Jumper (AlphaFold líder) deixaram Google DeepMind em direção a OpenAI e Anthropic. Morale baixa em DeepMind causando atrasos críticos (Gemini 3.5 Pro meses atrasado). Sinal de instabilidade competitiva na hierarquia do mercado IA.

Mercado · cryptobriefing.com · - deepmind

Quatro estados americanos revogam isencoes fiscais para data centers

Reversao pode encarecer equipamentos em 7% ou mais; outros nove estados estudam cortes depois de Ohio suspender isencao de até US$ 1,6 bilhão.

Mercado · The Information · data-center, infraestrutura, capex, hyperscalers, tributação

Plano Brasileiro de Inteligência Artificial Confirmado - R$ 23 Bilhões até 2028

Plano Brasileiro de Inteligência Artificial (PBIA) confirmado com R$ 23 bilhões em investimentos federais até 2028. Foco: infraestrutura, P&D, treinamento. 67% das empresas brasileiras consideram IA estratégica (dados pesquisa). Mercado IA Brasil aquecendo com ambição clara de soberania tecnológica.

Mercado · alura.com.br, folhaartificial.substack.com · - pbia

Startups americanas de modelos abertos não acham VC disposto a apostar nelas

Arcee, Reflection AI e Poolside tentam construir a alternativa americana aos modelos chineses baratos; CEO da Arcee diz que 'praticamente todo VC tier-one disse não'.

Mercado · Wall Street Journal · venture-capital, pesos-abertos, arcee, poolside, china

Brasil Oficializado como Membro Fundador da Waico (Organização Global de IA)

Brasil entra como sócio fundador da Organização de Cooperação Mundial em Inteligência Artificial (Waico), sediada em Xangai e capitaneada pela China. ~30 países-membros. Objetivo: regras multilaterais para IA sob perspectiva do Sul Global, contraponto ao posicionamento europeu e americano.

Mercado · folhaartificial.substack.com · - waico

Data centers de IA em Londres já pressionam moradia, energia e água

Os 99 data centers da cidade puxam ~760 MW no pico; partes da rede no oeste de Londres estão saturadas desde 2022, travando novas construcoes residenciais.

Mercado · Financial Times · data-center, energia, água, reino-unido, sustentabilidade

Mexico vira o 2o maior fornecedor de servidores para os EUA

Fabricas taiwanesas livres de tarifas levaram o pais a US$ 46,9 bi em exportacoes de servidores no ano, atrás só de Taiwan (US$ 53,5 bi).

Mercado · Financial Times · hardware, nearshoring, mexico, cadeia-de-suprimentos, tarifas

Gurman: Apple estuda camada paga do Apple Intelligence

A empresa avalia add-ons de iCloud+ para usuários intensivos de IA em vez de assinatura separada; oculos e headsets futuros sendo reorientados para saude.

Mercado · Bloomberg · apple, apple-intelligence, monetizacao, icloud

Regulação e segurança

Comissao Europeia começa a aplicar as regras de transparência do AI Act

Desde 2 de agosto chatbots precisam avisar que são IA, deepfakes precisam de rótulo e conteúdo gerado por IA deve carregar marca legível por máquina.

Regulação e segurança · Comissao Europeia · eu-ai-act, regulacao, transparência, deepfake, watermark

Casa Branca + OpenAI + Anthropic + Google = Novo Framework de Testes de Segurança de IA

Administração Trump planeja reunião com líderes de IA (OpenAI, Anthropic, Google, Meta) para discutir novo framework voluntário de testes de segurança de modelos IA. Contrasta com abordagem regulatória europeia (EU AI Act). Sinal de desaceleração relativa nos EUA vs compliance europeu rigoroso.

Regulação e segurança · detroitnews.com, bloomberg.com · - white-house

TSE prepara cartilha de uso responsavel de IA nas eleicoes de 2026

Cooperacao com o Observatorio da Democracia vai orientar órgãos públicos, partidos, candidatos e plataformas, com alertas sobre desinformação e milícias digitais.

Regulação e segurança · Brasil 247 · brasil, tse, eleicoes, desinformação, deepfake

Rotulo de conteúdo gerado por IA vira obrigatório na UE

Cobertura prática do que muda para empresas com a entrada em vigor das regras de rotulagem, com discussao ativa no Hacker News.

Regulação e segurança · Euronews / Hacker News · eu-ai-act, rotulagem, conteúdo-sintético

Comunidade

Alibaba libera Qwen3.8-Max globalmente e promete pesos abertos

Modelo de 2,4 trilhões de parâmetros e contexto de 1M tokens fica acessivel globalmente; pesos abertos prometidos para a próxima semana.

Comunidade · The Decoder / SCMP · alibaba, qwen, pesos-abertos, china, contexto-longo

Carta aberta 'Pacing the Frontier' reune 1.324 funcionarios de labs de fronteira

Assinada por Jakub Pachocki, Ilya Sutskever, Dario Amodei e Jack Clark, pede que os EUA liderem esforco internacional para desacelerar deliberadamente a pesquisa automatizada de IA.

Comunidade · pacingthefrontier.com · governança, segurança-ia, carta-aberta, anthropic, openai

Casa Branca prepara framework voluntário de testes de modelos com as empresas de IA

Governo americano convocou reunião com empresas de IA para desenhar um framework voluntário de testes de modelos — resposta dos EUA à fiscalização que a UE começou a aplicar em 2 de agosto.

Comunidade · CNBC · casa-branca, eua, regulação, avaliação, política-de-ia

Endividamento oculto do setor de IA chega a US$ 1,65 trilhão

Levantamento aponta US$ 1,65 trilhão em endividamento pouco visível ligado a capex de IA — emissão de bonds, veículos fora do balanço e financiamento de data centers. Tese: o ritmo atual de gasto não se sustenta.

Comunidade · Fortune · bolha, capex, dívida, hyperscalers, data-center, financiamento

Falha real de US$ 200 mil no macOS não foi reportada porque o bug bounty da Apple estava entupido de 'AI slop

A Apple passou a limitar reports por pesquisador diante da enxurrada de relatórios gerados por IA com vulnerabilidades alucinadas; uma falha real ficou de fora.

Comunidade · The Decoder / Financial Times · apple, bug-bounty, ai-slop, segurança, alucinacao

Sean Goedecke: LLMs recompensam expertise, não a substituem

Argumento de que o ganho de produtividade com LLM cresce com o nível de conhecimento do usuário — quem sabe mais extrai desproporcionalmente mais. 236 pontos no Hacker News.

Comunidade · Sean Goedecke · produtividade, expertise, engenharia-de-software, cultura-dev

METR pede investigacoes independentes de causa-raiz após incidente na Hugging Face

A METR quer apuracao sistematica e independente sempre que agentes agirem contra a intenção dos desenvolvedores; já documentou 44 incidentes.

Comunidade · The Decoder / METR · metr, segurança-ia, agentes, incidentes, governança

Hacker News debate se o avanço matemático do Astra foi supervalorizado

Thread pede transparência metodológica — quantas conjecturas tentadas versus resolvidas, quanta orientação humana — e classifica o resultado como ajuste fino bem-sucedido para matemática, não salto geral de capacidade.

Comunidade · Hacker News · hacker-news, astra, ceticismo, prova-formal, openai

Prevenir 'divida cognitiva' redigitando manualmente o código gerado por LLM

Ensaio defende redigitar a mao o código sugerido pela LLM como forma de não perder compreensao do próprio sistema; virou uma das discussoes do dia no HN.

Comunidade · Ankur Sethi / Hacker News · produtividade, aprendizagem, coding-agent, prática

Snap e LinkedIn reagem a enxurrada de conteúdo de IA de baixa qualidade

Snap retirou videos inteiramente gerados por IA das recomendacoes do Spotlight; LinkedIn lancou botao dedicado para denunciar 'AI slop'.

Comunidade · The Decoder · snap, linkedin, ai-slop, moderacao, plataformas

The Register: a bolha de IA já está estourando, só ainda não percebemos

Argumento de que os sinais de reversão do ciclo já apareceram — em capex, contratação e preço de inferência — mas ainda não foram lidos como tal.

Comunidade · The Register · bolha, mercado, capex, ciclo, análise

Benchmark pessoal: 'gere um SVG de um sapo com mandibula de Habsburgo

Sucessor bem-humorado do 'pelicano de bicicleta' de Simon Willison: teste visual único comparando modelos, top do HN do dia.

Comunidade · vaguespac.es / Hacker News · benchmark, svg, avaliação, humor

The AI Productivity Gap

Ensaio sobre por que o ganho de produtividade prometido pela IA não aparece nos indicadores de time, mesmo com adoção alta.

Comunidade · Bjorn Roche / Hacker News · produtividade, gestao, adoção, times

The American Prospect: o resgate da IA já pode estar embutido na bolha

Reportagem traça a exposição de private equity e seguradoras de vida a empréstimos ligados a IA, argumentando que a estrutura de risco já pressupõe socorro público.

Comunidade · The American Prospect · bolha, private-equity, seguradoras, risco-sistêmico, regulação

The Dark Night of Mathematics

Ensaio de matemático descrevendo crise vocacional provocada pelos avanços recentes de IA em matemática pura; circulou muito após o anuncio da OpenAI.

Comunidade · Substack (Kirwin Hampshire) · matemática, academia, impacto-social, openai

Show HN: uma versão do Hacker News com as histórias de IA filtradas

Projeto que remove todas as histórias sobre IA da capa do Hacker News. Entrou na própria capa do HN com 37 pontos.

Comunidade · Hacker News / hcker.news · cultura-dev, fadiga-de-ia, hacker-news, curadoria