OpenAI lancou o GPT-5.6-Cyber, primeiro modelo treinado explicitamente para pesquisa de vulnerabilidades e cadeias de exploit, com recusas reduzidas e 95% de conclusao em tarefas avancadas de ciberseg
O DeepSeek V4 Pro 0813 subiu no OpenRouter e virou o item de IA mais votado do dia no Hacker News (671 pontos), superando o anúncio do Grok 4.6. A cadência de releases do laboratório chinês e a relação custo-desempenho seguem sendo o principal argumento da comunidade.
Os pesos do Qwen3.8 na configuração 2.4T-A95B (mixture-of-experts com ~2,4 trilhões de parâmetros totais e ~95 bilhões ativos) foram publicados no ModelScope. É o terceiro lançamento de peso do dia e reforça a liderança chinesa em modelos de pesos abertos na faixa de fronteira.
A Liquid AI publicou o LFM2.5-VL-3B, modelo de visão-linguagem de 3 bilhões de parâmetros voltado a dispositivos de borda, priorizando velocidade e footprint reduzido.
O programa Daybreak passa a operar em dois niveis, Blue (defensivo) e Red (ofensivo), com atestados legais, monitoramento continuo e exigencia de chaves de seguranca em hardware a partir de 1o de sete
A xAI abriu o beta de um Grok agêntico posicionado como "teammate": em vez de conversar, o usuário atribui tarefas e o agente executa de forma assíncrona. É a mesma direção de produto que Anthropic e OpenAI vêm seguindo — do chat para a delegação.
O Google apresentou a linha Pixel 11 com Tensor G6 em 2nm, o Pixel Watch 5, um rival do AirTag e diversos recursos Gemini rodando no dispositivo. O Watch 5 chega sem os recursos Gemini prometidos no dia um.
Alguém está rodando varreduras de vulnerabilidade em escala forjando o user-agent de crawlers de IA legítimos, como o ClaudeBot. O caso expõe a fragilidade de confiar em user-agent para decidir quem pode acessar um site.
Guia oficial da NVIDIA para rodar o modelo aberto da Meta em GPU unica, mostrando a corrida das plataformas para transformar o Glimmer no padrao de agentes locais
Ferramentas e código · NVIDIA Technical Blog · nvidia, muse-glimmer, agentes-locais, meta
Uma fonte que remapeia glifos faz a página continuar legível para humanos e virar texto sem sentido para quem extrai o HTML — uma defesa de baixo custo contra scrapers de IA que não depende de bloqueio por robots.txt.
O Mojo atingiu a versão 1.0 com API estável e compatibilidade retroativa, encerrando três anos de quebras a cada release. A cobertura crítica do The Register lembra que o marco vem duas semanas após a compra da Modular pela Qualcomm e com o compilador ainda fechado.
O Hax é um agente de código de terminal escrito em C, com proposta declaradamente minimalista — sem runtime pesado, sem dependências. Reação de contraponto à sofisticação crescente dos agentes de código, com boa repercussão no HN.
Preprint demonstra que blocos de raciocínio criptografados devolvidos por APIs de OpenAI, Anthropic e Google podem ser reproduzidos em modelos irmãos mais fracos e revelados em texto puro. A análise de 6.708 trajetórias públicas de agentes expôs 62 chaves de API, 33 senhas e 7 chaves privadas de usuários reais.
O medalhista Fields Tim Gowers publicou analise sobre onde os LLMs realmente performam em matematica e onde ainda falham, separando manipulacao simbolica de construcao de prova genuina
Pesquisa · Blog de Timothy Gowers (via Hacker News) · matematica, avaliacao, raciocinio, gowers
O AllenAI passou a permitir exportar embeddings customizados do OlmoEarth Studio para análise externa, abrindo o modelo de fundação geoespacial para pipelines próprios de pesquisa.
Nvidia fechou MOUs com Apollo, Blackstone, BlackRock, Brookfield, Goldman Sachs e KKR para montar plataformas de credito capazes de direcionar mais de US$ 500 bilhoes a infraestrutura de IA de seus cl
Anthropic, Macquarie Asset Management e o fundo soberano de Singapura GIC criaram a Theseus Infrastructure para desenvolver e arrendar data centers dedicados ao laboratorio em contratos de longo prazo
O Google afirma que o Gemini alcancou 1 bilhao de usuarios mais rapido que qualquer outro produto da casa, resultado sobretudo da distribuicao embutida em Android, Search e Workspace
Mercado · Ars Technica · google, gemini, adocao, distribuicao
A Cognition, criadora do Devin, já estaria negociando nova rodada a US$ 40 bilhões pouco tempo depois da anterior. Junto com Lovable (US$ 13,3 bi) e Blacksmith (10x em menos de um ano), desenha um dia de reprecificação agressiva em todo o setor de IA para código.
O regulador chinês NDRC bloqueou a aquisição da Manus pela Meta por US$ 2 bilhões e a empresa volta a operar de forma independente. Usuários têm até 23/08 para fazer backup — dados gerados a partir de dezembro de 2025 serão apagados.
A Lovable confirmou valuation de US$ 13,3 bilhões e captação adicional de US$ 400 milhões, consolidando-se como o caso europeu mais valioso de geração de aplicações por IA.
A Thrive Holdings, com apoio da OpenAI, levantou US$ 2 bilhões para aplicar IA em empresas tradicionais — modelo de roll-up que compra negócios e os reconstrói com IA. No mesmo dia, a Blacksmith (teste de código com IA) teve valuation multiplicado por quase 10x, para US$ 550 milhões.
Anthropic passou a embutir marca d'agua legivel por maquina no texto gerado pelo Claude, detectavel mesmo apos copiar e colar, alem de metadados C2PA nas imagens
Um dia depois do anúncio das marcas d'água invisíveis no texto do Claude, o desdobramento é a reação de usuários que as veem como delação de uso de IA em trabalhos e tarefas escolares. O caso vira o teste prático de que "transparência de IA" tem custo de adoção.
Reportagem do 404 Media revelou que conteúdo da Twitch vem sendo usado há anos para treinar modelos da Amazon; a plataforma agora oferece uma configuração de opt-out — mas o padrão continua sendo o consentimento presumido. Ars Technica e The Verge confirmaram e detalharam o caminho da opção.
A Comissao Europeia detalhou 11 funcoes do Android que assistentes rivais como ChatGPT e Claude poderao acessar, com prazo de adequacao ate 2027 e compartilhamento de dados de busca a partir de janeir
Regulação e segurança · The Next Web · ue, dma, google, android, antitruste
Uma entidade de defesa de direitos na Alemanha apresentou queixa-crime contra os óculos de IA da Meta, alegando gravação de terceiros sem consentimento. É a primeira via criminal — e não administrativa — contra wearables de IA na Europa.
A xAI lançou o Grok 4.6, que marcou 61 pontos no Artificial Analysis Intelligence Index e já apareceu no OpenRouter no mesmo dia. Foi o lançamento de modelo com maior repercussão da tarde no Hacker News (348 pts na thread do anúncio, 295 na análise de benchmarks). Junto com o DeepSeek V4 Pro e os pesos do Qwen3.8, fecha um dia de três lançamentos de fronteira em poucas horas.
Comunidade · x-ai · xai, grok, benchmarks, artificial-analysis, openrouter, frontier-models
Ensaio de Florian Herrengt argumentando que a IA comprime a faixa intermediária da engenharia — juniores viram supervisores de agente e seniores ficam mais valiosos, enquanto o meio da carreira perde função. Foi o texto de opinião mais votado do dia (658 pts) e foi citado por Simon Willison.
Comunidade · hackernews · mercado-de-trabalho, engenharia-de-software, juniores, senioridade, hacker-news
Willison endossa a politica de Sophie Alpert para uso de IA em escrita tecnica: toda frase do seu documento e sua responsabilidade, e 'a IA escreveu' nao e desculpa aceitavel em review
Comunidade · Simon Willison's Weblog · escrita, governanca, llm, boas-praticas
Cobertura critica da mudanca de permissionamento do Claude Code, destacando testes da Trajectory Labs que mediram 0% de sucesso em 72 ataques de prompt injection contra o Claude Code e 5,83% no Codex
Comunidade · The Register · claude-code, agentes, autonomia, prompt-injection
LeCun assume papel de investidor num fundo de US$ 100 milhoes ao lado de Oriol Vinyals, mantendo a aposta publica de que world models, e nao LLMs, sao o caminho para agentes que planejam.
Comunidade · Sifted · lecun, world-models, venture-capital, europa
A 404 Media mostrou que uma empresa que comercializava revisao por pares e pesquisa medica com selo '100% escrita humana, nunca IA' produzia conteudo inteiramente gerado por IA
Comunidade · 404 Media · integridade-cientifica, peer-review, deteccao, fraude
Nathan Lambert reflete sobre ter escrito um livro-texto de IA e quanto tempo levaria até um modelo fazer o mesmo melhor — uma leitura honesta sobre autoria e obsolescência a partir de dentro do campo.
Comunidade · interconnects · nathan-lambert, interconnects, escrita, livros-tecnicos, autoria, mit-tech-review