A Z.ai confirmou que o modelo anônimo que dominou o OpenRouter na semana passada era o GLM-5.3-Flash: 320B de parâmetros totais com 18B ativos, nativamente multimodal, janela de 1M tokens e pesos aber...
A Zhipu/Z.ai afirma que todo o pipeline do GLM-5.3-Flash — pré-treinamento, pós-treinamento e inferência — rodou em um cluster de cerca de 100 mil chips de IA de fabricação chinesa. O modelo se tornou...
A OpenAI abriu prévia do Ultrafast, um novo nível de serviço que roda o GPT-5.6 Sol até 14 vezes mais rápido que o processamento padrão. O movimento converte latência em produto pago e é o complemento...
Repositório com quantizações dinâmicas do Qwen3.8-Flash-Next em GGUF, incluindo UD-IQ1_S (~72,5 GB) e UD-Q2_K_XL (~78,9 GB). São os artefatos que a comunidade de execução local está usando para rodar ...
Modelos · Hugging Face · qwen, gguf, quantizacao, local-llm, unsloth
A Architect Labs afirma que dois arquitetos humanos, apoiados por sistemas de IA, desenvolveram e verificaram o design do processador 'Redwood' em cerca de duas semanas — processo que normalmente exig...
Johann Rehberger demonstra execução de código arbitrário a partir de um pedido banal de resumo de site, com taxa de sucesso de 60% a 80% — contra os 0,00% de uma avaliação de terceiros encomendada pel...
Ferramentas e código · Embrace The Red (Johann Rehberger) · seguranca, prompt-injection, claude-code, agentes
O produto combina harness de agente, orquestrador e escolha entre modelos locais Qwen 3.8 e PPLX, ambos em 27B de parâmetros, com setup de inferência local em um clique. O Qwen 3.8 27B pós-treinado pe...
A Anthropic passou a permitir que empresas executem sessões de Claude Code em seu próprio compute, em vez da infraestrutura gerenciada. É um movimento direto sobre a objeção de compliance e soberania ...
Ferramentas e código · Anthropic · claude-code, self-hosted, enterprise, compliance
Desde 26 de agosto o Claude para desktop (macOS, Windows e Linux) traz um navegador Chromium embutido no Cowork, aberto em painel lateral. O Claude navega, lê páginas, clica, preenche e submete formul...
Ferramentas e código · The New Stack · anthropic, claude, cowork, browser, agentes
A OpenAI liberou ao ChatGPT a capacidade de autenticar-se em sites em nome do usuário para completar tarefas fim a fim. É a fronteira mais delicada da automação agêntica: credenciais e sessões vivas p...
A ElevenLabs publicou um servidor MCP hospedado que conecta sua plataforma de agentes de voz e chat diretamente ao Claude. Elimina a etapa de self-hosting que trava a adoção de MCP fora de times de en...
Ferramentas e código · Techgenyz · elevenlabs, mcp, voz, integracao
Projeto open source apresentado no Show HN que interpõe uma camada de política entre o agente e as ferramentas, validando e bloqueando chamadas de MCP antes da execução. Responde diretamente à lacuna ...
Ferramenta criada por um desenvolvedor depois de esgotar a quota do Claude em dez minutos, com o objetivo de mostrar exatamente para onde os tokens foram. Levantou 62 pontos e 48 comentários, com disc...
Projeto open source que se posiciona como alternativa aberta ao OpenRouter, com a proposta adicional de usar os dados de uso do roteamento para treinar um modelo melhor. Reuniu 183 pontos e 36 comentá...
O Expert Intelligence permite trazer ebooks elegíveis do Google Play para dentro dos Gemini Notebooks como fonte de contexto. O Google indicou que assinaturas de terceiros e rollout mais amplo para o ...
Ferramentas e código · The Verge · google, gemini, notebooklm, contexto, licenciamento
Coleção gratuita de notebooks que ensina RAG, agentes e avaliação sem depender de LangChain, LlamaIndex ou frameworks equivalentes — tudo rodando no Google Colab. Reuniu 111 pontos e 14 comentários. F...
Navegador headless escrito em Rust, posicionado como leve, rápido e de alta compatibilidade especificamente para uso por agentes de IA. Passou de 1.300 estrelas em pouco mais de duas semanas. Sinaliza...
O estudo 'Demystifying Agent Skills', sobre 8.135 registros de trials, mostra que skills funcionam sobretudo como âncoras procedurais que estabilizam a execução (65,7% dos casos), e não como injeção d...
Working paper consolida respostas de quase 6.000 CEOs, CFOs e gerentes financeiros em quatro países, coletadas por equipes do Fed de Atlanta, Bank of England, Bundesbank e Macquarie. Mais de 90% relat...
O paper formaliza a distinção entre o que induz uma ação no agente e o que a autoriza a executar, argumentando que colapsar as duas coisas é a raiz estrutural da prompt injection via saída de ferramen...
Reportagem traz demonstração e comentários de um pesquisador da Anthropic sobre sistemas capazes de melhorar a si próprios. É a categoria de resultado que mais mexe com projeções de timeline e com o d...
Pesquisa · TechCrunch · anthropic, self-improvement, pesquisa, fronteira
O trabalho argumenta que garantias de segurança verificadas passo a passo não se preservam quando os passos são compostos em loops longos de agente — o risco acumula em vez de decair. É um resultado i...
Novo benchmark que mede agentes de IA em workflows de pesquisa científica executados em terminal, em vez das tarefas sintéticas usuais. A proposta responde a uma crítica recorrente da comunidade: benc...
Novo estudo indica viés sistemático de generosidade quando modelos de linguagem corrigem redações comparados a avaliadores humanos. O achado é operacionalmente sério para instituições que já adotaram ...
Proposta de expor a intenção do agente como uma ferramenta invocável, de modo que o desalinhamento apareça no traço de execução em vez de ficar implícito no raciocínio interno. Chega no mesmo ciclo em...
Demonstra que é possível extrair skills proprietárias de um agente apenas interagindo com ele por tarefas, sem acesso a pesos ou prompts. Para quem constrói produto em cima de bibliotecas de skills cu...
O LAION-BVD reúne 1,3 bilhão de URLs de vídeo coletadas do CommonCrawl, das quais 80 milhões de vídeos (10 milhões de horas) foram efetivamente baixados — mais de dez vezes qualquer dataset vídeo-text...
Paper propõe destilar as trajetórias de execução de um agente em uma base de skills persistente e reutilizável, em vez de deixar a experiência morrer no fim da sessão. Trata o problema que a comunidad...
Estudo de campo numa empresa grande medindo não se as pessoas usam IA generativa, mas com que sofisticação usam. O achado relevante é a dispersão: o mesmo acesso à mesma ferramenta produz resultados m...
Trabalho mostrando que a curadoria cuidadosa de um conjunto pequeno de trajetórias supera o treino com volume grande e ruidoso em tarefas de engenharia de software. É mais um resultado na direção de q...
Estudo empírico testa se deixar o usuário final redigir as próprias políticas de permissão reduz de fato o 'agent overreach'. O tema é central agora que produtos como o ChatGPT passaram a autenticar-s...
Trabalho mostrando que modelos de linguagem conseguem projetar algoritmos de pesquisa operacional com desempenho próximo do ótimo conhecido, sem serem explicitamente treinados para isso. Soma-se à lin...
O grupo documenta o treino de um modelo de 1,5B de parâmetros numa única RTX 5090 com orçamento total de US$ 5.090, incluindo o hardware. É um exercício deliberado de acessibilidade — o subtítulo é li...
Receita de US$ 96,2 bilhões no trimestre, alta de 106% na comparação anual e acima do consenso de US$ 92,27 bilhões, com lucro ajustado por ação de US$ 2,22. O guidance de US$ 106-110 bilhões superou ...
A Anthropic estuda permitir que acionistas existentes vendam parte de suas participações durante a oferta, criando um componente secundário incomum em IPOs recentes de tecnologia. A avaliação da empre...
Gimenes entra na lista pela TybyrIA: um modelo pequeno e especializado, treinado a partir de 2 mil comentários classificados manualmente, que escalou a análise e produziu o relatório 'Anatomia de uma ...
Mercado · TIME · brasil, time100, direitos-digitais, slm, dataset-aberto
A Alibaba Cloud lançou sua primeira região na América do Sul, com dois data centers no Brasil e planos de oferecer serviços corporativos de IA agêntica localmente. É a segunda região da empresa na Amé...
Mercado · South China Morning Post · alibaba, brasil, data-center, nuvem, soberania
A Nvidia encerrou a AI Compute Partnership, programa lançado em julho no qual dava respaldo de crédito a provedores menores de nuvem em troca de 50% da receita acima de um piso horário. Funcionários a...
A Andreessen Horowitz criou o Machine Age Fund, de US$ 1,1 bilhao, dedicado a camada fisica da IA: chips, memoria, redes, data centers, refrigeracao, robotica e dispositivos de bor...
Reportagem mapeia a corrida por empresas de modelos de pesos abertos como alvo prioritário de M&A no Vale. A lógica: distribuição e comunidade já construídas, mais um caminho de contorno para clientes...
A SK Hynix deu inicio a construcao de uma planta de empacotamento de memoria HBM de mais de US$ 4 bilhoes em 133,5 acres no Purdue Research Park, sua primeira base de HBM nos EUA. ...
A Monashees, em parceria com Google e B3, lançou um hub para startups brasileiras de IA com modelos de negócio desenhados para escala global desde o início. Sinaliza a tentativa de corrigir o padrão h...
Mercado · Bloomberg Línea · brasil, monashees, google, b3, startups, venture-capital
Primeiro veículo da Andreessen Horowitz dedicado exclusivamente a infraestrutura física: chips, memória, redes, armazenamento, data centers, robótica e até eletrodomésticos. A firma argumenta que toda...
As duas empresas planejam investir mais de US$ 31 bilhões no Japão até 2032 para expandir produção de memória flash e desenvolver semicondutores de próxima geração, incluindo nova infraestrutura na pl...
O Gemini passou a oferecer simulados gratuitos do ENEM com correção e explicações, movimento de aquisição de usuários via educação em um dos maiores mercados do Google. Para escolas e cursinhos, muda ...
Mercado · O Globo · google, gemini, enem, educacao, brasil
Segundo dados da DataEye citados pelo FT, 89 dos 100 dramas animados mais populares do Douyin em maio foram producoes de IA. Os lancamentos saltaram de 655 novos titulos de IA em a...
A Instinct, assistente de IA voltada ao consumidor e ainda em beta privado, fechou a maior rodada divulgada do dia: US$ 250 milhões em Série B a uma avaliação de US$ 2,5 bilhões. O caso ilustra a disp...
A OpenAI anunciou o OpenAI x MHESI AI Accelerator, sua primeira parceria publico-privada com o governo tailandes: programa de 8 semanas com a NIA, a Universidade Mahidol e a Techsa...
A juíza distrital Rita Lin decidiu que a designação da Anthropic como 'risco de cadeia de suprimentos' pelo Departamento de Defesa foi retaliação inconstitucional, violando a Primeira e a Quinta Emend...
Um juiz federal decidiu que a decisão do governo Trump de colocar a Anthropic em lista de restrição para contratos federais foi ilegal. A disputa vinha de tensões entre a empresa e a administração sob...
Regulação e segurança · The New York Times · anthropic, regulacao, eua, governo
Carta aberta conjunta assinada por mais de cem empresas de tecnologia e segurança alerta que hospitais, sistemas de água e infraestrutura de internet estão sob risco crescente à medida que modelos fic...
Regulação e segurança · Tech Insider · ciberseguranca, coalizao, infraestrutura-critica, politica
Uma das opções em discussão estenderia as tarifas para além dos chips discretos, alcançando produtos que os contêm — laptops, consoles e os servidores que abastecem data centers de IA. O secretário de...
Regulação e segurança · Tech Startups / The Guardian · tarifas, semicondutores, eua, politica-industrial, custos
Proposta de mudança de regra permitiria que data centers evitassem o licenciamento de emissões atmosféricas que hoje torna pública sua poluição. O tema conecta a expansão física da IA com custo ambien...
Regulação e segurança · The Verge · data-center, ambiental, epa, energia, regulacao
A Meta finalizou, em meio ao julgamento, acordo de US$ 17 bilhoes com 47 procuradores-gerais estaduais sobre saude mental de jovens, pago anualmente ao longo de 10 anos. O pacote i...
A OpenAI inaugurou em 27 de agosto seu primeiro escritório nas Américas fora dos EUA. O Brasil é um dos três maiores mercados globais da empresa em usuários ativos, com 215 milhões de mensagens diária...
Comunidade · OpenAI · openai, brasil, sao-paulo, mercado
A OpenAI publicou os primeiros benchmarks do Jalapeño, seu chip de inferência desenvolvido com a Broadcom, alegando 1,5x a 1,9x mais throughput de pico e latência ponta-a-ponta 1,7x a 3,6x menor que s...
Comunidade · SemiAnalysis · openai, broadcom, chips, inferencia, nvidia
Reportagem mostra um número crescente de americanos cujas conversas privadas com chatbots foram tornadas públicas em tribunal. À medida que as pessoas recorrem à IA para trabalho, saúde e companhia, o...
Comunidade · The Washington Post · privacidade, regulacao, chatgpt, judiciario
Willison converge com Rehberger: a única forma segura de rodar agentes expostos a conteúdo adversarial é dentro de container, VM ou sandbox de sistema operacional, com egress de rede restrito, monitor...
Comunidade · Simon Willison's Weblog · seguranca, agentes, sandbox, simon-willison
Novos dados mostram o DeepMind perdendo pesquisadores sêniores para laboratórios rivais e startups, movimento acelerado pela saída de Jeff Dean (27 anos de casa), Sanjay Ghemawat, Oriol Vinyals e Quoc...
Comunidade · Fortune · google-deepmind, talento, mercado-de-trabalho
Willison argumenta que a assimetria da divulgação responsável mudou: com LLMs capazes de varrer código, a menção pública de que existe uma falha em determinado componente já reduz drasticamente o cust...
Comunidade · Simon Willison · seguranca, llm, exploit, willison, divulgacao
Texto de mantenedor que voltou a circular com força (176 pontos, 121 comentários) descrevendo o custo humano de revisar pull requests e relatórios de bug gerados por IA e enviados em massa por candida...
O State of Development 2026, com mais de 550 engenheiros e líderes, aponta alta de 71% ano a ano no uso diário de agentes. Apesar da adoção, os três gargalos citados continuam sendo gerenciamento de e...
Comunidade · Temporal · agentes, adocao, engenharia, confiabilidade, pesquisa-de-mercado
A comunidade rodou cerca de 60 strings de teste (emoji, coreano, latim full-width, notação matemática, cirílico) contra o endpoint anônimo e concluiu que o tokenizer batia com a família GLM — confirma...
Comunidade · r/LocalLLaMA · localllama, tokenizer, glm, comunidade, investigacao
A Anthropic abriu a Claude Academy, plataforma de cursos gratuitos de IA cobrindo do nível iniciante ao avançado. O lançamento acompanha a oferta de 10 mil assentos para cientistas e a Claude Team par...
Comunidade · Anthropic · anthropic, educacao, cursos, formacao
Ensaio muito discutido no HN sobre a prática difundida de rodar agentes de código com privilégios totais na máquina do desenvolvedor, sem isolamento nem restrição de egress. O argumento é que a conven...
A Anthropic anunciou 10 mil assentos de assinatura do Claude para cientistas no mundo todo, gratuitos ou com desconto por um ano, via um novo plano Claude Team voltado à pesquisa. O anúncio é compleme...
Comunidade · Anthropic · anthropic, ciencia, pesquisa, acesso
Issue reportando divisão por zero no FFmpeg descoberta por um fuzzer construído por vibe coding. O caso reacendeu no Hacker News (176 pontos, 136 comentários) o debate sobre a relação entre mantenedor...
Análise sustentando que a fase de preços subsidiados e quota generosa nos produtos de IA está terminando, e que isso força uma reprecificação das expectativas de adoção. Gerou 83 pontos e 76 comentári...
Merchant argumenta que a indústria subestima a amplitude da oposição local à construção de data centers de IA, especialmente em torno de consumo de água, energia e tarifas elétricas repassadas ao cons...
Comunidade · Blood in the Machine · data-centers, energia, agua, politica, infraestrutura
A nova versão do LibreOffice foi lançada com marketing deliberadamente contrário à corrente: processamento local, sem nenhum recurso de IA. O posicionamento é um sinal de mercado — existe um segmento ...
Comunidade · The Register · libreoffice, open-source, contraponto, privacidade