Z.ai lancou o GLM-5.3 mantendo o modelo-base de 743B do GLM-5.2 mas com pos-treinamento ampliado; reivindica o melhor desempenho em codificacao entre modelos de peso aberto e relata capacidades ciberneticas emergentes. Foi o post nº1 do Hacker News (542 pontos).
A chinesa Z.ai apresentou o GLM-5.3, modelo de 743 bilhoes de parametros que obtem os ganhos apenas via pos-treinamento ampliado sobre a base do GLM-5.2.
DeepSeek tornou geralmente disponivel o V4 Pro (build 0813), um MoE de 1,6 trilhao de parametros com 49B ativos, focado em capacidades agenticas e janela de contexto de ate 1 milhao de tokens. Benchmarks ainda aguardam verificacao independente.
Modelos · Tech Times · deepseek, moe, agentes, contexto-longo, china
O Qwen3.8-27B esta em primeiro lugar no trending da Hugging Face com 8.908 likes, e ja tem quantizacoes GGUF da unsloth (763 likes) e versao FP8 publicadas em 13/08.
Modelo aberto de 30B parametros (3B ativos) em arquitetura hibrida Mamba-2 com camadas de especialistas e atencao seletiva, otimizado para agentes always-on de baixa latencia.
Modelo aberto de raciocinio hierarquico com apenas 1 bilhao de parametros reivindica desempenho de fronteira usando exclusivamente dados de pos-treinamento com licenca permitida.
O topo do trending da HF nesta noite mistura texto-imagem e geracao de video: Muse-Glimmer-30B (165,3 mil downloads), MiniMax-H3 (2,0 milhoes) e MiniMax-Music3.
Modelos · huggingface · huggingface, trending, multimodal, video, minimax, meta
Claude for Government Desktop passa a incluir Claude Code e Claude Cowork em beta publico, entregues em ambiente autorizado FedRAMP High, com a Anthropic como parte contratante e faturadora.
O Palmyra X6 e um pos-treino do GLM-5.2 aberto da Z.ai, a US$ 2 / US$ 8 por 1M tokens e custo medio de tarefa de cerca de US$ 0,12. Mas o achado relevante nao e o modelo.
O auto mode virou padrao para usuarios Pro, Max e Team do Claude Code: aprovacoes manuais dao lugar a um classificador que barra acoes irreversiveis. Testes internos indicam 89% de deteccao de comandos perigosos contra 13,6% dos revisores humanos.
Ferramentas e código · AI Weekly · claude-code, anthropic, agentes, seguranca, auto-mode
O harness agentico da DeepSeek — arquitetura em que 'tudo e um plugin' — acumulou mais de 85 mil estrelas em menos de dez dias, um dos lancamentos open-source de crescimento mais rapido do ano.
A OpenAI abriu preview do Ultrafast, tier de API que executa o GPT-5.6 Sol ate 14 vezes mais rapido que o padrao, com ate 750 tokens de saida por segundo.
Ferramenta que transforma qualquer livro tecnico em PDF numa skill do Claude Code, pronta para consulta e uso durante o trabalho, passou de mil estrelas.
Stanford e Arc Institute usaram os modelos de linguagem genomica Evo 1 e Evo 2 para escrever genomas virais completos ineditos; 16 deles produziram bacteriofagos viaveis capazes de infectar e matar E. coli.
Mostra que deixar o agente pesquisar diretamente nos logs brutos de conversa alcanca desempenho comparavel a pipelines elaborados de memoria estruturada.
Relatorio tecnico de um Hierarchical Reasoning Model aberto de 1 bilhao de parametros treinado exclusivamente com dados de pos-treino legalmente permissiveis.
Benchmark que testa se agentes de IA conseguem produzir repositorios de software com verificacao formal completa — nao apenas codigo que passa em testes.
Trabalho com autores do Google que recombina varias rodadas pequenas de pre-treino com scaffolding num modelo unico maior, em vez de um treino monolitico caro.
Segunda versao de um sistema de memoria de longo prazo que consolida historico em segmentos semanticos em vez de chunks fixos, reduzindo custo de recuperacao.
Artigo tecnico detalhando os mecanismos de watermarking estatistico em texto de LLM ganhou tracao no Hacker News (114 pontos), em meio ao crescimento de ferramentas de remocao de marcas de proveniencia.
O FT aponta queda material nos precos dos modelos lideres dos EUA desde meados de julho, enquanto a DeepSeek encareceu o V4 Pro em ate 1.100% em alguns workloads.
A Apple treinou um LLM especifico para o mercado chines com suporte da Alibaba, ganhando controle sobre a IA que roda nos iPhones vendidos no pais, onde o ChatGPT e indisponivel.
Alphabet, Microsoft, Amazon, Nvidia, Oracle e Meta acumularam cerca de US$ 1,5 trilhao em compromissos de compra ligados a computacao, chips, data centers e energia.
A Nvidia anunciou em 10/08 plataformas de financiamento com Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs e KKR para mobilizar mais de US$ 500 bilhoes em infraestrutura de IA.
Nvidia formalizou parcerias com Toyota, Fujitsu, Fanuc, Kioxia e outras para aplicar IA fisica em manufatura e robotica, reforcando a demanda ja confirmada de US$ 1 trilhao ate 2027.
Reportagem detalha como a saida de Demis Hassabis do dia a dia (substituido por Koray Kavukcuoglu) e o atraso do Gemini 3.5 Pro alimentam tensoes internas sobre a direcao do laboratorio.
A maior foundry da China elevou precos de capacidade disputada com utilizacao em 93,7% no segundo trimestre e receita passando de US$ 3 bilhoes pela primeira vez.
A Mistral montou um stack de IA agentica para engenharia industrial com Airbus, BMW e ASML, cobrindo design, simulacao e producao com garantias de soberania de dados.
Angulo novo sobre o GLM-5.3: a Z.ai so vai liberar os pesos publicamente apos testes de seguranca adicionais e pretende restringir as capacidades de maior risco.
Assembleia e Senado da California votaram cerca de 30 projetos sobre seguranca de chatbots para menores, transparencia de direitos autorais em IA e a criacao de uma comissao de certificacao de seguranca — os textos seguem para sancao do governador Newsom.
Regulação e segurança · Tech Times · california, regulacao, chatbot, direitos-autorais, governanca
Especialistas da Unico e da Kaspersky alertam no SP2B que o custo dos ataques com IA caiu mais de 100 vezes nos ultimos tres anos, com uso de deepfakes ampliando ataques sofisticados.
Regulação e segurança · NeoFeed · fraude, deepfake, brasil, kaspersky, unico, seguranca
Artigo com subtitulo 'It is time to impose law and order on the frontier' argumenta que a desconfianca esta afastando usuarios de agentes, e domina a discussao no Hacker News.
Comunidade · hacker-news · alinhamento, agentes, confianca, palisade, rlhf, regulacao
Texto de Florian Herrengt argumenta que agentes removem o 'limite de velocidade' das mudancas de codigo, gerando PRs grandes e aparentemente funcionais que corroem a manutenibilidade. Rendeu 314 pontos e 364 comentarios no HN.
Comunidade · Hacker News · engenharia-de-software, agentes, manutenibilidade, carreira, debate