Radar do FAROL53 notas

sexta-feira, 14 de agosto de 2026

Modelos

GLM-5.3 da Z.ai reivindica codificacao de fronteira com capacidades ciberneticas emergentes

Z.ai lancou o GLM-5.3 mantendo o modelo-base de 743B do GLM-5.2 mas com pos-treinamento ampliado; reivindica o melhor desempenho em codificacao entre modelos de peso aberto e relata capacidades ciberneticas emergentes. Foi o post nº1 do Hacker News (542 pontos).

Modelos · Z.ai · glm, pesos-abertos, china, coding, cyber, z-ai

Z.ai lanca GLM-5.3 com capacidade cibernetica emergente

A chinesa Z.ai apresentou o GLM-5.3, modelo de 743 bilhoes de parametros que obtem os ganhos apenas via pos-treinamento ampliado sobre a base do GLM-5.2.

Modelos · websearch · zai, glm, china, ciberseguranca, open-weights

DeepSeek libera o V4 Pro em disponibilidade geral

DeepSeek tornou geralmente disponivel o V4 Pro (build 0813), um MoE de 1,6 trilhao de parametros com 49B ativos, focado em capacidades agenticas e janela de contexto de ate 1 milhao de tokens. Benchmarks ainda aguardam verificacao independente.

Modelos · Tech Times · deepseek, moe, agentes, contexto-longo, china

Alibaba abre os pesos da serie Qwen3.8 sob Apache 2.0

A equipe Qwen liberou os pesos abertos da serie Qwen3.8 sob Apache 2.0, com destaque para o denso multimodal Qwen3.8-27B.

Modelos · websearch · alibaba, qwen, open-weights, multimodal, apache

NVIDIA libera Nemotron 3.5 Lightning como modelo aberto

NVIDIA anunciou o Nemotron 3.5 Lightning, modelo leve que roda em uma unica GPU de PC, baixavel e modificavel gratuitamente sem licenca paga.

Modelos · websearch · nvidia, nemotron, open-weights, agentes, inferencia-local

Qwen3.8-27B lidera trending da Hugging Face, mas licenca do irmao maior irrita a comunidade

O Qwen3.8-27B esta em primeiro lugar no trending da Hugging Face com 8.908 likes, e ja tem quantizacoes GGUF da unsloth (763 likes) e versao FP8 publicadas em 13/08.

Modelos · huggingface · qwen, alibaba, open-weights, licenca, comunidade, gguf

Needle2: LLM agentico de 14 MB roda em Raspberry Pi, ESP32 e Android de US$ 200

Modelo de 45M parametros em binario de 14 MB, com sessao completa em 28 MB de RAM e quantizacao CQ2-bit embutida no treino, nao aplicada depois.

Modelos · hacker-news · edge, on-device, quantizacao, microcontrolador, apache-2, tinyml

Nvidia libera Nemotron 3.5 Lightning: MoE de 30B com 3B ativos que roda em uma unica GPU

Modelo aberto de 30B parametros (3B ativos) em arquitetura hibrida Mamba-2 com camadas de especialistas e atencao seletiva, otimizado para agentes always-on de baixa latencia.

Modelos · websearch · nvidia, nemotron, mamba, moe, agentes, edge

DFM Mimir v1: desempenho de fronteira com 1B de parametros e dados de pos-treino licenciados

Modelo aberto de raciocinio hierarquico com apenas 1 bilhao de parametros reivindica desempenho de fronteira usando exclusivamente dados de pos-treinamento com licenca permitida.

Modelos · arXiv · modelos-pequenos, hrm, dados-licenciados, eficiencia, arxiv

Trending da Hugging Face confirma virada multimodal: Muse-Glimmer, MiniMax-H3 e Ling-3.0-tiny

O topo do trending da HF nesta noite mistura texto-imagem e geracao de video: Muse-Glimmer-30B (165,3 mil downloads), MiniMax-H3 (2,0 milhoes) e MiniMax-Music3.

Modelos · huggingface · huggingface, trending, multimodal, video, minimax, meta

Ferramentas e código

DeepSeek abre o Harness, runtime de agentes rival do Claude Code

A DeepSeek publicou sob licenca MIT o developer preview do Harness v0.1, runtime de agentes cujo lema e que toda capacidade e um plugin.

Ferramentas e código · websearch · deepseek, harness, agentes, open-source, mit, claude-code

Anthropic leva Claude Code e Claude Cowork ao governo dos EUA em ambiente FedRAMP High

Claude for Government Desktop passa a incluir Claude Code e Claude Cowork em beta publico, entregues em ambiente autorizado FedRAMP High, com a Anthropic como parte contratante e faturadora.

Ferramentas e código · websearch · anthropic, claude-code, cowork, governo, fedramp, compliance

Writer lanca Palmyra X6 e mostra que o harness corta 41% do custo em qualquer modelo

O Palmyra X6 e um pos-treino do GLM-5.2 aberto da Z.ai, a US$ 2 / US$ 8 por 1M tokens e custo medio de tarefa de cerca de US$ 0,12. Mas o achado relevante nao e o modelo.

Ferramentas e código · websearch · writer, palmyra, harness, orquestracao, custo, agentes

Anthropic torna o auto mode padrao no Claude Code

O auto mode virou padrao para usuarios Pro, Max e Team do Claude Code: aprovacoes manuais dao lugar a um classificador que barra acoes irreversiveis. Testes internos indicam 89% de deteccao de comandos perigosos contra 13,6% dos revisores humanos.

Ferramentas e código · AI Weekly · claude-code, anthropic, agentes, seguranca, auto-mode

DeepSeek Harness ultrapassa 85 mil estrelas no GitHub

O harness agentico da DeepSeek — arquitetura em que 'tudo e um plugin' — acumulou mais de 85 mil estrelas em menos de dez dias, um dos lancamentos open-source de crescimento mais rapido do ano.

Ferramentas e código · GitHub · deepseek, harness, agentes, open-source, plugins

OpenAI lanca tier Ultrafast com GPT-5.6 Sol rodando em Cerebras

A OpenAI abriu preview do Ultrafast, tier de API que executa o GPT-5.6 Sol ate 14 vezes mais rapido que o padrao, com ate 750 tokens de saida por segundo.

Ferramentas e código · websearch · openai, cerebras, latencia, agentes, inferencia

book-to-skill converte livros tecnicos em PDF para skills do Claude Code

Ferramenta que transforma qualquer livro tecnico em PDF numa skill do Claude Code, pronta para consulta e uso durante o trabalho, passou de mil estrelas.

Ferramentas e código · GitHub · claude-code, skills, pdf, conhecimento, open-source

Codex no app desktop do ChatGPT chega ao Linux em preview

A OpenAI liberou em preview o Codex integrado ao app desktop do ChatGPT para Linux.

Ferramentas e código · websearch · openai, codex, linux, desktop, claude-code

phone-harness permite que agentes controlem o celular

Projeto que da a agentes de IA controle direto sobre o smartphone acumulou mais de 1.700 estrelas em poucos dias.

Ferramentas e código · GitHub · agentes, mobile, automacao, computer-use, open-source

AX-RAY: catalogo aberto de criterios de avaliacao e seguranca de IA

Catalogo versionado e legivel por maquina com criterios de seguranca, auditoria de modelos e prontidao para deploy, organizado em 11 eixos.

Ferramentas e código · huggingface · governanca, avaliacao, compliance, dataset, auditoria

Pesquisa

Virus inteiramente projetados por IA funcionam em laboratorio: 16 bacteriofagos viaveis

Stanford e Arc Institute usaram os modelos de linguagem genomica Evo 1 e Evo 2 para escrever genomas virais completos ineditos; 16 deles produziram bacteriofagos viaveis capazes de infectar e matar E. coli.

Pesquisa · websearch · biosseguranca, evo-2, stanford, arc-institute, genomica, ciencia

Busca direta no log bruto rivaliza com memoria estruturada em agentes

Mostra que deixar o agente pesquisar diretamente nos logs brutos de conversa alcanca desempenho comparavel a pipelines elaborados de memoria estruturada.

Pesquisa · arxiv · memoria, agentes, simplicidade, baseline

RippleMem propoe memoria associativa de longo prazo para agentes

Propoe substituir a recuperacao isolada por recoleccao associativa, em que lembrar de um fato ativa fatos relacionados em cascata.

Pesquisa · arxiv · memoria, agentes, rag, contexto, recuperacao

DFM Mimir v1: raciocinio hierarquico de 1B so com dados permitidos

Relatorio tecnico de um Hierarchical Reasoning Model aberto de 1 bilhao de parametros treinado exclusivamente com dados de pos-treino legalmente permissiveis.

Pesquisa · arxiv · hrm, modelo-pequeno, dados, direito-autoral, licenciamento

AutoDesign: otimizacao meta-harness para design agentico de longo horizonte

Paper propoe otimizar automaticamente o proprio harness do agente — nao so o prompt — para tarefas de design com horizonte longo.

Pesquisa · arXiv · agentes, harness, long-horizon, otimizacao, arxiv

Vero: agentes de IA conseguem construir repositorios formalmente verificados?

Benchmark que testa se agentes de IA conseguem produzir repositorios de software com verificacao formal completa — nao apenas codigo que passa em testes.

Pesquisa · arXiv · verificacao-formal, agentes, codigo, benchmark, arxiv

AQuA: agentes de pesquisa quantitativa que se autoaprimoram

Framework de agentes que geram, testam e refinam recursivamente suas proprias estrategias de trading, do time de Mengdi Wang em Princeton.

Pesquisa · arxiv · agentes, auto-aprimoramento, rl, financas, trading

Mixture of Training recombina treinos pequenos num modelo maior

Trabalho com autores do Google que recombina varias rodadas pequenas de pre-treino com scaffolding num modelo unico maior, em vez de um treino monolitico caro.

Pesquisa · arxiv · pre-treino, google, compute, escalabilidade

LycheeMemory V2 consolida historico por segmentos semanticos

Segunda versao de um sistema de memoria de longo prazo que consolida historico em segmentos semanticos em vez de chunks fixos, reduzindo custo de recuperacao.

Pesquisa · arxiv · memoria, agentes, segmentacao, recuperacao

OmniScientist: cientista de IA omni-modal e omni-disciplinar

Sistema que propoe unificar modalidades e disciplinas num unico agente cientifico capaz de conduzir o ciclo de pesquisa ponta a ponta.

Pesquisa · arXiv · ai-scientist, multimodal, descoberta-cientifica, agentes, arxiv

Explicacao tecnica de como funciona a marca d'agua em texto gerado por IA

Artigo tecnico detalhando os mecanismos de watermarking estatistico em texto de LLM ganhou tracao no Hacker News (114 pontos), em meio ao crescimento de ferramentas de remocao de marcas de proveniencia.

Pesquisa · declaude.org · watermarking, proveniencia, deteccao, texto-gerado

Mercado

Guerra de precos se inverte: OpenAI e Anthropic cortam tarifas enquanto DeepSeek sobe ate 1.100%

O FT aponta queda material nos precos dos modelos lideres dos EUA desde meados de julho, enquanto a DeepSeek encareceu o V4 Pro em ate 1.100% em alguns workloads.

Mercado · websearch · precos, openai, anthropic, deepseek, inferencia, economia-de-tokens

Receita anualizada da OpenAI passa de US$ 40 bilhoes

A OpenAI atingiu run rate de receita acima de US$ 40 bilhoes, cerca do dobro do patamar do fim de 2025.

Mercado · websearch · openai, receita, ipo, financas

DeepSeek lanca V4 Pro e eleva precos de API em ate 1.100%

DeepSeek oficializou o V4 Pro a US$ 1,32 por milhao de tokens de entrada e US$ 3,96 de saida, cerca de 9x e 14x o custo do V4 Flash.

Mercado · websearch · deepseek, preco, api, china

Anthropic sinaliza que nao planeja liberar um modelo muito mais forte

A Anthropic sinalizou que nao pretende lancar no curto prazo um modelo substancialmente mais capaz, citando avaliacao interna de riscos em alta.

Mercado · websearch · anthropic, risco, seguranca, estrategia

Apple treina modelo proprio para a China com apoio da Alibaba

A Apple treinou um LLM especifico para o mercado chines com suporte da Alibaba, ganhando controle sobre a IA que roda nos iPhones vendidos no pais, onde o ChatGPT e indisponivel.

Mercado · websearch · apple, china, alibaba, apple-intelligence, regulacao, on-device

Big Tech acumula cerca de US$ 1,5 trilhao em compromissos de compra fora do balanco

Alphabet, Microsoft, Amazon, Nvidia, Oracle e Meta acumularam cerca de US$ 1,5 trilhao em compromissos de compra ligados a computacao, chips, data centers e energia.

Mercado · websearch · capex, big-tech, contabilidade, data-center, energia, risco

Brasil lidera adocao de agentes de IA em producao: 76% das empresas contra 62% global

Estudo coloca o Brasil a frente da media global (62%) e dos EUA (67%) em agentes de IA ja em producao, com 76% das empresas brasileiras.

Mercado · websearch · brasil, adocao, agentes, roi, orcamento, pesquisa

Goldman Sachs mobiliza investidores para o pacote de US$ 500 bilhoes de infraestrutura da Nvidia

A Nvidia anunciou em 10/08 plataformas de financiamento com Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs e KKR para mobilizar mais de US$ 500 bilhoes em infraestrutura de IA.

Mercado · websearch · nvidia, goldman-sachs, infraestrutura, financiamento, data-center, risco-sistemico

Nvidia assina sete gigantes industriais japonesas na coalizao de IA fisica

Nvidia formalizou parcerias com Toyota, Fujitsu, Fanuc, Kioxia e outras para aplicar IA fisica em manufatura e robotica, reforcando a demanda ja confirmada de US$ 1 trilhao ate 2027.

Mercado · The Motley Fool · nvidia, ia-fisica, robotica, japao, manufatura

DeepMind vive crise de identidade apos reestruturacao de lideranca

Reportagem detalha como a saida de Demis Hassabis do dia a dia (substituido por Koray Kavukcuoglu) e o atraso do Gemini 3.5 Pro alimentam tensoes internas sobre a direcao do laboratorio.

Mercado · Fortune · deepmind, google, gemini, lideranca, governanca

IBM e OpenAI firmam parceria de IA corporativa

A IBM vai incorporar modelos da OpenAI, incluindo GPT-5.6, Codex e ChatGPT Work, a plataforma IBM Consulting Advantage.

Mercado · websearch · ibm, openai, enterprise, consultoria

SMIC sobe precos com fabricas a 93,7% de utilizacao e lucro trimestral triplicado

A maior foundry da China elevou precos de capacidade disputada com utilizacao em 93,7% no segundo trimestre e receita passando de US$ 3 bilhoes pela primeira vez.

Mercado · websearch · smic, semicondutores, china, foundry, capacidade, supply-chain

Pony.ai e Uber vao colocar mais de 2.000 robotaxis em cinco cidades europeias

A parceria, que ja opera em Zagreb, se expande para mais quatro mercados europeus e depois para o Oriente Medio, com frota na casa dos milhares.

Mercado · websearch · robotaxi, pony-ai, uber, autonomia, europa, ia-fisica

Mistral monta stack de IA industrial com Airbus, BMW e ASML e anuncia data center de 10 MW

A Mistral montou um stack de IA agentica para engenharia industrial com Airbus, BMW e ASML, cobrindo design, simulacao e producao com garantias de soberania de dados.

Mercado · websearch · mistral, europa, soberania, industria, shieldstral, moderacao

OpenAI troca de CRO em nova rodada de mudancas no alto escalao

Denise Dresser deixa o cargo de chief revenue officer apos nove meses; Dali Rajic, presidente e COO da Wiz, assume o comando comercial da OpenAI.

Mercado · TechCrunch · openai, executivos, comercial, enterprise

Regulação e segurança

Z.ai vai restringir os pesos do GLM-5.3 com sistema de acesso confiavel

Angulo novo sobre o GLM-5.3: a Z.ai so vai liberar os pesos publicamente apos testes de seguranca adicionais e pretende restringir as capacidades de maior risco.

Regulação e segurança · websearch · z-ai, glm, ciberseguranca, open-weights, cybergym, acesso-controlado

California vota pacote de cerca de 30 projetos de lei de IA

Assembleia e Senado da California votaram cerca de 30 projetos sobre seguranca de chatbots para menores, transparencia de direitos autorais em IA e a criacao de uma comissao de certificacao de seguranca — os textos seguem para sancao do governador Newsom.

Regulação e segurança · Tech Times · california, regulacao, chatbot, direitos-autorais, governanca

Custo dos golpes com IA despenca mais de 100 vezes em tres anos

Especialistas da Unico e da Kaspersky alertam no SP2B que o custo dos ataques com IA caiu mais de 100 vezes nos ultimos tres anos, com uso de deepfakes ampliando ataques sofisticados.

Regulação e segurança · NeoFeed · fraude, deepfake, brasil, kaspersky, unico, seguranca

Comunidade

Ensaio no HN questiona por que o Opus 5 parece pior de usar

Ensaio que subiu ao top 3 do Hacker News consolida a queixa recorrente de que o Opus 5 e verboso e faz over-engineering em tarefas simples.

Comunidade · websearch · anthropic, opus-5, claude-code, ux, regressao

Economist: agentes de IA mentem, trapaceiam e roubam — e a desconfianca ja afasta usuarios

Artigo com subtitulo 'It is time to impose law and order on the frontier' argumenta que a desconfianca esta afastando usuarios de agentes, e domina a discussao no Hacker News.

Comunidade · hacker-news · alinhamento, agentes, confianca, palisade, rlhf, regulacao

Ensaio sobre IA 'esvaziando a classe media' da engenharia de software viraliza

Texto de Florian Herrengt argumenta que agentes removem o 'limite de velocidade' das mudancas de codigo, gerando PRs grandes e aparentemente funcionais que corroem a manutenibilidade. Rendeu 314 pontos e 364 comentarios no HN.

Comunidade · Hacker News · engenharia-de-software, agentes, manutenibilidade, carreira, debate

NVIDIA e parceiros criam a Open Secure AI Alliance

A NVIDIA lancou com parceiros da industria a Open Secure AI Alliance, iniciativa voltada a seguranca de modelos e ferramentas abertas.

Comunidade · websearch · nvidia, seguranca, open-source, alianca