A Thinking Machines (lab de Mira Murati, ex-CTO da OpenAI) lançou em 15/07 seu primeiro modelo, o Inkling: transformer Mixture-of-Experts com 975B de parâmetros totais e 41B ativos, janela de até 1M de tokens, pré-treinado em 45 trilhões de tokens de texto, imagem, áudio e vídeo. É open-weights — pesos completos no Hugging Face (incluindo checkpoint NVFP4 para Blackwell) — e disponível via API na Together, Fireworks, Modal, Databricks e Baseten. Foi o assunto nº1 do Hacker News (523+ pts).
Dois eventos devem coincidir em 17/07: o esperado lancamento do Google Gemini 3.5 Pro (spec vazada de 2M de contexto, Deep Think no tier Ultra de US$250, precos ~US$1,25 input/US$10 output por milhao de tokens) e a abertura da World Artificial Intelligence Conference em Xangai, com Xi Jinping presente pessoalmente pela primeira vez desde 2018. Data ainda nao confirmada oficialmente pelo Google.
Modelos · web · google, gemini, waic, china, lancamento
Publicado em 13/07 e em alta no Hugging Face, o OvisOCR2 (base Qwen3.5-0.8B) é um modelo multimodal pequeno para OCR e parsing de documentos: extrai markdown, tabelas e fórmulas, com deploy via vLLM. Parte de uma leva de modelos de OCR/documento (Baidu Unlimited-OCR, etc.) que continua aquecida.
A OpenAI revelou o GPT-Red, modelo interno treinado por self-play RL para automatizar red-teaming. Em cenários inéditos ele atacou com sucesso o GPT-5.1 em 84% dos casos (vs 13% de red-teamers humanos); mais de 90% dos ataques funcionam contra o GPT-5 e menos de 23% contra o GPT-5.6. É mantido isolado dos modelos em produção para não vazar a capacidade ofensiva.
Ferramentas e código · MIT Technology Review / MarkTechPost / OpenAI · openai, red-team, seguranca, prompt-injection, self-play, rl
Benchmark da Systima.ai (330 pontos no HN) mostra que o Claude Code consome ~33k tokens de bootstrap por turno (schemas de tools sozinhos ~24k) antes de qualquer input, chegando a 75-85k em setups reais - 40%+ de uma janela de 200k. Ressalva importante: o batching agressivo de tool calls paralelas reduz o numero de requisicoes, aproximando o custo total do do OpenCode em tarefas multi-etapa.
A OpenAI lançou (15/07) o kbd-1.0-codex-micro: um macropad programável de US$230 feito com a Work Louder, voltado a quem roda vários agentes Codex em paralelo. Tem 6 "agent keys" com RGB que mostram o status do thread (branco=ocioso, azul=pensando, verde=concluído, âmbar=input necessário, vermelho=erro), teclas de comando, joystick para disparar workflows e um dial que regula quanto "raciocínio"/compute o agente usa. Edição limitada, mira os ~5 milhões de usuários semanais do Codex. 2º item de hardware da OpenAI no dia. (251 pts no HN.)
Simon Willison documentou o DOOMQL: um raycaster estilo Doom em que o SQLite (via CTE recursiva) cuida de movimento, colisão, IA dos inimigos, combate e de cada pixel RGB — com Python só ligando teclado, clock e terminal. Foi construído com GPT-5.6 Sol (Codex xhigh) e Willison publicou o transcript completo. Demo muito compartilhada de como o coding agêntico empurra um banco de dados muito além do uso previsto.
PACE (A Proxy for Agentic Capability Evaluation) propoe prever o desempenho de LLMs em benchmarks agenticos caros (SWE-Bench, GAIA) usando um pequeno subconjunto de instancias atomicas, com alta correlacao a uma fracao do custo. Combina estrategias de selecao de instancias (relevancia local, informatividade global) e regressao. 18 upvotes no HF Papers.
Survey que reenquadra os agentes de LLM como uma mudança de paradigma de "responder perguntas" para "completar tarefas", argumentando que desempenho vem da co-evolução entre o modelo-base e o "harness" de execução (observação, contexto, controle, ação, estado, verificação). Boa referência conceitual para engenharia de agentes de longo horizonte.
A governadora Kathy Hochul assinou em 14/07 uma ordem executiva criando a primeira moratoria estadual dos EUA para novos data centers acima de 50 MW, valida por ate um ano. O objetivo e dar tempo aos reguladores para avaliar o impacto em contas de energia, uso de agua e qualidade do ar. Ha ~25 projetos (cerca de 9.340 MW) na fila de interconexao.
Comunidade · web · infraestrutura, data-center, energia, regulacao, EUA
Um novo toggle de consentimento no app Samsung Health avisa que recusar o uso dos dados para treino de IA desliga a sincronizacao na nuvem e apaga os dados armazenados. Cobre registros de saude, medicamentos, sono, atividade e ciclo. Criticos apontam que ameacar apagar dados nao e consentimento real; a Samsung depois esclareceu que apagaria apenas os dados retidos especificamente para treino. Foi topo do Hacker News.
Comunidade · web · privacidade, samsung, dados-saude, consentimento, treino-ia
A TSMC reportou receita recorde de NT$1,27 tri (~US$39,62 bi) no 2o trimestre, alta de 36% a/a, atribuida explicitamente a demanda por chips de IA (GPUs Nvidia, silicio Apple). Os processos N3 e o empacotamento avancado CoWoS estao esgotados ate o fim do ano. Conferencia de resultados marcada para quinta.
Comunidade · web · semicondutores, hardware, tsmc, mercado, nvidia
A chinesa Unitree (robos quadrupedes e humanoides de baixo custo) recebeu aprovacao do regulador para levantar ~4,2 bi de yuans (US$619 mi) na STAR Market, com valuation potencial de ~US$5,9 bi. Recursos irao para pesquisa de modelos de IA para robos, novos produtos e uma fabrica de robos inteligentes. E uma de tres empresas de humanoides caminhando para os mercados publicos nas ultimas semanas.
Comunidade · web · robotica, humanoides, china, ipo, unitree
A alemã Helsing (defesa com IA) fechou uma Série E de US$1,8 bilhão a valuation de US$18 bilhões — a maior rodada de defense-tech da Europa e sua startup de defesa mais valiosa, com demanda muito acima da alocação. Sinal de capital fluindo forte para IA soberana e de defesa.
Comunidade · cnbc · helsing, defesa, defense-tech, investimento, europa, ia-soberana
Discussão em alta no Hacker News (200+ pts) sobre a OpenAI perder uma disputa de marca ("trademark") em tribunal da União Europeia. Reforça o cerco jurídico à empresa em múltiplas frentes (direitos autorais, marca, hardware).
Comunidade · dpa · openai, marca-registrada, propriedade-intelectual, uniao-europeia, juridico
Ensaio em alta no Hacker News (160+ pts) sobre como a clonagem de voz por IA — que precisa de poucos segundos de áudio — já ultrapassa os mecanismos de defesa e autenticação por voz, com implicações para bancos, call centers e biometria.
Comunidade · smarterarticles · seguranca, deepfake-voz, fraude, clonagem-de-voz, autenticacao, biometria