Radar do FAROL18 notas

quarta-feira, 15 de julho de 2026

Modelos

Thinking Machines lança Inkling: primeiro modelo open-weights (975B/41B ativos, multimodal, 1M de contexto)

A Thinking Machines (lab de Mira Murati, ex-CTO da OpenAI) lançou em 15/07 seu primeiro modelo, o Inkling: transformer Mixture-of-Experts com 975B de parâmetros totais e 41B ativos, janela de até 1M de tokens, pré-treinado em 45 trilhões de tokens de texto, imagem, áudio e vídeo. É open-weights — pesos completos no Hugging Face (incluindo checkpoint NVFP4 para Blackwell) — e disponível via API na Together, Fireworks, Modal, Databricks e Baseten. Foi o assunto nº1 do Hacker News (523+ pts).

Modelos · techcrunch · thinking-machines, mira-murati, inkling, open-weights, moe, multimodal

17/07 vira dia-chave da IA: lancamento do Gemini 3.5 Pro encontra a WAIC de Xangai com Xi Jinping

Dois eventos devem coincidir em 17/07: o esperado lancamento do Google Gemini 3.5 Pro (spec vazada de 2M de contexto, Deep Think no tier Ultra de US$250, precos ~US$1,25 input/US$10 output por milhao de tokens) e a abertura da World Artificial Intelligence Conference em Xangai, com Xi Jinping presente pessoalmente pela primeira vez desde 2018. Data ainda nao confirmada oficialmente pelo Google.

Modelos · web · google, gemini, waic, china, lancamento

OvisOCR2: modelo compacto de OCR e parsing de documentos (Qwen3.5-0.8B) em alta no HF

Publicado em 13/07 e em alta no Hugging Face, o OvisOCR2 (base Qwen3.5-0.8B) é um modelo multimodal pequeno para OCR e parsing de documentos: extrai markdown, tabelas e fórmulas, com deploy via vLLM. Parte de uma leva de modelos de OCR/documento (Baidu Unlimited-OCR, etc.) que continua aquecida.

Modelos · huggingface · ocr, document-parsing, qwen3-5, multimodal, markdown, tabelas

Ferramentas e código

OpenAI detalha o GPT-Red, red-teamer automático que supera humanos em prompt injection

A OpenAI revelou o GPT-Red, modelo interno treinado por self-play RL para automatizar red-teaming. Em cenários inéditos ele atacou com sucesso o GPT-5.1 em 84% dos casos (vs 13% de red-teamers humanos); mais de 90% dos ataques funcionam contra o GPT-5 e menos de 23% contra o GPT-5.6. É mantido isolado dos modelos em produção para não vazar a capacidade ofensiva.

Ferramentas e código · MIT Technology Review / MarkTechPost / OpenAI · openai, red-team, seguranca, prompt-injection, self-play, rl

Infrastructure AI Lança Agentic Hub 1.0 para Edge AI

Ferramentas e código · agentic-ai-news · Agentes, Edge Computing, Infrastructure, Orquestração

Estudo: Claude Code envia ~33k tokens antes de ler o prompt; OpenCode, 7k

Benchmark da Systima.ai (330 pontos no HN) mostra que o Claude Code consome ~33k tokens de bootstrap por turno (schemas de tools sozinhos ~24k) antes de qualquer input, chegando a 75-85k em setups reais - 40%+ de uma janela de 200k. Ressalva importante: o batching agressivo de tool calls paralelas reduz o numero de requisicoes, aproximando o custo total do do OpenCode em tarefas multi-etapa.

Ferramentas e código · hackernews · claude-code, context-engineering, tokens, agentes, opencode

OpenAI lança Codex Micro: macropad de US$230 para agentes de código (com Work Louder)

A OpenAI lançou (15/07) o kbd-1.0-codex-micro: um macropad programável de US$230 feito com a Work Louder, voltado a quem roda vários agentes Codex em paralelo. Tem 6 "agent keys" com RGB que mostram o status do thread (branco=ocioso, azul=pensando, verde=concluído, âmbar=input necessário, vermelho=erro), teclas de comando, joystick para disparar workflows e um dial que regula quanto "raciocínio"/compute o agente usa. Edição limitada, mira os ~5 milhões de usuários semanais do Codex. 2º item de hardware da OpenAI no dia. (251 pts no HN.)

Ferramentas e código · techcrunch · openai, codex, hardware, macropad, work-louder, agentes-de-codigo

DOOMQL: um motor tipo Doom escrito em ~2.000 linhas de SQL puro (montado com GPT-5.6 Sol)

Simon Willison documentou o DOOMQL: um raycaster estilo Doom em que o SQLite (via CTE recursiva) cuida de movimento, colisão, IA dos inimigos, combate e de cada pixel RGB — com Python só ligando teclado, clock e terminal. Foi construído com GPT-5.6 Sol (Codex xhigh) e Willison publicou o transcript completo. Demo muito compartilhada de como o coding agêntico empurra um banco de dados muito além do uso previsto.

Ferramentas e código · simonwillison · simon-willison, sql, sqlite, doom, gpt-5-6, codex

Pesquisa

Paper PACE: proxy barato para prever desempenho de LLMs em benchmarks agenticos

PACE (A Proxy for Agentic Capability Evaluation) propoe prever o desempenho de LLMs em benchmarks agenticos caros (SWE-Bench, GAIA) usando um pequeno subconjunto de instancias atomicas, com alta correlacao a uma fracao do custo. Combina estrategias de selecao de instancias (relevancia local, informatividade global) e regressao. 18 upvotes no HF Papers.

Pesquisa · arxiv · paper, agentes, avaliacao, benchmark, swe-bench

Survey: 'From Question Answering to Task Completion' — design de sistemas e harness de agentes

Survey que reenquadra os agentes de LLM como uma mudança de paradigma de "responder perguntas" para "completar tarefas", argumentando que desempenho vem da co-evolução entre o modelo-base e o "harness" de execução (observação, contexto, controle, ação, estado, verificação). Boa referência conceitual para engenharia de agentes de longo horizonte.

Pesquisa · huggingface-papers · agentes, harness, co-evolucao-modelo-harness, long-horizon, survey, engenharia-de-agentes

Comunidade

52% de Partners de Canal Deploying AI Agents Internamente

Comunidade · agentic-ai-news · Agentes, Adoção Enterprise, IA Agentica

Nova York é o 1º estado dos EUA a pausar data centers hyperscale de IA

A governadora Kathy Hochul assinou em 14/07 uma ordem executiva criando a primeira moratoria estadual dos EUA para novos data centers acima de 50 MW, valida por ate um ano. O objetivo e dar tempo aos reguladores para avaliar o impacto em contas de energia, uso de agua e qualidade do ar. Ha ~25 projetos (cerca de 9.340 MW) na fila de interconexao.

Comunidade · web · infraestrutura, data-center, energia, regulacao, EUA

Samsung Health ameaca apagar dados de quem recusar treino de IA

Um novo toggle de consentimento no app Samsung Health avisa que recusar o uso dos dados para treino de IA desliga a sincronizacao na nuvem e apaga os dados armazenados. Cobre registros de saude, medicamentos, sono, atividade e ciclo. Criticos apontam que ameacar apagar dados nao e consentimento real; a Samsung depois esclareceu que apagaria apenas os dados retidos especificamente para treino. Foi topo do Hacker News.

Comunidade · web · privacidade, samsung, dados-saude, consentimento, treino-ia

TSMC bate recorde de receita no 2o tri (US$39,6 bi) puxada por IA

A TSMC reportou receita recorde de NT$1,27 tri (~US$39,62 bi) no 2o trimestre, alta de 36% a/a, atribuida explicitamente a demanda por chips de IA (GPUs Nvidia, silicio Apple). Os processos N3 e o empacotamento avancado CoWoS estao esgotados ate o fim do ano. Conferencia de resultados marcada para quinta.

Comunidade · web · semicondutores, hardware, tsmc, mercado, nvidia

Unitree Robotics tem IPO de US$619 mi aprovado na STAR Market de Xangai

A chinesa Unitree (robos quadrupedes e humanoides de baixo custo) recebeu aprovacao do regulador para levantar ~4,2 bi de yuans (US$619 mi) na STAR Market, com valuation potencial de ~US$5,9 bi. Recursos irao para pesquisa de modelos de IA para robos, novos produtos e uma fabrica de robos inteligentes. E uma de tres empresas de humanoides caminhando para os mercados publicos nas ultimas semanas.

Comunidade · web · robotica, humanoides, china, ipo, unitree

Helsing capta US$1,8 bi a valuation de US$18 bi — maior rodada de defesa-tech da Europa

A alemã Helsing (defesa com IA) fechou uma Série E de US$1,8 bilhão a valuation de US$18 bilhões — a maior rodada de defense-tech da Europa e sua startup de defesa mais valiosa, com demanda muito acima da alocação. Sinal de capital fluindo forte para IA soberana e de defesa.

Comunidade · cnbc · helsing, defesa, defense-tech, investimento, europa, ia-soberana

OpenAI perde disputa de marca em tribunal da União Europeia

Discussão em alta no Hacker News (200+ pts) sobre a OpenAI perder uma disputa de marca ("trademark") em tribunal da União Europeia. Reforça o cerco jurídico à empresa em múltiplas frentes (direitos autorais, marca, hardware).

Comunidade · dpa · openai, marca-registrada, propriedade-intelectual, uniao-europeia, juridico

The Three-Second Theft: por que a fraude de voz por IA supera as defesas

Ensaio em alta no Hacker News (160+ pts) sobre como a clonagem de voz por IA — que precisa de poucos segundos de áudio — já ultrapassa os mecanismos de defesa e autenticação por voz, com implicações para bancos, call centers e biometria.

Comunidade · smarterarticles · seguranca, deepfake-voz, fraude, clonagem-de-voz, autenticacao, biometria