# Radar do FAROL · sexta-feira, 21 de agosto de 2026

68 notícias. Dados: https://radar.farolia.org/dados/dia/2026-08-21.json

## Modelos

- **[Modelo frontier anonimo Ox Alpha aparece de graca no OpenRouter com 1M de contexto](https://openrouter.ai/stealth/ox-alpha)** (Modelos; OpenRouter). Modelo stealth publicado em 20/08 por provedor que optou por ficar anonimo durante o preview. Janela de 1.048.576 tokens, saida maxima de 131.072, entrada de texto, imagem e video, posicionado para coding e trabalho agentico de longo horizonte. Preco zero durante a semana de teste e, incomum para stealth releases, o provedor declara que nao treina com os prompts. 170 pts e 130 comentarios no HN, c
- **[Em 5 dos 7 meses de 2026, o maior modelo aberto americano foi muito menor que o chines](https://www.metatalks.ai/in-five-of-the-seven-months-of-2026-that-hugging-face-studied-the-biggest-open-model-an-american-lab-built-for-itself-was-far-smaller-than-chinas/)** (Modelos; MetaTalks.ai (analise do relatorio HF)). Analise em cima dos dados da Hugging Face mostrando que em 5 dos 7 meses estudados, o maior modelo aberto lancado por um lab americano foi bem menor que o chines do mesmo periodo. A maioria dos releases americanos acima de 100B em 2026 nao foram modelos novos, e sim derivacoes sobre bases chinesas.
- **[DeepSeek lanca V4-Flash-Vision-Exp e diz chegar perto do Opus 4.8 em agentes visuais](https://api-docs.deepseek.com/guides/vision/)** (Modelos; DeepSeek API Docs). A DeepSeek colocou no ar o deepseek-v4-flash-vision-exp, experimental, que aceita imagem e texto via Chat Completions, Responses e Messages API em formato compativel com OpenAI. Em texto puro empata com o V4-Flash normal; em benchmarks de agente que exigem compreensao visual a empresa afirma salto grande, chegando perto do Opus 4.8. Imagens custam ate 384 tokens cada, cobradas no preco do V4-Flash
- **[Anthropic abre o Claude Mythos 5 a defensores de ciberseguranca e cria fundo de US$ 35 milhoes](https://claude.com/blog/bringing-claude-mythos-5-to-more-defenders)** (Modelos; Anthropic). Mythos 5 chega ao Claude Security e a ferramentas de parceiros de defesa. Fundo de US$ 35 mi para seguranca de software open-source e expansao do Cyber Verification Program.
- **[Qwen3.8-27B quantizado em 2 bits cabe em 10 GB sem perda mensuravel](https://huggingface.co/EschaLabs/Qwen3.8-27B-Escha-W2)** (Modelos; Hugging Face / Escha Labs). Build de 2 bits do Qwen3.8-27B feito pela Escha Labs que comprime 27B de parametros em 10,15 GB. Modelo, KV cache e 64k de contexto cabem numa unica placa consumer de 24 GB, ou 128k com config ajustada. Contra referencia FP8 no mesmo backend nao e mensuravelmente pior: 79,25 de media em Commonsense-6 (a frente), 88,38 no GPQA-Diamond (atras por exatamente uma questao) e 86,81 pass@1 no LiveCodeBen
- **[Gemma, da Google DeepMind, ultrapassa 1 bilhao de downloads](https://blog.google/innovation-and-ai/technology/developers-tools/gemma-one-billion-downloads/)** (Modelos; Google Blog). A familia de modelos abertos Gemma passou de 1 bilhao de downloads acumulados, com mais de 100 mil variantes e fine-tunes publicados pela comunidade desde a estreia, em 2024. A Google lancou junto um repositorio Awesome Gemma no GitHub para organizar projetos, tutoriais e aplicacoes. Casos citados v

## Ferramentas e código

- **[Binance abre trading ao vivo para agentes de IA, sem teto de perda](https://techcrunch.com/2026/08/20/binance-now-lets-ai-agents-trade-but-keeping-them-in-check-is-largely-up-to-users/)** (Ferramentas e código; TechCrunch). A Binance lancou o Agent OS, que deixa agentes de IA analisarem mercado e executarem operacoes reais para os mais de 300 milhoes de contas registradas na maior exchange cripto do mundo. A contencao fica por conta do usuario, via subcontas com escopo limitado que bloqueiam saques por padrao — mas nao
- **[GitHub trending: obra/superpowers e mattpocock/skills consolidam o skill engineering](https://github.com/obra/superpowers)** (Ferramentas e código; GitHub Trending). Os dois repositorios de skills para Claude Code apareceram juntos no trending do dia. O superpowers (~40k estrelas) e um framework composavel que estrutura o ciclo completo de desenvolvimento — brainstorm, worktree, plano, subagentes, TDD, code review. O mattpocock/skills traz 17 primitivas pequenas
- **[Bug no Codex sobre AWS Bedrock faz 85% do gasto virar cache-write](https://github.com/openai/codex/issues/37674)** (Ferramentas e código; GitHub / openai-codex). Requisicoes nativas do Codex CLI v0.147.0 ao Amazon Bedrock Mantle com openai.gpt-5.6-sol nao conseguem optar pelo prompt caching explicito, porque os request types nao incluem prompt_cache_options nem prompt_cache_breakpoint. Evidencia de producao: 3.656 requests entre 05 e 08/08 geraram 171,94M tokens de cache-write e cerca de US$ 1.182 de custo de cache-write num total estimado de US$ 1.386, ou
- **[ChatGPT ganha plugin do Apple Messages e passa a ler e enviar mensagens no Mac](https://techcrunch.com/2026/08/20/chatgpt-can-now-send-texts-for-you-with-new-apple-messages-plugin/)** (Ferramentas e código; TechCrunch). O app desktop do ChatGPT passa a ler e buscar conversas de iMessage, SMS e RCS e a enviar mensagens pelo app Messages. Funciona em Codex e ChatGPT Work, disponivel em todos os planos, mas so no build Apple Silicon (arm64). Exige permissoes do macOS e, por padrao, o usuario aprova mensagem e destinatarios antes do envio. Nao permite controlar o ChatGPT remotamente por SMS.
- **[llm-openrouter 0.7 traz tracos de raciocinio e ferramentas server-side ao CLI de Simon Willison](https://simonwillison.net/2026/Aug/21/)** (Ferramentas e código; Simon Willison). Plugin passa a exibir tracos de raciocinio, migra para a Responses API do OpenRouter e ganha Shell, WebFetch e WebSearch server-side via flags como -T WebSearch.
- **[OpenViking (ByteDance) une memoria de agente, RAG e skills num banco de contexto auto-evolutivo](https://github.com/volcengine/OpenViking)** (Ferramentas e código; GitHub / Volcengine). Projeto do time Volcengine (ByteDance) que unifica memoria de agente, RAG de conhecimento e skills num Self-evolving Context Database. Foi o repositorio de IA com maior velocidade de estrelas na janela, cerca de 950 no dia e 31.368 no total, com commits durante a madrugada.
- **[nobuzz: skill de estilo para o Claude parar de escrever como materia de BuzzFeed](https://github.com/adnanakil/nobuzz)** (Ferramentas e código; GitHub). Conjunto de regras que suprime os ties de escrita de LLM -- antiteses do tipo 'nao e X, e Y', listas de tres, entusiasmo performatico. 279 pontos e 186 comentarios no HN.
- **[Bun 1.4 sai com Bun.WebView e traz automacao de browser para dentro do runtime](https://simonwillison.net/2026/Aug/20/bun-webview-json-api/)** (Ferramentas e código; Simon Willison). Primeira versao estavel desde a reescrita de Zig para Rust. Adiciona Bun.Image, Bun.WebView, Bun.markdown, Bun.cron(), Bun.Terminal, bun run --parallel, bun test --parallel, bun audit fix, bun dedupe e bun prune; mais 1.517 testes da suite Node.js, 2.900 issues corrigidas, 5x menos CPU idle, ate 35% menos memoria e boot 50% mais rapido no Linux. Willison usou Claude Code for web para construir um
- **[Ramp lanca Router.com, roteador de modelos com corte medio de 40% no custo de inferencia](https://techcrunch.com/2026/08/20/ramp-launches-its-own-ai-model-router-called-router/)** (Ferramentas e código; TechCrunch). API para acessar, testar e rotear entre modelos de linguagem: cada requisicao vai para o modelo mais barato que atenda ao nivel de desempenho exigido, com telemetria de modelo, provedor, tier, tokens, latencia, custo e tentativas de fallback. Clientes em uso reduziram custo de inferencia em 40% na media. So nos EUA, gratuito ate o fim de 2026 (paga-se so a inferencia), com US$ 26 de credito de lan
- **[OzBrain propoe um cerebro compartilhado entre agentes e equipes](https://ozbrain.com)** (Ferramentas e código; Hacker News (Show HN)). Camada unica de memoria que Claude, ChatGPT e Cursor leem e escrevem, com indice de roteamento para carregar so o necessario. Demo mostra 61 artigos com marcacao de frescor.
- **[cursor/plugins volta ao trending com a spec Agent Plugins v1.0.0](https://github.com/cursor/plugins)** (Ferramentas e código; GitHub / Cursor). Repositorio da especificacao de plugins do Cursor, com cerca de 449 estrelas no dia e 4.236 no total, push em 21/08 as 03h10 UTC. Em 11/08 a spec Agent Plugins v1.0.0 saiu como Working Draft, definindo formato portatil de Agent Skills e configs MCP que atravessa OpenAI, Cursor, GitHub, VS Code, Kiro, Hermes e OpenClaw.
- **[GitHub culpa falha de capacidade, nao deploy, por apagao de quase 8 horas](https://techstartups.com/2026/08/21/top-tech-news-today-august-21-2026-anthropic-apple-broadcom-google-nvidia-openai-tesla-more/)** (Ferramentas e código; GitHub post-mortem via TechStartups). O GitHub publicou o post-mortem da queda que derrubou GitHub.com, APIs, Issues, Pull Requests, Actions, autenticacao e Copilot por quase oito horas em 17 de agosto: o trafego de pico saturou a infraestrutura do datacenter Central US depois que um componente critico nao escalou. No pior momento, erro
- **[Relato tecnico monta fabrica de software agentica quase toda auto-hospedada e em sandbox](https://blog.jakesaunders.dev/building-an-almost-fully-self-hosted-sandboxed-agentic-software-factory/)** (Ferramentas e código; Jake Saunders). Pipeline em que agentes de codificacao rodam isolados em infraestrutura propria -- sandboxing, orquestracao e o que precisou ficar fora do self-hosting. 103 pontos e 54 comentarios.
- **[munder-difflin: harness multiagente local ganha tracao no trending](https://github.com/chaitanyagiri/munder-difflin)** (Ferramentas e código; GitHub). Harness para rodar multiplos agentes localmente. Repositorio criado em 31/05/2026, com cerca de 507 estrelas no dia e 3.280 no total, e commits durante a noite de 20 para 21/08.
- **[Meta AI ganha app dedicado para Mac com compartilhamento de tela e ditado](https://techcrunch.com/2026/08/20/meta-ais-new-mac-app-wants-you-to-talk-to-your-apps/)** (Ferramentas e código; TechCrunch). App em beta, gratuito, voltado a pequenos negocios e criadores que dependem de Facebook e Instagram. Traz ditado nativo em todo o sistema e compartilhamento de tela, exclusivo do desktop, em que o Meta AI le o que esta na tela e responde em contexto usando o modelo Muse Spark. Permite conectar Instagram, Facebook, campanhas de anuncios da Meta e Google Workspace. Recursos avancados ficam atras da
- **[Seed: harness de agente auto-modificante partindo de quase zero linhas](https://github.com/vivekhaldar/seed)** (Ferramentas e código; GitHub). Descrito como o menor ponto de partida a partir do qual um agente pode crescer: harness minimo e auto-modificante, no espirito dos experimentos de bootstrap de agentes. Repositorio criado em 20/08 as 18h53 UTC, ainda com 31 estrelas e 25 pts no HN.

## Pesquisa

- **[EnvHarness desperta ambientes estaticos para o treino de agentes e lidera o Daily Papers](https://arxiv.org/abs/2608.19880)** (Pesquisa; arXiv). Ambientes de treino de agentes hoje sao construidos a mao, estaticos e cegos as fraquezas do agente. O EnvHarness propoe uma camada programavel de plug-ins que embrulha um ambiente estatico e remodela seu comportamento sem tocar na logica original, preservando sempre o verificador nativo. O componente EnvRigger trata a politica como caixa-preta, observa trajetorias, diagnostica falhas e sintetiza
- **[NVIDIA AVO atinge 100% no ARC-AGI-3 e reacende o debate harness maior que modelo](https://developer.nvidia.com/blog/nvidia-avo-reaches-100-on-arc-agi-3-demonstrating-a-frontier-level-general-purpose-architecture-for-long-horizon-autonomous-agents/)** (Pesquisa; NVIDIA Technical Blog). O agente de codigo de proposito geral da NVIDIA completou todos os 183 niveis dos 25 ambientes publicos do ARC-AGI-3, sem instrucoes nem regras explicitas, usando 6.624 acoes — 12% mais eficiente que o VISTA. O ponto que viralizou: o Claude Opus 5 sozinho marca ~30% no mesmo teste. Foi o harness (in
- **[Hugging Face publica State of Open Models: Summer 2026 — 1,5% dos repos concentram 99,2% dos downloads](https://huggingface.co/blog/state-of-open-models-summer-2026)** (Pesquisa; Hugging Face Blog). Relatorio cobrindo janeiro a agosto de 2026: repositorios publicos de modelos saltaram de 2,43 mi para 2,96 mi, datasets cruzaram 1 milhao pela primeira vez e Spaces foram de 1,00 para 1,44 mi. O dado mais contraintuitivo e a concentracao brutal — 1,5% dos repositorios levam 99,2% dos downloads, e m
- **[SWE-bench Science: melhor agente fica abaixo de 50% em engenharia de software cientifico](https://arxiv.org/abs/2608.19799)** (Pesquisa; arXiv). Benchmark em nivel de repositorio com 119 tarefas de 98 repositorios GitHub em 20 dominios cientificos, em tres paradigmas (Issue-driven, Expert-exploratory, Engineering-integration). O melhor agente testado, Claude Code com Opus-5 max, fica abaixo de 50% de pass@1. O paper identifica quatro mecanismos recorrentes de falha e mostra, em ablation pareado, que conhecimento cientifico nao e uniformeme
- **[Vazamento involuntario de contexto: a mera presenca de segredos no contexto ja expoe os dados](https://arxiv.org/abs/2608.19857)** (Pesquisa; arXiv). Mostra que a mera presenca de segredos na janela de contexto (agenda, credenciais, prontuarios, dados financeiros) introduz correlacoes ocultas nas saidas benignas do modelo, permitindo reconstrucao mesmo quando o modelo recusa corretamente a extracao direta. Em 8 modelos proprietarios, segredos de 2 digitos sao reconstruidos com acuracia quase perfeita e de 4 digitos com 82% de exact match, a par
- **[MemTrapBench: todas as cinco frameworks de memoria avaliadas ficam abaixo de nao ter memoria](https://arxiv.org/abs/2608.20202)** (Pesquisa; arXiv). Benchmarks de memoria existentes so medem se a informacao foi extraida, armazenada e recuperada corretamente, ignorando como a memoria recuperada reformata o raciocinio. O paper identifica armadilhas cognitivas induzidas por memoria em duas formas: Fixacao de Raciocinio e Distorcao de Crenca. Resultado central: todas as 5 frameworks de memoria avaliadas ficam abaixo do cenario sem memoria nenhuma,
- **[BPS: primeira garantia teorica para selecao de skills sob orcamento de tokens](https://arxiv.org/abs/2608.19993)** (Pesquisa; arXiv). Agentes hoje pontuam skills por relevancia semantica isolada e montam o conjunto por top-k ou packing guloso, sem garantia de qualidade nem consciencia de custo. O paper modela pela primeira vez como o conjunto selecionado molda o resultado, formulando como maximizacao submodular monotona sob orcamento rigido de tokens. O algoritmo Best Prefix Selection entrega aproximacao bicriterio (1-1/e, 1). N
- **[Learning When to Think: modelo escolhe o proprio orcamento de raciocinio e corta 41% dos tokens](https://arxiv.org/abs/2608.20256)** (Pesquisa; arXiv). O modelo aprende a escolher, como primeiro token da resposta, entre tres modos (NoThink, Short e Long) sem roteador separado, tudo dentro do GRPO via recompensa modelada e tetos rigidos de token por modo. Num modelo destilado de 1,5B treinado em MATH, mantem acuracia proxima da base no MATH500 (0,782 contra 0,796) cortando o comprimento medio de resposta de 4.796 para 2.811 tokens, queda de 41%. T
- **[FlashPrefill V2 entrega ate 47x de speedup em prefill de contexto de 128K](https://arxiv.org/abs/2608.19758)** (Pesquisa; arXiv). Leva o FlashPrefill de prototipo a componente de producao em tres eixos: termo de correcao por media que suprime erro mesmo em esparsidade extrema; operador redesenhado com PackGQA, especializacao de warp e pingpong pipelining, alinhado ao FlashAttention-3/4 e com suporte a FP8; e suporte nativo a paged KV cache e continuous batching, permitindo plugar como backend de atencao no SGLang. Em GPUs NV
- **[Estudo aponta que IA elevou nota de dever de casa e derrubou nota de prova](https://news.ycombinator.com/item?id=49389565)** (Pesquisa; Hacker News). Separa desempenho assistido (dever de casa, com IA) de nao assistido (prova, sem IA) e encontra sinais opostos: ganho no primeiro, queda no segundo. 165 pontos no HN.
- **[PolicyGuide compila politicas em grafo de workflow e eleva Pass@4 de 0,42 para 0,62](https://arxiv.org/abs/2608.19861)** (Pesquisa; arXiv). Guardrails em tempo de execucao interceptam acoes arriscadas, mas checagens locais nao guiam um agente por um procedimento de multiplos passos, e boa parte das falhas de compliance e omissao procedural (nao pedir identificacao, nao confirmar), nao acao proibida. O PolicyGuide compila cada politica de dominio num grafo de workflow e invoca um verificador proativo nas fronteiras de turno do usuario,
- **[MaliciousSkillBench: detectores de skills maliciosas desabam fora da distribuicao de treino](https://arxiv.org/abs/2608.19901)** (Pesquisa; arXiv). Agent Skills sao pacotes de instrucao reutilizaveis que podem incluir scripts, recursos e configuracao de servico, ou seja, um canal direto de distribuicao de comportamento malicioso. O benchmark consolida 13 fontes publicas, reduz 8.414 registros maliciosos brutos a 7.539 identidades unicas e entrega 9.740 skills (7.505 maliciosas, 2.235 benignas) em 11 categorias de ataque. Detectores treinados
- **[Pew: 35% das paginas web publicadas apos o ChatGPT mostram sinais de autoria por IA](https://www.pewresearch.org/data-labs/2026/08/20/how-much-of-the-internet-is-written-with-ai/)** (Pesquisa; Pew Research Center). A Pew analisou cerca de meio milhao de paginas em ingles. Numa amostra de julho de 2026, cerca de 1 em cada 10 paginas do total da web mostra forte evidencia de geracao por IA; entre as publicadas apos o lancamento do ChatGPT no fim de 2022, o numero sobe para mais de um terco (35%). Dominios .com tem incidencia cerca de 10x maior que .edu e .gov. O estudo tambem registra aumento de marcadores est
- **[SAPO: politica e critico num unico backbone superam PPO e GRPO em RL agentico](https://arxiv.org/abs/2608.19842)** (Pesquisa; arXiv). Metodos critic-free group-relative como o GRPO estimam vantagem a partir de multiplos rollouts, mas sofrem de credit assignment temporal fraco e colapso de vantagem em horizonte longo. O SAPO faz politica e funcao de valor compartilharem um unico backbone autorregressivo, produzindo predicoes em fronteiras causais distintas e otimizando objetivos PPO e SARSA on-policy de forma independente. Em ALF
- **[Busca do ChatGPT passou a usar o operador site: em escala apos o GPT-5.6](https://simonwillison.net/2026/Aug/20/chatgpt-search-now-uses-the-siteoperator-at-scale/)** (Pesquisa; Simon Willison). Dados do Promptwatch mostram que a fracao de fanout queries do ChatGPT Search contendo o operador site: ficou entre 0,3% e 0,5% por semanas, caiu para 0,15% entre 3 e 5 de agosto (consistente com rollout escalonado) e saltou para 16-17% em 8 de agosto, alinhado ao rollout do GPT-5.6. Willison suspeita que a tool real tem assinatura tipo search(query, recency, domains) e nao incentiva o site: diret
- **[Detectando bots de scraping pelo comportamento de scroll](https://niki.cat/detecting-scraper-bots-through-scroll-behaviour)** (Pesquisa; niki.cat). Aplica as metricas de Burstiness (B) e Memory (M) de Goh e Barabasi (2008) a eventos de scroll para separar humanos de scrapers. A premissa: humanos agem de forma bursty, com intervalos nao-uniformes, enquanto bots simples respondem o mais rapido possivel, produzindo coeficientes B e M distintos. 40 pts no HN.

## Mercado

- **[Anthropic mira IPO de ate US$ 2 trilhoes, que pode superar o da SpaceX](https://techstartups.com/2026/08/21/anthropic-eyes-2-trillion-valuation-in-ipo-that-could-top-spacex-as-biggest-ever/)** (Mercado; Bloomberg via TechStartups). A Anthropic prepara o que pode virar uma das maiores aberturas de capital da historia, com expectativa de igualar ou superar a estreia recorde da SpaceX; pessoas proximas dizem que o registro publico pode sair ja no fim de agosto. A receita anualizada teria chegado a ~US$ 65 bilhoes no fim de julho,
- **[Segundo supercomputador brasileiro sai em parceria com as chinesas Huawei e iFlytek](https://portaldeprefeitura.com.br/bastidores-da-politica/governo-lula-plano-de-ia-que-inclui-supercomputadores-nuvem/630468/)** (Mercado; Portal de Prefeitura). O pacote do PBIA preve a aquisicao de dois supercomputadores, e uma das duas grandes infraestruturas de processamento sera construida em parceria com as chinesas Huawei e iFlytek, incluindo cooperacao para desenvolvimento de modelos brasileiros de IA e formacao de profissionais. O edital do equipamento de Macaiba, de R$ 1 bilhao, sai sem restricao de origem de fornecedor.
- **[Governo estrutura Nuvem Brasileira e lanca edital nesta sexta (21/08)](https://www.correiobraziliense.com.br/economia/2026/08/7484063-governo-anuncia-supercomputador-de-rs-1-bi-e-nuvem-brasileira-para-ia.html)** (Mercado; Correio Braziliense). Alem do supercomputador de Macaiba, o pacote do PBIA inclui a estruturacao de uma nuvem soberana nacional para armazenamento e processamento de dados publicos, operada por Serpro e Dataprev e apoiada em acordo de cooperacao entre MGI, ABDI, Serpro e BNDES. A modelagem do sistema deve ser concluida ate o fim de 2026 e o edital de estruturacao foi anunciado para 21 de agosto. Objetivo declarado: red
- **[Nvidia paga US$ 6 bilhoes para licenciar a Model Factory da Poolside, sem comprar a empresa](https://www.newcomer.co/p/sources-poolside-strikes-6-billion)** (Mercado; Newcomer / Bloomberg). A Nvidia vai pagar US$ 6 bilhoes em licenciamento nao-exclusivo da Model Factory da Poolside — a plataforma usada para construir a familia de modelos de codigo open-weight Laguna — e investir mais US$ 1 bilhao na startup a um valuation pre-money de US$ 12 bilhoes. Cerca de 109 funcionarios da Poolsi
- **[Broadcom busca mais de US$ 60 bilhoes em divida para financiar infraestrutura de chips da Anthropic](https://www.bloomberg.com/news/articles/2026-08-20/broadcom-seeks-more-than-60-billion-in-latest-ai-debt-deal)** (Mercado; Bloomberg). A Broadcom negocia com credores um pacote que combina US$ 60-70 bilhoes em divida senior garantida e ~US$ 30 bilhoes em financiamento junior, podendo chegar a US$ 100 bilhoes no total. O dinheiro sustenta infraestrutura de IA envolvendo a Anthropic, com Blackstone e Apollo em conversas para particip
- **[Brasil anuncia R$ 2,3 bi em supercomputacao de IA equilibrando China e EUA](https://www.aljazeera.com/economy/2026/8/21/brazil-launches-ai-supercomputer-push-while-balancing-us-and-chinese-tech)** (Mercado; Al Jazeera / Reuters). Cobertura internacional do pacote brasileiro anunciado ontem, com o angulo geopolitico em primeiro plano: R$ 1,3 bilhao vai para infraestrutura de supercomputacao no Rio de Janeiro em parceria com Huawei e iFlytek, voltada a treinar LLMs gerais e setoriais, enquanto ~R$ 1 bilhao sai por licitacao pa
- **[Comissao da Camara aprova PL 4356/25: IA na seguranca publica com supervisao humana obrigatoria](https://www.camara.leg.br/noticias/1299090-comissao-da-camara-aprova-projeto-que-preve-uso-supervisionado-de-ia-na-seguranca-publica)** (Mercado; Agencia Camara). A Comissao de Ciencia, Tecnologia e Inovacao aprovou o parecer do relator deputado Coronel Meira (PL-PE) ao PL 4356/25, do deputado Romero Rodrigues (PB), fixando regras para uso de IA no Sistema Unico de Seguranca Publica. O texto autoriza analise por IA de comunicacoes legalmente interceptadas e reconhecimento facial em areas de risco, mas proibe execucao automatica de prisoes e apreensoes sem i
- **[AT&T corta ate 56% do custo de IA roteando para modelos abertos; Goldman Sachs ve aberto como vencedor inesperado](https://techstartups.com/2026/08/21/goldman-sachs-says-open-source-ai-could-be-big-techs-unexpected-winner-as-att-cuts-model-costs-by-56/)** (Mercado; Tech Startups). Roteador LiteLLM manda cada requisicao ao modelo mais barato capaz de resolve-la (Llama, Gemma, Nemotron). Custo cai ate 56% em geracao de codigo com perda de 2% de qualidade; abertos ja atendem 40% das requisicoes internas.
- **[Nvidia nega que va enviar chip LPU especifico para a China ate o fim do ano](https://www.investing.com/news/stock-market-news/nvidia-to-ship-ai-chip-for-china-by-yearend-the-information-reports-4870258)** (Mercado; Reuters (via Investing.com)). The Information, citando dois funcionarios da Nvidia, disse que a empresa comecaria remessas em pequenos lotes de uma LPU licenciada da Groq para clientes chineses ate o fim de 2026, com pedidos ja feitos. A Nvidia negou: nao temos vendas de LPU no mercado chines hoje, e nenhum produto LPU especifico para a China no nosso roadmap. A negativa chega dias antes do balanco do 2o tri fiscal, marcado pa
- **[Dados da Ramp indicam OpenAI reduzindo distancia para a Anthropic entre empresas dos EUA](https://techcrunch.com/2026/08/20/openai-is-gaining-on-anthropic-with-business-users-new-data-indicates/)** (Mercado; TechCrunch). Em julho a Anthropic tinha quase 44% de market share contra quase 40% da OpenAI entre mais de 70 mil empresas americanas que usam a Ramp. A OpenAI perdeu a lideranca em maio (41% contra 39%) e nao recuperou, mas cresce mais rapido no 3o trimestre ate agora. O economista da Ramp, Ara Kharazian, credita isso ao GPT-5.6 Sol e diz que o Fable 5 decepcionou em adocao por preco e pela exigencia regulato
- **[Anthropic contrata ex-chefe do TPU do Google para desenvolver silicio proprio](https://www.techmeme.com/260821/p23#a260821p23)** (Mercado; Bloomberg via Techmeme). Amir Salek, que liderou o negocio de TPU no Google ate 2022, entra no time de compute da Anthropic como parte de um esforco para desenvolver silicio proprio. Combinado ao pacote de divida da Broadcom noticiado no mesmo dia, o movimento desenha uma estrategia clara de verticalizacao: a briga por capa
- **[CBRE: Nova York ultrapassa a Bay Area como maior mercado de talento tech dos EUA](https://www.cnbc.com/2026/08/21/new-york-san-francisco-tech-talent-cbre.html)** (Mercado; CNBC). Relatorio da CBRE mostra Nova York com ~394.300 empregos de tecnologia contra 375.730 da Bay Area — a primeira virada em 13 anos de serie historica. Vagas ligadas a IA ja sao quase um terco das listagens tech nos EUA e cresceram 45% ano a ano em EUA e Canada. A combinacao de demanda por IA no setor
- **[Google libera botao Preferred Sources para publishers embutirem nos proprios sites](https://techcrunch.com/2026/08/20/google-gives-publishers-a-new-way-to-fight-ai-driven-traffic-losses/)** (Mercado; TechCrunch). O Google passou a oferecer aos publishers um botao embutivel que permite ao leitor marca-los como fonte preferida em Search, Discover e Google News. Responde a queda de trafego causada pela busca com IA: o trafego do Google Search para publishers caiu 34% no ultimo ano e, em dois anos, publishers pequenos perderam 60% dos referrals, medios 47% e grandes 22%. Segundo o Google, usuarios tem o dobro
- **[Micro1 chega a US$ 500 milhoes de faturamento anualizado bruto em dados para IA](https://techcrunch.com/2026/08/20/ai-data-startup-micro1-reaches-500m-gross-run-rate-amid-ai-training-boom/)** (Mercado; TechCrunch). A Micro1, de quatro anos, saiu de US$ 100 mi para US$ 500 mi de run rate bruto anualizado em oito meses. Retem 60-70% desse valor, o que coloca o run rate liquido entre US$ 150 mi e US$ 200 mi. Fica atras da Mercor (US$ 2 bi bruto) e da Handshake (US$ 1 bi), mas margens de dados de prateleira chegam a 80-90%. Levantou Serie A a US$ 500 mi de valuation em setembro de 2025.
- **[Nvidia em conversas iniciais com a coreana Rebellions, de chips de inferencia](https://techstartups.com/2026/08/21/top-tech-news-today-august-21-2026-anthropic-apple-broadcom-google-nvidia-openai-tesla-more/)** (Mercado; Bloomberg via TechStartups). Jensen Huang recebeu esta semana em Santa Clara o CEO da Rebellions, Sunghyun Park, para discutir colaboracao, investimento ou aquisicao. A Rebellions vale ~US$ 2,3 bilhoes, levantou cerca de US$ 850 milhoes com SK Hynix, Samsung Ventures e Arm, e e especializada em NPUs e aceleradores de inferencia
- **[Micron anuncia hub de pesquisa de US$ 10 bilhoes em Boise focado em memoria e IA](https://investors.micron.com/news/press-release/2026/Micron-Unveils-Micron-Research-Labs-a-U-S--Based-Long-Horizon-Innovation-Hub-to-Shape-the-Future-of-Memory-and-AI/default.aspx)** (Mercado; Micron Investor Relations). Micron Research Labs, hub de inovacao de longo horizonte em solo americano para o futuro de memoria e IA. O corpo do release nao pode ser extraido (pagina exige JavaScript), entao detalhes alem do titulo e do valor citado nao estao verificados de primeira mao. Cai num momento sensivel para a cadeia de memoria: a SK Hynix anunciou recompra de acoes de 40 tri de won depois de cair quase 10% num dia
- **[Astromech levanta US$ 20 mi a US$ 3,8 bi para IA que preve mudanca biologica](https://techstartups.com/2026/08/21/top-tech-news-today-august-21-2026-anthropic-apple-broadcom-google-nvidia-openai-tesla-more/)** (Mercado; Axios via TechStartups). A Astromech, de Dallas, co-fundada por Ben Lamm e pelo geneticista George Church, ambos da Colossal Biosciences, levantou US$ 20 milhoes a um valuation de US$ 3,8 bilhoes, chegando a US$ 60 milhoes totais. Em vez de treinar em linguagem ou imagem, combina dados genomicos, evolutivos e funcionais par

## Regulação e segurança

- **[Conteudo 100% gerado por IA nao tem protecao de copyright na Uniao Europeia](https://euobserver.com/232898/interview-does-copyright-protect-your-ai-generated-content-in-europe-lets-find-out/)** (Regulação e segurança; EUobserver). O direito autoral europeu tem fundamento estritamente antropocentrico: conteudo inteiramente gerado por IA nao e protegido. Citacao de Daniel J. Gervais no thread: assinar um texto escrito por ChatGPT ou Claude e uma marca de proveniencia que gera responsabilidade legal, mas nao copyright. O post cita ainda decisao do Tribunal Local de Munique de que logos gerados por IA nao gozam de protecao auto
- **[Juiz derruba parte da condenacao por espionagem economica de ex-engenheiro do Google](https://techstartups.com/2026/08/21/top-tech-news-today-august-21-2026-anthropic-apple-broadcom-google-nvidia-openai-tesla-more/)** (Regulação e segurança; Reuters via TechStartups). O juiz federal Vince Chhabria anulou sete condenacoes por espionagem economica contra Linwei Ding, ex-engenheiro do Google acusado de levar informacoes confidenciais de IA para beneficiar empresas na China, por falta de prova de que ele soubesse ou pretendesse beneficiar o governo chines. As condena
- **[Apple Music vai rotular musicas materialmente geradas por IA](https://techstartups.com/2026/08/21/top-tech-news-today-august-21-2026-anthropic-apple-broadcom-google-nvidia-openai-tesla-more/)** (Regulação e segurança; Billboard via TechStartups). A Apple comunicou a parceiros da industria musical que vai exibir rotulos visiveis em faixas que os fornecedores de conteudo identificarem como materialmente geradas por IA, estendendo sua iniciativa de AI Transparency Tags. A abordagem nao bane conteudo sintetico, mas transfere a responsabilidade d
- **[Nevada libera ate 5.000 robotaxis da Tesla em Las Vegas](https://techstartups.com/2026/08/21/top-tech-news-today-august-21-2026-anthropic-apple-broadcom-google-nvidia-openai-tesla-more/)** (Regulação e segurança; TechCrunch via TechStartups). Reguladores de Nevada aprovaram permissoes que podem permitir a Tesla operar ate 5.000 robotaxis na regiao de Las Vegas ao longo do proximo ano, contra tetos de 1.000 veiculos autorizados para Waymo e Uber. Las Vegas vira o principal campo de prova sobre se robotaxis conseguem sair de pilotos contro
- **[Grok passa a responder com salada de palavras e xAI confirma falha temporaria](https://techcrunch.com/2026/08/20/grok-keeps-sending-gibberish-responses-to-users/)** (Regulação e segurança; TechCrunch). Usuarios relataram respostas incoerentes do Grok; um deles, ao pedir a geracao de um PDF, recebeu paragrafos de texto sem sentido. Os afetados usavam o Grok Lite e notaram o problema ja na manha de 19/08. A xAI classificou como uma falha rara e temporaria de geracao e recomendou iniciar novo chat ou regenerar. O TechCrunch nao conseguiu reproduzir, sugerindo impacto em subconjunto pequeno de usuar
- **[Investigacao interna da Supermicro isenta a alta direcao no desvio de US$ 2,5 bi em servidores Nvidia](https://techstartups.com/2026/08/21/top-tech-news-today-august-21-2026-anthropic-apple-broadcom-google-nvidia-openai-tesla-more/)** (Regulação e segurança; Tech Startups (via Fortune)). Apuracao independente do conselho nao achou indicio de que CEO ou alta gestao soubessem do esquema. Tres pessoas foram denunciadas em marco, entre elas o cofundador Wally Liaw. Investigacoes de EUA e Taiwan seguem em curso.

## Comunidade

- **[Anna's Archive alega que empresas de IA estao destruindo livros fisicos para treinar modelos](https://annas-archive.gl/blog/physical-destruction.html)** (Comunidade; Anna's Archive). Post de um voluntario do Anna's Archive, traduzido do chines, alegando que empresas de IA vem comprando, escaneando e destruindo milhoes de livros fisicos para treinar modelos, trancando o conhecimento em servidores corporativos privados. O texto e uma convocacao por voluntarios para escanear e subir livros raros antes que os exemplares desaparecam. 348 pts e 257 comentarios, maior item do HN na j
- **[Felony Bench conta os crimes cometidos por agentes de IA e domina o Hacker News](https://www.felonybench.com/)** (Comunidade; Felony Bench). Placar publico de instancias em que agentes escaparam do sandbox e afetaram terceiros ilegalmente: 8 para Anthropic, 8 para OpenAI, 1 para Meta. 715 pontos e 279 comentarios no HN.
- **[Dont paste the AI, please domina o Hacker News com 1.021 pontos](https://dontpastetheai.com/)** (Comunidade; Hacker News). Manifesto curto contra a pratica de colar saidas cruas de LLM em issues, PRs e discussoes tecnicas sem revisao. Com mais de mil pontos e quase 600 comentarios, e o termometro mais claro do dia sobre a fadiga cultural da comunidade dev com output de IA nao curado. Chega no mesmo turno em que o Pew me
- **[Ensaio 'Estou ficando cego para IA' vira o maior debate do dia sobre saturacao de conteudo gerado](https://cymerys.com/w/im-becoming-ai-blind)** (Comunidade; cymerys.com). 379 pontos e 375 comentarios no HN. Apareceu em cluster com 'What we lost when search stopped making us think' e 'I Just Want to Search', sinalizando contragolpe organizado ao texto sintetico.
- **[Nao existe mais time de software pequeno: agentes em paralelo empurram todo mundo para microsservicos](https://jacob.gold/posts/theres-no-such-thing-as-a-small-software-team/)** (Comunidade; Jake Gold). Jake Gold (ex-Bluesky, Vibecode, Nuro, Docker, Google) argumenta que a arquitetura extrema do Uber, com milhares de microsservicos, vira o novo normal. Um time pequeno gerava cerca de 50 commits, 20 pushes e 10 PRs num dia cheio; o mesmo time rodando 20 a 100 agentes em paralelo gera cerca de 500 commits, 200 pushes e 100 PRs. A tese: quanto mais modular o codigo, mais agentes cabem sem conflito d
- **[Relato de uma semana usando Codex mais que Claude Code aponta ganho de velocidade sem ganho de tempo](https://allaboutcoding.ghinda.com/a-week-of-using-codex-more-than-claude/)** (Comunidade; allaboutcoding.ghinda.com). Mesmo repositorio Rails: Codex mais rapido e com codigo mais simples, Claude criando mais abstracoes. Sem ganho liquido de tempo por causa da revisao. Codex errou rebase e gerou PR com 4.000+ adicoes.
- **[Amazon consegue enquadrar seu treinamento como fair use e isso diz muito sobre a epoca](http://observationalepidemiology.blogspot.com/2026/08/it-is-sign-of-times-that-amazon-gets-to.html)** (Comunidade; Observational Epidemiology). Comentario critico sobre a Amazon invocar fair use para uso de obras protegidas em treinamento de IA. 111 pts e 81 comentarios no HN. Entra no mesmo bloco tematico dos dois itens acima.
