# Radar do FAROL · quinta-feira, 7 de maio de 2026

6 notícias. Dados: https://radar.farolia.org/dados/dia/2026-05-07.json

## Modelos

- **[OpenAI lança GPT-5.5-Cyber em preview limitado para times de cibersegurança vetados](https://openai.com/index/gpt-5-5-with-trusted-access-for-cyber/)** (Modelos; openai). Resposta direta ao Mythos da Anthropic. OpenAI introduz o programa Trusted Access for Cyber (TAC) e libera o GPT-5.5-Cyber — variante do GPT-5.5 com guardrails afrouxados para tarefas defensivas (identificação e triagem de vulnerabilidades, validação de patches, análise de malware). Sam Altman diz que o rollout começa "nos próximos dias"; TAC já vetou "milhares de defensores e centenas de times". Postura mais aberta que a da Anthropic, que mantém Mythos restrito a um clube fechado via Project Glasswing.

## Ferramentas e código

- **[Q8 KV cache permite rodar modelo 30B com 100K de contexto numa RTX 5090 24 GB](https://buraak.com/blog/local-llm-on-rtx-5090.html)** (Ferramentas e código; hacker-news). Tutorial técnico que circulou no HN em 7-mai mostra que com **`--cache-type-k q8_0 --cache-type-v q8_0`** (quantização Q8 do KV cache em llama.cpp/Ollama) dá pra rodar um modelo de **30B parâmetros com 100K tokens de contexto** numa RTX 5090 (32 GB GDDR7, mas algumas variantes vêm com 24 GB). A truque corta a memória do KV cache pela metade com perda mínima de qualidade. Fica muito relevante para fluxos de coding agent local — Claude Code/equivalente — onde contextos longos mandam.
- **[Simon Willison libera llm-gemini 0.31: Gemini 3 + YouTube URL como anexo](https://simonwillison.net/2026/May/7/llm-gemini/)** (Ferramentas e código; simonwillison-blog). Simon Willison shippou em 7-mai o `llm-gemini 0.31`, plugin para o CLI `llm` que agora suporta **Gemini 3** e — mais importante — aceita **URLs do YouTube como anexo** para o Gemini analisar o vídeo direto na linha de comando. Também promove o `Gemini 3.1 Flash-Lite` para release estável (saiu de preview). Pequena release, grande utilidade prática para quem usa pipelines CLI de análise de vídeo.

## Pesquisa

- **[Meta libera NeuralBench — benchmark NeuroAI com 36 tarefas EEG e 94 datasets](https://www.marktechpost.com/2026/05/07/meta-ai-releases-neuralbench-a-unified-open-source-framework-to-benchmark-neuroai-models-across-36-eeg-tasks-and-94-datasets/)** (Pesquisa; marktechpost). Meta AI Research publica NeuralBench — framework open-source que padroniza avaliacao de modelos NeuroAI: 36 tarefas EEG, 94 datasets, 9.478 sujeitos, 13.603 horas de EEG, 14 arquiteturas DL comparaveis. Resolve fragmentacao historica do campo.
- **[Apple LaDiR: difusão latente eleva LLMs em raciocínio com exploração paralela de trajetórias](https://machinelearning.apple.com/research/ladir)** (Pesquisa; apple-ml-research). Apple Machine Learning Research publicou o LaDiR (**Latent Diffusion Reasoner**) — framework que une representação latente contínua + refinamento iterativo via difusão a um LLM existente. Funciona assim: um VAE codifica passos de raciocínio em "thought tokens" no espaço latente; difusão refina iterativamente; geração autoregressiva produz a resposta final. Roda **múltiplas trajetórias de raciocínio em paralelo**, com mecanismo que empurra para diversidade — gerando um conjunto diverso de respostas candidatas. Aplicado a LLaMA 3.1 8B (matemática, planejamento) e Qwen3-8B-Base (geração de código). Aceito em workshop ICLR 2026 ("Latent & Implicit Thinking — Going Beyond CoT Reasoning"). Bate com a tendência de "chain-of-thought morre, raciocínio paralelo nasce".

## Comunidade

- **[Microsoft eleva CapEx 2026 para US$ 190B e bate US$ 37B/ano em receita de IA (+123% YoY)](https://247wallst.com/investing/2026/05/07/apples-ai-restraint-looks-smart-as-microsoft-spends-190b-on-ai-despite-user-pushback/)** (Comunidade; 247wallst). Microsoft anuncia +US$ 25B em CapEx (total US$ 190B/ano), receita de IA em US$ 37B run-rate (+123% YoY). 24/7 Wall St argumenta que abstinencia da Apple parece sabia diante de pushback crescente de usuarios contra Copilot.
