Radar do FAROL6 notas

quinta-feira, 7 de maio de 2026

Modelos

OpenAI lança GPT-5.5-Cyber em preview limitado para times de cibersegurança vetados

Resposta direta ao Mythos da Anthropic. OpenAI introduz o programa Trusted Access for Cyber (TAC) e libera o GPT-5.5-Cyber — variante do GPT-5.5 com guardrails afrouxados para tarefas defensivas (identificação e triagem de vulnerabilidades, validação de patches, análise de malware). Sam Altman diz que o rollout começa "nos próximos dias"; TAC já vetou "milhares de defensores e centenas de times". Postura mais aberta que a da Anthropic, que mantém Mythos restrito a um clube fechado via Project Glasswing.

Modelos · openai · - openai

Ferramentas e código

Q8 KV cache permite rodar modelo 30B com 100K de contexto numa RTX 5090 24 GB

Tutorial técnico que circulou no HN em 7-mai mostra que com **`--cache-type-k q8_0 --cache-type-v q8_0`** (quantização Q8 do KV cache em llama.cpp/Ollama) dá pra rodar um modelo de **30B parâmetros com 100K tokens de contexto** numa RTX 5090 (32 GB GDDR7, mas algumas variantes vêm com 24 GB). A truque corta a memória do KV cache pela metade com perda mínima de qualidade. Fica muito relevante para fluxos de coding agent local — Claude Code/equivalente — onde contextos longos mandam.

Ferramentas e código · hacker-news · - local-llm

Simon Willison libera llm-gemini 0.31: Gemini 3 + YouTube URL como anexo

Simon Willison shippou em 7-mai o `llm-gemini 0.31`, plugin para o CLI `llm` que agora suporta **Gemini 3** e — mais importante — aceita **URLs do YouTube como anexo** para o Gemini analisar o vídeo direto na linha de comando. Também promove o `Gemini 3.1 Flash-Lite` para release estável (saiu de preview). Pequena release, grande utilidade prática para quem usa pipelines CLI de análise de vídeo.

Ferramentas e código · simonwillison-blog · - simon-willison

Pesquisa

Meta libera NeuralBench — benchmark NeuroAI com 36 tarefas EEG e 94 datasets

Meta AI Research publica NeuralBench — framework open-source que padroniza avaliacao de modelos NeuroAI: 36 tarefas EEG, 94 datasets, 9.478 sujeitos, 13.603 horas de EEG, 14 arquiteturas DL comparaveis. Resolve fragmentacao historica do campo.

Pesquisa · marktechpost · meta, neuroai, eeg, benchmark, neuralbench, open-source

Apple LaDiR: difusão latente eleva LLMs em raciocínio com exploração paralela de trajetórias

Apple Machine Learning Research publicou o LaDiR (**Latent Diffusion Reasoner**) — framework que une representação latente contínua + refinamento iterativo via difusão a um LLM existente. Funciona assim: um VAE codifica passos de raciocínio em "thought tokens" no espaço latente; difusão refina iterativamente; geração autoregressiva produz a resposta final. Roda **múltiplas trajetórias de raciocínio em paralelo**, com mecanismo que empurra para diversidade — gerando um conjunto diverso de respostas candidatas. Aplicado a LLaMA 3.1 8B (matemática, planejamento) e Qwen3-8B-Base (geração de código). Aceito em workshop ICLR 2026 ("Latent & Implicit Thinking — Going Beyond CoT Reasoning"). Bate com a tendência de "chain-of-thought morre, raciocínio paralelo nasce".

Pesquisa · apple-ml-research · - apple

Comunidade

Microsoft eleva CapEx 2026 para US$ 190B e bate US$ 37B/ano em receita de IA (+123% YoY)

Microsoft anuncia +US$ 25B em CapEx (total US$ 190B/ano), receita de IA em US$ 37B run-rate (+123% YoY). 24/7 Wall St argumenta que abstinencia da Apple parece sabia diante de pushback crescente de usuarios contra Copilot.

Comunidade · 247wallst · microsoft, capex, copilot, revenue, ai-economy, msft