# Radar do FAROL · domingo, 10 de maio de 2026

41 notícias. Dados: https://radar.farolia.org/dados/dia/2026-05-10.json

## Modelos

- **[Claude Opus 4.7 lança em GA — ganho forte em vision (alta resolução) e tarefas de coding longas, preço estável em $5/$25](https://www.anthropic.com/news/claude-opus-4-7)** (Modelos; web-search). Anthropic disponibilizou em GA o Claude Opus 4.7. Melhorias específicas em engenharia de software (tarefas longas de coding) e em visão (imagens em resolução mais alta). Preço se mantém em US$ 5/M input e US$ 25/M output, igual ao 4.6 — sinal de que o ganho é de qualidade, não de escala bruta.
- **[Gemini API File Search agora é multimodal: imagens + texto, citações por página, RAG verificável](https://blog.google/innovation-and-ai/technology/developers-tools/expanded-gemini-api-file-search-multimodal-rag/)** (Modelos; web-search). Google ampliou o File Search da API Gemini com três features importantes para RAG produtivo: indexação multimodal (imagens + texto via Gemini Embedding 2), metadata customizada e citações com nível de página — tudo embutido no managed service, sem precisar montar pipeline próprio.
- **[OpenAI lança trio de voz na API: GPT-Realtime-2, GPT-Realtime-Translate (tradução de fala em tempo real) e GPT-Realtime-Whisper (transcrição streaming)](https://releasebot.io/updates/openai)** (Modelos; web-search). OpenAI publicou três novos modelos de voz no realtime API: GPT-Realtime-2 (raciocínio em conversa ao vivo), GPT-Realtime-Translate (tradução simultânea de fala) e GPT-Realtime-Whisper (transcrição em streaming). Stack completa para construir agentes de voz multilíngues com latência baixa.
- **[Anthropic lança Claude Security (scan + fix de vulnerabilidades) e Claude Design (visuais, slides, protótipos) em beta com Opus 4.7](https://releasebot.io/updates/anthropic)** (Modelos; web-search). Claude Security entra em public beta para clientes Enterprise, escaneando código por vulnerabilidades e gerando fixes propostos com Opus 4.7. Em paralelo, Claude Design — produto novo do Anthropic Labs — permite colaborar com Claude na produção de designs, protótipos, slides e one-pagers.
- **[Sulphur-2-base é o modelo mais trending do Hugging Face: text-to-video, 144 mil downloads em uma semana, GGUF disponível](https://hf.co/SulphurAI/Sulphur-2-base)** (Modelos; huggingface). Sulphur-2-base (SulphurAI), lançado em 3 de maio, é o modelo #1 em trending score no Hugging Face Hub: text-to-video aberto, baseado em diffusers, 144 mil downloads em poucos dias e GGUF disponível. Promete competir com Sora, Veo e Kling no espaço de geração de vídeo open.
- **[OpenAI promove GPT-5.5 Instant a novo default do ChatGPT — alegação de redução de halucinação >50% em cenários high-stakes e uso de Gmail/Drive/chats passados](https://www.marketingprofs.com/opinions/2026/54655/ai-update-may-8-2026-ai-news-and-views-from-the-past-week)** (Modelos; web-search). OpenAI substituiu o default do ChatGPT por GPT-5.5 Instant — variante mais rápida da família 5.5, com foco em personalização e contexto. Alegação central: redução >50% de claims halucinados em cenários high-stakes e capacidade ampliada de usar chats passados, arquivos enviados e serviços conectados (Gmail, Drive).
- **[Qwopus3.6-35B-A3B-v1-GGUF: merge experimental Qwen3.6 + Opus thinking aterrissa local-first com GGUF](https://hf.co/Jackrong/Qwopus3.6-35B-A3B-v1-GGUF)** (Modelos; huggingface). Modelo experimental publicado por Jackrong na HF combina backbone Qwen3.6 35B-A3B com camadas reasoning/CoT estilo Claude Opus, distribuído já em GGUF para llama.cpp. Multimodal (vision), tool-use, function-calling, long-context, EN/ZH/ES/RU — 53k downloads em poucos dias.
- **[CTONE lança 'Agent Computer' em Shenzhen: PCs com 200+ skill-agents on-device, parceria SenseTime + Alibaba Cloud](https://www.prnewswire.com/news-releases/ctone-group-unveils-ai-strategy-and-new-agent-computer-series-302767499.html)** (Modelos; web-search). Ex-líder global em Mini PCs, CTONE realiza evento em Shenzhen anunciando reposicionamento como 'construtor do ecossistema de computação por agentes' — três linhas de Agent Computer: entry-level com 200+ agents da SenseTime, mid-tier com edge-cloud Alibaba, profissional para grandes modelos on-device.
- **[Zyphra/ZAYA1-8B: novo LLM da Zyphra debuta entre os top trending do HF (367 likes, 45k downloads) com arquitetura própria 'Zaya](https://hf.co/Zyphra/ZAYA1-8B)** (Modelos; huggingface). Zyphra publicou ZAYA1-8B em 4 de maio — arquitetura custom batizada 'Zaya' (não é Transformer puro), licença Apache 2.0, eval-results no card. Em uma semana acumulou 367 likes e 45 mil downloads. Referência: arXiv 2605.05365.
- **[HiDream-ai/HiDream-O1-Image: novo image-text-to-image baseado em Qwen3-VL, 179 likes em 2 dias](https://hf.co/HiDream-ai/HiDream-O1-Image)** (Modelos; huggingface). HiDream-O1-Image foi publicado em 8 de maio: image-text-to-image baseado em Qwen3-VL, licença MIT. Acumulou 179 likes em 2 dias. Promete edição multimodal com instrução natural — competidor direto de Flux.1-Kontext.

## Ferramentas e código

- **[Qualcomm CEO: OpenAI, Meta e outros estão construindo wearables com agentes que substituem o smartphone](https://fortune.com/2026/05/09/qualcomm-smartphone-ai-secret-device-openai-meta-wearables-agents/)** (Ferramentas e código; web-search). Cristiano Amon (CEO Qualcomm) confirma que está trabalhando com 'praticamente todos' os grandes players de IA em dispositivos wearable secretos — óculos, joias, broches, pingentes — projetados para um mundo onde o centro da vida digital é um agente autônomo, não mais um smartphone.
- **[Anthropic abre 10 templates de agentes financeiros, integração total com Microsoft 365 e parceria de dados com a Moody's](https://fortune.com/2026/05/05/anthropic-wall-street-financial-services-agents-jamie-dimon/)** (Ferramentas e código; web-search). Anthropic mira Wall Street com 10 agentes prontos para o trabalho mais consumidor de tempo em finanças — pitchbooks, KYC, fechamento mensal, credit memos. Cada um vai como plugin no Claude Cowork/Claude Code e como cookbook no Managed Agents. Soma-se integração completa com Microsoft 365 e dados da Moody's, com endosso público de Jamie Dimon.
- **[antirez/ds4: motor de inferência DeepSeek 4 Flash em Metal (Apple Silicon) — 5300 stars em poucos dias](https://github.com/antirez/ds4)** (Ferramentas e código; github-trending). Salvatore Sanfilippo (antirez, criador do Redis) publicou um motor de inferência local para DeepSeek 4 Flash escrito direto em Metal Performance Shaders — Apple Silicon nativo, sem CUDA, sem llama.cpp. Já passou de 5,3k estrelas em poucos dias.
- **[openai/privacy-filter no HF passa de 1,3 mil likes e 185 mil downloads — modelo open de OpenAI para PII filtering on-device](https://hf.co/openai/privacy-filter)** (Ferramentas e código; huggingface). OpenAI publicou 'privacy-filter' no Hugging Face — modelo de token-classification para identificar e mascarar PII (nomes, e-mails, documentos, cartões). Licença Apache 2.0, formatos ONNX e safetensors, suporte transformers.js (roda no browser). Acumulou 1.394 likes e 185 mil downloads desde 17 de abril.
- **[Academic Research Skills for Claude Code — repo viraliza no HN (72 pts) com skills prontas para pesquisa acadêmica em Claude Code](https://github.com/Imbad0202/academic-research-skills)** (Ferramentas e código; hackernews). Repo Imbad0202/academic-research-skills compila um pacote de skills para Claude Code voltado a pesquisa acadêmica — busca de literatura, leitura crítica, síntese, citação correta, geração de relatórios. Pegou 72 pontos no HN. Vale comparar com sua skill `pesquisa-profunda` e `deep-research-wshuyi`.
- **[strukto-ai/mirage: Unified Virtual Filesystem for AI Agents — VFS abstraindo S3, GCS, OneDrive, GitHub para skills](https://github.com/strukto-ai/mirage)** (Ferramentas e código; github-trending). Mirage é um virtual filesystem unificado pensado para ser exposto a agentes via MCP/skills: o agente faz ls, read, write num único namespace e por baixo o Mirage roteia para S3, Google Drive, OneDrive, Dropbox, GitHub, Notion etc. Subiu para ~1700 stars rapidamente.
- **[IBM Think 2026: nova geração do watsonx Orchestrate (multi-agent), IBM Confluent (dados em real-time), IBM Concert (intelligent operations) e IBM Sovereign Core](https://newsroom.ibm.com/2026-05-05-think-2026-ibm-delivers-the-blueprint-for-the-ai-operating-model-as-the-ai-divide-widens)** (Ferramentas e código; web-search). No Think 2026, IBM anunciou seu pacote mais amplo até agora para AI corporativa híbrida: nova geração do watsonx Orchestrate com orquestração multi-agente, IBM Confluent (dados real-time para IA), IBM Concert (ops inteligentes) e IBM Sovereign Core (independência operacional). Empresa enquadrou o conjunto como 'blueprint do AI Operating Model'.
- **[lightseekorg/tokenspeed: motor de inferência LLM 'speed-of-light' aposta em fusão de kernels e batching agressivo](https://github.com/lightseekorg/tokenspeed)** (Ferramentas e código; github-trending). Mais um motor de inferência LLM que se apresenta como 'speed-of-light' — segue tendência do nano-vLLM, sgl-router e MiniInfer: focar em throughput máximo via fusão agressiva de kernels CUDA e batching dinâmico. ~880 estrelas.
- **[vect-G/lecture-to-hw: skill do Codex que transforma aula gravada + arquivos da disciplina em homework — 76 stars em dias](https://github.com/vect-G/lecture-to-hw)** (Ferramentas e código; github). Skill para Codex (OpenAI) que pega gravação de aula + arquivos do curso (slides, código, leituras) e gera lista de exercícios. Pegou 76 stars em poucos dias. Padrão típico de skill educacional que combina transcrição, sumarização e geração de tarefas adaptadas ao nível do material.
- **[MachinaCheck: case do AMD Developer Hackathon mostra sistema multi-agente para manufatura CNC rodando em GPUs MI300X](https://huggingface.co/blog/lablab-ai-amd-developer-hackathon/machinacheck)** (Ferramentas e código; huggingface). Time MachinaCheck publicou case no blog do Hugging Face: sistema multi-agente que avalia 'manufaturabilidade' de uma peça CNC a partir do CAD. Roda em GPUs AMD MI300X — vencedor do hackathon AMD x lablab.ai. Sinal claro: AMD ganhando tração no enterprise como alternativa à NVIDIA.

## Pesquisa

- **[Cited but Not Verified: agentes de Deep Research citam fontes que não respaldam a afirmação em ~30% dos casos](https://arxiv.org/abs/2605.06635)** (Pesquisa; arxiv). Paper de 7 de maio audita as citações geradas por Deep Research da OpenAI, Gemini Deep Research Max, Perplexity Pro e research skills do Claude. Achado: ~30% das fontes citadas não suportam a afirmação que acompanham — citação existe e é real, mas o conteúdo da fonte não fala daquilo.
- **[SkillOS (arXiv 2605.06649): agente aprende a curar a própria biblioteca de skills — incluir, fundir, descartar — em ciclo auto-evolutivo](https://arxiv.org/abs/2605.06649)** (Pesquisa; arxiv). Paper propõe SkillOS: framework em que o agente IA não só usa skills, mas decide quais skills criar, quais fundir e quais descartar. Auto-curadoria de biblioteca de habilidades baseada em frequência de uso, taxa de sucesso e overlap semântico. Ressonância direta com o modelo de skills do Claude Code e Cowork.
- **[Recursive Agent Optimization (arXiv 2605.06645): agente otimiza a si próprio em loop de auto-melhoramento — sem nova rodada de fine-tuning](https://arxiv.org/abs/2605.06645)** (Pesquisa; arxiv). Paper propõe Recursive Agent Optimization (RAO): o agente examina as próprias trajetórias passadas, identifica gargalos no próprio prompt-system e propõe edições recursivas. Cada iteração otimiza o próprio otimizador. Auto-melhoramento sem fine-tuning, só com edição de instruções.
- **[ActCam (arXiv 2605.06633): controle zero-shot conjunto de câmera + movimento 3D em vídeo gerado — sem precisar treinar modelo novo](https://arxiv.org/abs/2605.06633)** (Pesquisa; arxiv). Paper de 7/5 propõe ActCam — método zero-shot para controlar simultaneamente movimento de câmera (pan, dolly, orbit) e movimento 3D dos objetos em modelos de geração de vídeo. Vantagem: sem fine-tuning, sem dataset proprietário. Encaixa em cima de Sora, Veo, Sulphur-2.
- **[Superintelligent Retrieval Agent: 'IR já é commodity, o gargalo agora é planejamento, busca e síntese](https://arxiv.org/abs/2605.06647)** (Pesquisa; arxiv). Paper de 7 de maio argumenta que retrieval clássico (BM25, embeddings) virou commodity e que a próxima fronteira é o 'agente de retrieval superinteligente' — capaz de planejar buscas, descompor questões, executar passos paralelos e sintetizar com auditoria explícita.
- **[Patch2Vuln (arXiv 2605.06658): agente reconstrói vulnerabilidades a partir de patches binários de distribuições Linux — security research automatizada](https://arxiv.org/abs/2605.06658)** (Pesquisa; arxiv). Paper de 7/5 propõe Patch2Vuln — agente que olha o patch binário de uma distribuição Linux, identifica a função alterada, infere a vulnerabilidade original e reconstrói um PoC (proof-of-concept) plausível. Pesquisa de segurança 100% automatizada — útil para defesa e, inevitavelmente, para ofensa.
- **[StraTA: incentivar agentic RL com 'Strategic Trajectory Abstraction' — agente aprende a abstrair próprias trajetórias e generalizar](https://arxiv.org/abs/2605.06642)** (Pesquisa; arxiv). Paper de 7 de maio propõe que agentes de RL aprendam não só a executar, mas a abstrair as próprias trajetórias bem-sucedidas em 'estratégias' reutilizáveis — espécie de meta-skill auto-induzida que melhora generalização para novas tarefas.
- **[AI Co-Mathematician (arXiv 2605.06640): IA agentic para acelerar matemáticos profissionais — não substituir, mas amplificar](https://arxiv.org/abs/2605.06640)** (Pesquisa; arxiv). Paper de 7/5 documenta uso real de agente IA como 'co-matemático' — não como autoresolveddor, mas como par de raciocínio que aceita conjecturas, propõe lemas, gera contraexemplos e organiza prova. Casa com a nova onda de papers tipo 'lean + LLM' e com o trabalho do Terence Tao usando Claude/Gemini.

## Comunidade

- **[Apple prepara virada: Apple Intelligence em iOS 27 / iPadOS 27 / macOS 27 deve permitir escolher Google ou Anthropic como provider](https://www.marketingprofs.com/opinions/2026/54655/ai-update-may-8-2026-ai-news-and-views-from-the-past-week)** (Comunidade; web-search). Vazamento aponta que a Apple vai abrir Apple Intelligence — em iOS 27, iPadOS 27 e macOS 27 — para múltiplos providers de IA, com Google (Gemini) e Anthropic (Claude) já citados como opções além da OpenAI. Movimento desfaz a exclusividade que vinha sendo lida como vitória da OpenAI no consumer.
- **[Anthropic fecha com SpaceX para usar 300 MW do Colossus 1 (≈220 mil GPUs NVIDIA) e dobra rate limits de Pro, Max, Team e Enterprise](https://releasebot.io/updates/anthropic)** (Comunidade; web-search). Anthropic vai consumir TODA a capacidade do data center Colossus 1 da SpaceX — 300 MW novos (~220 mil GPUs NVIDIA) em poucas semanas. Com o reforço, a empresa dobrou rate limits de Pro, Max, Team e Enterprise por assento e eliminou as reduções de horário de pico para Pro e Max.
- **[Local AI needs to be the norm' viraliza no HN (370 pts) — manifesto pelo deslocamento de inferência LLM para máquinas pessoais](https://unix.foo/posts/local-ai-needs-to-be-norm/)** (Comunidade; hackernews). Post 'Local AI needs to be the norm' acumulou 370 pontos no HN nas últimas 24h. Argumenta que dependência de APIs (OpenAI, Anthropic) é frágil — privacidade, custo, latência, censura, soberania — e que com Qwen3.6, Llama-4 e similares já é viável rodar tudo localmente para a maioria dos use cases.
- **[Hinton volta a alertar na CNN: IA vai substituir 'muitos, muitos empregos](https://thehill.com/policy/technology/5664662-ai-risks-hinton-warns/)** (Comunidade; thehill). Geoffrey Hinton, em entrevista no State of the Union da CNN (10/5), diz estar 'mais preocupado' com IA do que dois anos atras, citando ganhos em raciocinio e capacidade de engano, e que tamanho de tarefa duplica a cada ~7 meses.
- **[Cidadãos de Maryland pagarão US$ 2 bilhões em upgrade de grid elétrico para sustentar data centers de IA do interior — protesto formal ao FERC](https://www.tomshardware.com/tech-industry/artificial-intelligence/maryland-citizens-slapped-with-usd2-billion-grid-upgrade-bill-for-out-of-state-ai-data-centers-state-complains-to-federal-energy-regulators-says-additional-cost-breaks-ratepayer-protection-pledge-promises)** (Comunidade; hackernews). Estado de Maryland protestou formalmente ao FERC (Federal Energy Regulatory Commission): residentes terão US$ 2 bilhões adicionados na conta de luz para custear upgrade de transmissão necessário para sustentar data centers de IA construídos em estados vizinhos (PA, VA, OH). Quebra a 'ratepayer protection pledge' formal — IA consumindo subsídio cruzado dos cidadãos.
- **[Zuckerberg comunica aos 8 mil demitidos da Meta: layoffs são 'um line item' nos US$ 145 bi de capex em IA](https://247wallst.com/investing/2026/05/08/mark-zuckerberg-just-told-8000-employees-their-layoffs-are-a-line-item-in-his-145-billion-ai-bill/)** (Comunidade; web-search). Mark Zuckerberg disse a oito mil funcionários demitidos que os cortes são apenas 'um item de linha' no orçamento de US$ 145 bilhões da Meta em infraestrutura de IA — narrativa que corta e mostra o trade-off cru entre folha e capex em GPUs.
- **[Alphabet sobe 160% em 1 ano puxado por dominio de quase toda a stack de IA](https://www.cnbc.com/2026/05/10/alphabet-160percent-rally-in-year-reflects-value-of-owning-most-of-ai-stack.html)** (Comunidade; cnbc). Alphabet bate recorde de alta — +160% em 12 meses — puxado por integracao TPU + Gemini + Workspace + Cloud. Tese de 'IA full-stack' (silicio proprio, modelo proprio, distribuicao propria) volta a se valorizar vs. players verticais.
- **[Sam Altman: jovens usam ChatGPT como 'sistema operacional de vida](https://www.hokanews.com/2026/05/sam-altman-says-young-people-use.html)** (Comunidade; hokanews). Altman afirma que jovens (universitarios e Gen Z) tratam ChatGPT como 'sistema operacional de vida' integrado a workflow academico, arquivos pessoais, Gmail/Drive e tarefas diarias. Tese de plataforma-de-vida vs. assistente.
- **[IA lidera como motivo declarado de layoffs em abril (Challenger Gray)](https://www.cnn.com/2026/05/10/tech/ai-taking-jobs)** (Comunidade; cnn). Relatorio mensal Challenger Gray & Christmas: pelo segundo mes consecutivo, 'IA' aparece como motivo declarado #1 para layoffs nos EUA. CNN argumenta que efeito real ainda e indireto — substituicao de contratacoes, nao demissoes diretas.
- **[Gen Z aumenta ressentimento contra IA: adoção estagna e medo de perder emprego cresce (relatório Walton Foundation)](https://www.waltonfamilyfoundation.org/about-us/newsroom/gen-z-resentment-toward-ai-grows-as-adoption-stagnates-and-workplace-fears-mount)** (Comunidade; web-search). Pesquisa da Walton Family Foundation publicada em 9 de maio mostra que jovens da Gen Z (16–28 anos) estão cada vez mais resistentes a IA: adoção pessoal estagnou, e o medo de impacto no mercado de trabalho cresceu de forma marcante em 12 meses.
- **[Interrupt 2026 (LangChain) confirma agenda 13-14/05 — agentes enterprise no centro](https://www.langchain.com/blog/previewing-interrupt-2026-agents-at-enterprise-scale)** (Comunidade; langchain). LangChain divulga agenda do Interrupt 2026 (13-14/5 em SF) com keynotes de Harrison Chase, Andrew Ng, Aaron Levie. AMAs sobre LangSmith, Deep Agents, LangGraph; workshops focados em agentes enterprise saindo de PoC.
- **[Claude Does Not Actually Taste Bananas': post do LessWrong investiga fenomenologia sintética baseada em potássio nos LLMs](https://www.lesswrong.com/posts/claude-does-not-actually-taste-bananas)** (Comunidade; lesswrong). Post do LessWrong argumenta que quando o Claude descreve 'sensação' de comer banana, está ativando padrões linguísticos vinculados a potássio, doçura, textura — mas não está experimentando qualia em sentido forte. Investigação cuidadosa do que é 'fenomenologia sintética' em LLMs.
- **[Snap e Perplexity encerram parceria de US$ 400 milhões antes do rollout — 'separação amigável' no Q1/2026](https://www.marketingprofs.com/opinions/2026/54655/ai-update-may-8-2026-ai-news-and-views-from-the-past-week)** (Comunidade; web-search). Snap confirmou que a parceria anunciada de US$ 400 milhões com a Perplexity foi 'encerrada amigavelmente' no Q1/2026, antes mesmo de chegar a um rollout amplo. Sinaliza dificuldade de Perplexity em monetizar via embed em apps de terceiros.
