Radar do FAROL41 notas

domingo, 10 de maio de 2026

Modelos

Claude Opus 4.7 lança em GA — ganho forte em vision (alta resolução) e tarefas de coding longas, preço estável em $5/$25

Anthropic disponibilizou em GA o Claude Opus 4.7. Melhorias específicas em engenharia de software (tarefas longas de coding) e em visão (imagens em resolução mais alta). Preço se mantém em US$ 5/M input e US$ 25/M output, igual ao 4.6 — sinal de que o ganho é de qualidade, não de escala bruta.

Modelos · web-search · anthropic, claude, opus, model-release, vision, coding

Gemini API File Search agora é multimodal: imagens + texto, citações por página, RAG verificável

Google ampliou o File Search da API Gemini com três features importantes para RAG produtivo: indexação multimodal (imagens + texto via Gemini Embedding 2), metadata customizada e citações com nível de página — tudo embutido no managed service, sem precisar montar pipeline próprio.

Modelos · web-search · google, gemini, file-search, rag, multimodal, citations

OpenAI lança trio de voz na API: GPT-Realtime-2, GPT-Realtime-Translate (tradução de fala em tempo real) e GPT-Realtime-Whisper (transcrição streaming)

OpenAI publicou três novos modelos de voz no realtime API: GPT-Realtime-2 (raciocínio em conversa ao vivo), GPT-Realtime-Translate (tradução simultânea de fala) e GPT-Realtime-Whisper (transcrição em streaming). Stack completa para construir agentes de voz multilíngues com latência baixa.

Modelos · web-search · openai, voice, realtime, whisper, translate, api

Anthropic lança Claude Security (scan + fix de vulnerabilidades) e Claude Design (visuais, slides, protótipos) em beta com Opus 4.7

Claude Security entra em public beta para clientes Enterprise, escaneando código por vulnerabilidades e gerando fixes propostos com Opus 4.7. Em paralelo, Claude Design — produto novo do Anthropic Labs — permite colaborar com Claude na produção de designs, protótipos, slides e one-pagers.

Modelos · web-search · anthropic, claude-security, claude-design, security, design, opus-4-7

Sulphur-2-base é o modelo mais trending do Hugging Face: text-to-video, 144 mil downloads em uma semana, GGUF disponível

Sulphur-2-base (SulphurAI), lançado em 3 de maio, é o modelo #1 em trending score no Hugging Face Hub: text-to-video aberto, baseado em diffusers, 144 mil downloads em poucos dias e GGUF disponível. Promete competir com Sora, Veo e Kling no espaço de geração de vídeo open.

Modelos · huggingface · huggingface, text-to-video, sulphur, diffusers, gguf

OpenAI promove GPT-5.5 Instant a novo default do ChatGPT — alegação de redução de halucinação >50% em cenários high-stakes e uso de Gmail/Drive/chats passados

OpenAI substituiu o default do ChatGPT por GPT-5.5 Instant — variante mais rápida da família 5.5, com foco em personalização e contexto. Alegação central: redução >50% de claims halucinados em cenários high-stakes e capacidade ampliada de usar chats passados, arquivos enviados e serviços conectados (Gmail, Drive).

Modelos · web-search · openai, chatgpt, gpt-5-5, default-model, hallucination, personalization

Qwopus3.6-35B-A3B-v1-GGUF: merge experimental Qwen3.6 + Opus thinking aterrissa local-first com GGUF

Modelo experimental publicado por Jackrong na HF combina backbone Qwen3.6 35B-A3B com camadas reasoning/CoT estilo Claude Opus, distribuído já em GGUF para llama.cpp. Multimodal (vision), tool-use, function-calling, long-context, EN/ZH/ES/RU — 53k downloads em poucos dias.

Modelos · huggingface · huggingface, qwen, opus, gguf, moe, reasoning

CTONE lança 'Agent Computer' em Shenzhen: PCs com 200+ skill-agents on-device, parceria SenseTime + Alibaba Cloud

Ex-líder global em Mini PCs, CTONE realiza evento em Shenzhen anunciando reposicionamento como 'construtor do ecossistema de computação por agentes' — três linhas de Agent Computer: entry-level com 200+ agents da SenseTime, mid-tier com edge-cloud Alibaba, profissional para grandes modelos on-device.

Modelos · web-search · ctone, agent-computer, sensetime, alibaba-cloud, hardware-ai, edge-ai

Zyphra/ZAYA1-8B: novo LLM da Zyphra debuta entre os top trending do HF (367 likes, 45k downloads) com arquitetura própria 'Zaya

Zyphra publicou ZAYA1-8B em 4 de maio — arquitetura custom batizada 'Zaya' (não é Transformer puro), licença Apache 2.0, eval-results no card. Em uma semana acumulou 367 likes e 45 mil downloads. Referência: arXiv 2605.05365.

Modelos · huggingface · zyphra, zaya, llm-8b, open-source, eval-results

HiDream-ai/HiDream-O1-Image: novo image-text-to-image baseado em Qwen3-VL, 179 likes em 2 dias

HiDream-O1-Image foi publicado em 8 de maio: image-text-to-image baseado em Qwen3-VL, licença MIT. Acumulou 179 likes em 2 dias. Promete edição multimodal com instrução natural — competidor direto de Flux.1-Kontext.

Modelos · huggingface · hidream, image-generation, qwen3-vl, multimodal, text-to-image

Ferramentas e código

Qualcomm CEO: OpenAI, Meta e outros estão construindo wearables com agentes que substituem o smartphone

Cristiano Amon (CEO Qualcomm) confirma que está trabalhando com 'praticamente todos' os grandes players de IA em dispositivos wearable secretos — óculos, joias, broches, pingentes — projetados para um mundo onde o centro da vida digital é um agente autônomo, não mais um smartphone.

Ferramentas e código · web-search · qualcomm, openai, meta, wearables, agentes, smartphone

Anthropic abre 10 templates de agentes financeiros, integração total com Microsoft 365 e parceria de dados com a Moody's

Anthropic mira Wall Street com 10 agentes prontos para o trabalho mais consumidor de tempo em finanças — pitchbooks, KYC, fechamento mensal, credit memos. Cada um vai como plugin no Claude Cowork/Claude Code e como cookbook no Managed Agents. Soma-se integração completa com Microsoft 365 e dados da Moody's, com endosso público de Jamie Dimon.

Ferramentas e código · web-search · anthropic, wall-street, agents, finance, microsoft365, moodys

antirez/ds4: motor de inferência DeepSeek 4 Flash em Metal (Apple Silicon) — 5300 stars em poucos dias

Salvatore Sanfilippo (antirez, criador do Redis) publicou um motor de inferência local para DeepSeek 4 Flash escrito direto em Metal Performance Shaders — Apple Silicon nativo, sem CUDA, sem llama.cpp. Já passou de 5,3k estrelas em poucos dias.

Ferramentas e código · github-trending · github, antirez, deepseek, metal, apple-silicon, inference

openai/privacy-filter no HF passa de 1,3 mil likes e 185 mil downloads — modelo open de OpenAI para PII filtering on-device

OpenAI publicou 'privacy-filter' no Hugging Face — modelo de token-classification para identificar e mascarar PII (nomes, e-mails, documentos, cartões). Licença Apache 2.0, formatos ONNX e safetensors, suporte transformers.js (roda no browser). Acumulou 1.394 likes e 185 mil downloads desde 17 de abril.

Ferramentas e código · huggingface · openai, privacy, pii, token-classification, on-device, transformers-js

Academic Research Skills for Claude Code — repo viraliza no HN (72 pts) com skills prontas para pesquisa acadêmica em Claude Code

Repo Imbad0202/academic-research-skills compila um pacote de skills para Claude Code voltado a pesquisa acadêmica — busca de literatura, leitura crítica, síntese, citação correta, geração de relatórios. Pegou 72 pontos no HN. Vale comparar com sua skill `pesquisa-profunda` e `deep-research-wshuyi`.

Ferramentas e código · hackernews · claude-code, skills, academic-research, hackernews

strukto-ai/mirage: Unified Virtual Filesystem for AI Agents — VFS abstraindo S3, GCS, OneDrive, GitHub para skills

Mirage é um virtual filesystem unificado pensado para ser exposto a agentes via MCP/skills: o agente faz ls, read, write num único namespace e por baixo o Mirage roteia para S3, Google Drive, OneDrive, Dropbox, GitHub, Notion etc. Subiu para ~1700 stars rapidamente.

Ferramentas e código · github-trending · github, vfs, filesystem, agents, mcp, abstraction

IBM Think 2026: nova geração do watsonx Orchestrate (multi-agent), IBM Confluent (dados em real-time), IBM Concert (intelligent operations) e IBM Sovereign Core

No Think 2026, IBM anunciou seu pacote mais amplo até agora para AI corporativa híbrida: nova geração do watsonx Orchestrate com orquestração multi-agente, IBM Confluent (dados real-time para IA), IBM Concert (ops inteligentes) e IBM Sovereign Core (independência operacional). Empresa enquadrou o conjunto como 'blueprint do AI Operating Model'.

Ferramentas e código · web-search · ibm, watsonx, orchestrate, multi-agent, sovereign-cloud, enterprise-ai

lightseekorg/tokenspeed: motor de inferência LLM 'speed-of-light' aposta em fusão de kernels e batching agressivo

Mais um motor de inferência LLM que se apresenta como 'speed-of-light' — segue tendência do nano-vLLM, sgl-router e MiniInfer: focar em throughput máximo via fusão agressiva de kernels CUDA e batching dinâmico. ~880 estrelas.

Ferramentas e código · github-trending · github, inference, performance, vllm, sgi

vect-G/lecture-to-hw: skill do Codex que transforma aula gravada + arquivos da disciplina em homework — 76 stars em dias

Skill para Codex (OpenAI) que pega gravação de aula + arquivos do curso (slides, código, leituras) e gera lista de exercícios. Pegou 76 stars em poucos dias. Padrão típico de skill educacional que combina transcrição, sumarização e geração de tarefas adaptadas ao nível do material.

Ferramentas e código · github · codex, skills, education, homework-generation, github-trending

MachinaCheck: case do AMD Developer Hackathon mostra sistema multi-agente para manufatura CNC rodando em GPUs MI300X

Time MachinaCheck publicou case no blog do Hugging Face: sistema multi-agente que avalia 'manufaturabilidade' de uma peça CNC a partir do CAD. Roda em GPUs AMD MI300X — vencedor do hackathon AMD x lablab.ai. Sinal claro: AMD ganhando tração no enterprise como alternativa à NVIDIA.

Ferramentas e código · huggingface · multi-agent, amd, mi300x, cnc, manufacturing, lablab-ai

Pesquisa

Cited but Not Verified: agentes de Deep Research citam fontes que não respaldam a afirmação em ~30% dos casos

Paper de 7 de maio audita as citações geradas por Deep Research da OpenAI, Gemini Deep Research Max, Perplexity Pro e research skills do Claude. Achado: ~30% das fontes citadas não suportam a afirmação que acompanham — citação existe e é real, mas o conteúdo da fonte não fala daquilo.

Pesquisa · arxiv · arxiv, deep-research, citations, hallucination, source-attribution, evaluation

SkillOS (arXiv 2605.06649): agente aprende a curar a própria biblioteca de skills — incluir, fundir, descartar — em ciclo auto-evolutivo

Paper propõe SkillOS: framework em que o agente IA não só usa skills, mas decide quais skills criar, quais fundir e quais descartar. Auto-curadoria de biblioteca de habilidades baseada em frequência de uso, taxa de sucesso e overlap semântico. Ressonância direta com o modelo de skills do Claude Code e Cowork.

Pesquisa · arxiv · arxiv, skill-curation, self-evolving, agents, claude-code, cowork

Recursive Agent Optimization (arXiv 2605.06645): agente otimiza a si próprio em loop de auto-melhoramento — sem nova rodada de fine-tuning

Paper propõe Recursive Agent Optimization (RAO): o agente examina as próprias trajetórias passadas, identifica gargalos no próprio prompt-system e propõe edições recursivas. Cada iteração otimiza o próprio otimizador. Auto-melhoramento sem fine-tuning, só com edição de instruções.

Pesquisa · arxiv · arxiv, self-improvement, agent-optimization, recursion, meta-learning

ActCam (arXiv 2605.06633): controle zero-shot conjunto de câmera + movimento 3D em vídeo gerado — sem precisar treinar modelo novo

Paper de 7/5 propõe ActCam — método zero-shot para controlar simultaneamente movimento de câmera (pan, dolly, orbit) e movimento 3D dos objetos em modelos de geração de vídeo. Vantagem: sem fine-tuning, sem dataset proprietário. Encaixa em cima de Sora, Veo, Sulphur-2.

Pesquisa · arxiv · arxiv, video-generation, camera-control, 3d-motion, zero-shot

Superintelligent Retrieval Agent: 'IR já é commodity, o gargalo agora é planejamento, busca e síntese

Paper de 7 de maio argumenta que retrieval clássico (BM25, embeddings) virou commodity e que a próxima fronteira é o 'agente de retrieval superinteligente' — capaz de planejar buscas, descompor questões, executar passos paralelos e sintetizar com auditoria explícita.

Pesquisa · arxiv · arxiv, retrieval, agents, superintelligence, deep-research

Patch2Vuln (arXiv 2605.06658): agente reconstrói vulnerabilidades a partir de patches binários de distribuições Linux — security research automatizada

Paper de 7/5 propõe Patch2Vuln — agente que olha o patch binário de uma distribuição Linux, identifica a função alterada, infere a vulnerabilidade original e reconstrói um PoC (proof-of-concept) plausível. Pesquisa de segurança 100% automatizada — útil para defesa e, inevitavelmente, para ofensa.

Pesquisa · arxiv · arxiv, agentic-ai, security, reverse-engineering, binary-analysis, vulnerabilities

StraTA: incentivar agentic RL com 'Strategic Trajectory Abstraction' — agente aprende a abstrair próprias trajetórias e generalizar

Paper de 7 de maio propõe que agentes de RL aprendam não só a executar, mas a abstrair as próprias trajetórias bem-sucedidas em 'estratégias' reutilizáveis — espécie de meta-skill auto-induzida que melhora generalização para novas tarefas.

Pesquisa · arxiv · arxiv, agentic-rl, trajectory, abstraction, generalization

AI Co-Mathematician (arXiv 2605.06640): IA agentic para acelerar matemáticos profissionais — não substituir, mas amplificar

Paper de 7/5 documenta uso real de agente IA como 'co-matemático' — não como autoresolveddor, mas como par de raciocínio que aceita conjecturas, propõe lemas, gera contraexemplos e organiza prova. Casa com a nova onda de papers tipo 'lean + LLM' e com o trabalho do Terence Tao usando Claude/Gemini.

Pesquisa · arxiv · arxiv, agentic-ai, mathematics, scientific-discovery, human-ai-collab

Comunidade

Apple prepara virada: Apple Intelligence em iOS 27 / iPadOS 27 / macOS 27 deve permitir escolher Google ou Anthropic como provider

Vazamento aponta que a Apple vai abrir Apple Intelligence — em iOS 27, iPadOS 27 e macOS 27 — para múltiplos providers de IA, com Google (Gemini) e Anthropic (Claude) já citados como opções além da OpenAI. Movimento desfaz a exclusividade que vinha sendo lida como vitória da OpenAI no consumer.

Comunidade · web-search · apple, apple-intelligence, anthropic, google, gemini, ios27

Anthropic fecha com SpaceX para usar 300 MW do Colossus 1 (≈220 mil GPUs NVIDIA) e dobra rate limits de Pro, Max, Team e Enterprise

Anthropic vai consumir TODA a capacidade do data center Colossus 1 da SpaceX — 300 MW novos (~220 mil GPUs NVIDIA) em poucas semanas. Com o reforço, a empresa dobrou rate limits de Pro, Max, Team e Enterprise por assento e eliminou as reduções de horário de pico para Pro e Max.

Comunidade · web-search · anthropic, spacex, colossus, compute, rate-limits, gpu

Local AI needs to be the norm' viraliza no HN (370 pts) — manifesto pelo deslocamento de inferência LLM para máquinas pessoais

Post 'Local AI needs to be the norm' acumulou 370 pontos no HN nas últimas 24h. Argumenta que dependência de APIs (OpenAI, Anthropic) é frágil — privacidade, custo, latência, censura, soberania — e que com Qwen3.6, Llama-4 e similares já é viável rodar tudo localmente para a maioria dos use cases.

Comunidade · hackernews · local-ai, hackernews, manifesto, sovereignty, privacy, llm-local

Hinton volta a alertar na CNN: IA vai substituir 'muitos, muitos empregos

Geoffrey Hinton, em entrevista no State of the Union da CNN (10/5), diz estar 'mais preocupado' com IA do que dois anos atras, citando ganhos em raciocinio e capacidade de engano, e que tamanho de tarefa duplica a cada ~7 meses.

Comunidade · thehill · hinton, ai-risk, jobs, agi-alarm, doomer

Cidadãos de Maryland pagarão US$ 2 bilhões em upgrade de grid elétrico para sustentar data centers de IA do interior — protesto formal ao FERC

Estado de Maryland protestou formalmente ao FERC (Federal Energy Regulatory Commission): residentes terão US$ 2 bilhões adicionados na conta de luz para custear upgrade de transmissão necessário para sustentar data centers de IA construídos em estados vizinhos (PA, VA, OH). Quebra a 'ratepayer protection pledge' formal — IA consumindo subsídio cruzado dos cidadãos.

Comunidade · hackernews · data-centers, infrastructure, energy, maryland, regulation, ai-cost

Zuckerberg comunica aos 8 mil demitidos da Meta: layoffs são 'um line item' nos US$ 145 bi de capex em IA

Mark Zuckerberg disse a oito mil funcionários demitidos que os cortes são apenas 'um item de linha' no orçamento de US$ 145 bilhões da Meta em infraestrutura de IA — narrativa que corta e mostra o trade-off cru entre folha e capex em GPUs.

Comunidade · web-search · meta, zuckerberg, layoffs, capex, ai-spend, jobs

Alphabet sobe 160% em 1 ano puxado por dominio de quase toda a stack de IA

Alphabet bate recorde de alta — +160% em 12 meses — puxado por integracao TPU + Gemini + Workspace + Cloud. Tese de 'IA full-stack' (silicio proprio, modelo proprio, distribuicao propria) volta a se valorizar vs. players verticais.

Comunidade · cnbc · alphabet, google, mercado, full-stack-ai, tpu, gemini

Sam Altman: jovens usam ChatGPT como 'sistema operacional de vida

Altman afirma que jovens (universitarios e Gen Z) tratam ChatGPT como 'sistema operacional de vida' integrado a workflow academico, arquivos pessoais, Gmail/Drive e tarefas diarias. Tese de plataforma-de-vida vs. assistente.

Comunidade · hokanews · openai, altman, chatgpt, gen-z, comportamento, life-os

IA lidera como motivo declarado de layoffs em abril (Challenger Gray)

Relatorio mensal Challenger Gray & Christmas: pelo segundo mes consecutivo, 'IA' aparece como motivo declarado #1 para layoffs nos EUA. CNN argumenta que efeito real ainda e indireto — substituicao de contratacoes, nao demissoes diretas.

Comunidade · cnn · layoffs, jobs, ai-jobs, challenger-gray, ai-bloodbath

Gen Z aumenta ressentimento contra IA: adoção estagna e medo de perder emprego cresce (relatório Walton Foundation)

Pesquisa da Walton Family Foundation publicada em 9 de maio mostra que jovens da Gen Z (16–28 anos) estão cada vez mais resistentes a IA: adoção pessoal estagnou, e o medo de impacto no mercado de trabalho cresceu de forma marcante em 12 meses.

Comunidade · web-search · genz, adocao, jobs, sentiment, walton-foundation, sociedade

Interrupt 2026 (LangChain) confirma agenda 13-14/05 — agentes enterprise no centro

LangChain divulga agenda do Interrupt 2026 (13-14/5 em SF) com keynotes de Harrison Chase, Andrew Ng, Aaron Levie. AMAs sobre LangSmith, Deep Agents, LangGraph; workshops focados em agentes enterprise saindo de PoC.

Comunidade · langchain · langchain, interrupt-2026, agents, enterprise, conferencia, langsmith

Claude Does Not Actually Taste Bananas': post do LessWrong investiga fenomenologia sintética baseada em potássio nos LLMs

Post do LessWrong argumenta que quando o Claude descreve 'sensação' de comer banana, está ativando padrões linguísticos vinculados a potássio, doçura, textura — mas não está experimentando qualia em sentido forte. Investigação cuidadosa do que é 'fenomenologia sintética' em LLMs.

Comunidade · lesswrong · lesswrong, claude, phenomenology, qualia, alignment, anthropic

Snap e Perplexity encerram parceria de US$ 400 milhões antes do rollout — 'separação amigável' no Q1/2026

Snap confirmou que a parceria anunciada de US$ 400 milhões com a Perplexity foi 'encerrada amigavelmente' no Q1/2026, antes mesmo de chegar a um rollout amplo. Sinaliza dificuldade de Perplexity em monetizar via embed em apps de terceiros.

Comunidade · web-search · snap, perplexity, parceria, partnership-failure