Anthropic disponibilizou em GA o Claude Opus 4.7. Melhorias específicas em engenharia de software (tarefas longas de coding) e em visão (imagens em resolução mais alta). Preço se mantém em US$ 5/M input e US$ 25/M output, igual ao 4.6 — sinal de que o ganho é de qualidade, não de escala bruta.
Google ampliou o File Search da API Gemini com três features importantes para RAG produtivo: indexação multimodal (imagens + texto via Gemini Embedding 2), metadata customizada e citações com nível de página — tudo embutido no managed service, sem precisar montar pipeline próprio.
OpenAI publicou três novos modelos de voz no realtime API: GPT-Realtime-2 (raciocínio em conversa ao vivo), GPT-Realtime-Translate (tradução simultânea de fala) e GPT-Realtime-Whisper (transcrição em streaming). Stack completa para construir agentes de voz multilíngues com latência baixa.
Modelos · web-search · openai, voice, realtime, whisper, translate, api
Claude Security entra em public beta para clientes Enterprise, escaneando código por vulnerabilidades e gerando fixes propostos com Opus 4.7. Em paralelo, Claude Design — produto novo do Anthropic Labs — permite colaborar com Claude na produção de designs, protótipos, slides e one-pagers.
Sulphur-2-base (SulphurAI), lançado em 3 de maio, é o modelo #1 em trending score no Hugging Face Hub: text-to-video aberto, baseado em diffusers, 144 mil downloads em poucos dias e GGUF disponível. Promete competir com Sora, Veo e Kling no espaço de geração de vídeo open.
OpenAI substituiu o default do ChatGPT por GPT-5.5 Instant — variante mais rápida da família 5.5, com foco em personalização e contexto. Alegação central: redução >50% de claims halucinados em cenários high-stakes e capacidade ampliada de usar chats passados, arquivos enviados e serviços conectados (Gmail, Drive).
Modelo experimental publicado por Jackrong na HF combina backbone Qwen3.6 35B-A3B com camadas reasoning/CoT estilo Claude Opus, distribuído já em GGUF para llama.cpp. Multimodal (vision), tool-use, function-calling, long-context, EN/ZH/ES/RU — 53k downloads em poucos dias.
Ex-líder global em Mini PCs, CTONE realiza evento em Shenzhen anunciando reposicionamento como 'construtor do ecossistema de computação por agentes' — três linhas de Agent Computer: entry-level com 200+ agents da SenseTime, mid-tier com edge-cloud Alibaba, profissional para grandes modelos on-device.
Zyphra publicou ZAYA1-8B em 4 de maio — arquitetura custom batizada 'Zaya' (não é Transformer puro), licença Apache 2.0, eval-results no card. Em uma semana acumulou 367 likes e 45 mil downloads. Referência: arXiv 2605.05365.
HiDream-O1-Image foi publicado em 8 de maio: image-text-to-image baseado em Qwen3-VL, licença MIT. Acumulou 179 likes em 2 dias. Promete edição multimodal com instrução natural — competidor direto de Flux.1-Kontext.
Cristiano Amon (CEO Qualcomm) confirma que está trabalhando com 'praticamente todos' os grandes players de IA em dispositivos wearable secretos — óculos, joias, broches, pingentes — projetados para um mundo onde o centro da vida digital é um agente autônomo, não mais um smartphone.
Anthropic mira Wall Street com 10 agentes prontos para o trabalho mais consumidor de tempo em finanças — pitchbooks, KYC, fechamento mensal, credit memos. Cada um vai como plugin no Claude Cowork/Claude Code e como cookbook no Managed Agents. Soma-se integração completa com Microsoft 365 e dados da Moody's, com endosso público de Jamie Dimon.
Salvatore Sanfilippo (antirez, criador do Redis) publicou um motor de inferência local para DeepSeek 4 Flash escrito direto em Metal Performance Shaders — Apple Silicon nativo, sem CUDA, sem llama.cpp. Já passou de 5,3k estrelas em poucos dias.
OpenAI publicou 'privacy-filter' no Hugging Face — modelo de token-classification para identificar e mascarar PII (nomes, e-mails, documentos, cartões). Licença Apache 2.0, formatos ONNX e safetensors, suporte transformers.js (roda no browser). Acumulou 1.394 likes e 185 mil downloads desde 17 de abril.
Repo Imbad0202/academic-research-skills compila um pacote de skills para Claude Code voltado a pesquisa acadêmica — busca de literatura, leitura crítica, síntese, citação correta, geração de relatórios. Pegou 72 pontos no HN. Vale comparar com sua skill `pesquisa-profunda` e `deep-research-wshuyi`.
Ferramentas e código · hackernews · claude-code, skills, academic-research, hackernews
Mirage é um virtual filesystem unificado pensado para ser exposto a agentes via MCP/skills: o agente faz ls, read, write num único namespace e por baixo o Mirage roteia para S3, Google Drive, OneDrive, Dropbox, GitHub, Notion etc. Subiu para ~1700 stars rapidamente.
No Think 2026, IBM anunciou seu pacote mais amplo até agora para AI corporativa híbrida: nova geração do watsonx Orchestrate com orquestração multi-agente, IBM Confluent (dados real-time para IA), IBM Concert (ops inteligentes) e IBM Sovereign Core (independência operacional). Empresa enquadrou o conjunto como 'blueprint do AI Operating Model'.
Mais um motor de inferência LLM que se apresenta como 'speed-of-light' — segue tendência do nano-vLLM, sgl-router e MiniInfer: focar em throughput máximo via fusão agressiva de kernels CUDA e batching dinâmico. ~880 estrelas.
Skill para Codex (OpenAI) que pega gravação de aula + arquivos do curso (slides, código, leituras) e gera lista de exercícios. Pegou 76 stars em poucos dias. Padrão típico de skill educacional que combina transcrição, sumarização e geração de tarefas adaptadas ao nível do material.
Time MachinaCheck publicou case no blog do Hugging Face: sistema multi-agente que avalia 'manufaturabilidade' de uma peça CNC a partir do CAD. Roda em GPUs AMD MI300X — vencedor do hackathon AMD x lablab.ai. Sinal claro: AMD ganhando tração no enterprise como alternativa à NVIDIA.
Paper de 7 de maio audita as citações geradas por Deep Research da OpenAI, Gemini Deep Research Max, Perplexity Pro e research skills do Claude. Achado: ~30% das fontes citadas não suportam a afirmação que acompanham — citação existe e é real, mas o conteúdo da fonte não fala daquilo.
Paper propõe SkillOS: framework em que o agente IA não só usa skills, mas decide quais skills criar, quais fundir e quais descartar. Auto-curadoria de biblioteca de habilidades baseada em frequência de uso, taxa de sucesso e overlap semântico. Ressonância direta com o modelo de skills do Claude Code e Cowork.
Paper propõe Recursive Agent Optimization (RAO): o agente examina as próprias trajetórias passadas, identifica gargalos no próprio prompt-system e propõe edições recursivas. Cada iteração otimiza o próprio otimizador. Auto-melhoramento sem fine-tuning, só com edição de instruções.
Paper de 7/5 propõe ActCam — método zero-shot para controlar simultaneamente movimento de câmera (pan, dolly, orbit) e movimento 3D dos objetos em modelos de geração de vídeo. Vantagem: sem fine-tuning, sem dataset proprietário. Encaixa em cima de Sora, Veo, Sulphur-2.
Paper de 7 de maio argumenta que retrieval clássico (BM25, embeddings) virou commodity e que a próxima fronteira é o 'agente de retrieval superinteligente' — capaz de planejar buscas, descompor questões, executar passos paralelos e sintetizar com auditoria explícita.
Paper de 7/5 propõe Patch2Vuln — agente que olha o patch binário de uma distribuição Linux, identifica a função alterada, infere a vulnerabilidade original e reconstrói um PoC (proof-of-concept) plausível. Pesquisa de segurança 100% automatizada — útil para defesa e, inevitavelmente, para ofensa.
Paper de 7 de maio propõe que agentes de RL aprendam não só a executar, mas a abstrair as próprias trajetórias bem-sucedidas em 'estratégias' reutilizáveis — espécie de meta-skill auto-induzida que melhora generalização para novas tarefas.
Paper de 7/5 documenta uso real de agente IA como 'co-matemático' — não como autoresolveddor, mas como par de raciocínio que aceita conjecturas, propõe lemas, gera contraexemplos e organiza prova. Casa com a nova onda de papers tipo 'lean + LLM' e com o trabalho do Terence Tao usando Claude/Gemini.
Vazamento aponta que a Apple vai abrir Apple Intelligence — em iOS 27, iPadOS 27 e macOS 27 — para múltiplos providers de IA, com Google (Gemini) e Anthropic (Claude) já citados como opções além da OpenAI. Movimento desfaz a exclusividade que vinha sendo lida como vitória da OpenAI no consumer.
Comunidade · web-search · apple, apple-intelligence, anthropic, google, gemini, ios27
Anthropic vai consumir TODA a capacidade do data center Colossus 1 da SpaceX — 300 MW novos (~220 mil GPUs NVIDIA) em poucas semanas. Com o reforço, a empresa dobrou rate limits de Pro, Max, Team e Enterprise por assento e eliminou as reduções de horário de pico para Pro e Max.
Comunidade · web-search · anthropic, spacex, colossus, compute, rate-limits, gpu
Post 'Local AI needs to be the norm' acumulou 370 pontos no HN nas últimas 24h. Argumenta que dependência de APIs (OpenAI, Anthropic) é frágil — privacidade, custo, latência, censura, soberania — e que com Qwen3.6, Llama-4 e similares já é viável rodar tudo localmente para a maioria dos use cases.
Comunidade · hackernews · local-ai, hackernews, manifesto, sovereignty, privacy, llm-local
Geoffrey Hinton, em entrevista no State of the Union da CNN (10/5), diz estar 'mais preocupado' com IA do que dois anos atras, citando ganhos em raciocinio e capacidade de engano, e que tamanho de tarefa duplica a cada ~7 meses.
Comunidade · thehill · hinton, ai-risk, jobs, agi-alarm, doomer
Estado de Maryland protestou formalmente ao FERC (Federal Energy Regulatory Commission): residentes terão US$ 2 bilhões adicionados na conta de luz para custear upgrade de transmissão necessário para sustentar data centers de IA construídos em estados vizinhos (PA, VA, OH). Quebra a 'ratepayer protection pledge' formal — IA consumindo subsídio cruzado dos cidadãos.
Comunidade · hackernews · data-centers, infrastructure, energy, maryland, regulation, ai-cost
Mark Zuckerberg disse a oito mil funcionários demitidos que os cortes são apenas 'um item de linha' no orçamento de US$ 145 bilhões da Meta em infraestrutura de IA — narrativa que corta e mostra o trade-off cru entre folha e capex em GPUs.
Comunidade · web-search · meta, zuckerberg, layoffs, capex, ai-spend, jobs
Alphabet bate recorde de alta — +160% em 12 meses — puxado por integracao TPU + Gemini + Workspace + Cloud. Tese de 'IA full-stack' (silicio proprio, modelo proprio, distribuicao propria) volta a se valorizar vs. players verticais.
Comunidade · cnbc · alphabet, google, mercado, full-stack-ai, tpu, gemini
Altman afirma que jovens (universitarios e Gen Z) tratam ChatGPT como 'sistema operacional de vida' integrado a workflow academico, arquivos pessoais, Gmail/Drive e tarefas diarias. Tese de plataforma-de-vida vs. assistente.
Comunidade · hokanews · openai, altman, chatgpt, gen-z, comportamento, life-os
Relatorio mensal Challenger Gray & Christmas: pelo segundo mes consecutivo, 'IA' aparece como motivo declarado #1 para layoffs nos EUA. CNN argumenta que efeito real ainda e indireto — substituicao de contratacoes, nao demissoes diretas.
Comunidade · cnn · layoffs, jobs, ai-jobs, challenger-gray, ai-bloodbath
Pesquisa da Walton Family Foundation publicada em 9 de maio mostra que jovens da Gen Z (16–28 anos) estão cada vez mais resistentes a IA: adoção pessoal estagnou, e o medo de impacto no mercado de trabalho cresceu de forma marcante em 12 meses.
Comunidade · web-search · genz, adocao, jobs, sentiment, walton-foundation, sociedade
LangChain divulga agenda do Interrupt 2026 (13-14/5 em SF) com keynotes de Harrison Chase, Andrew Ng, Aaron Levie. AMAs sobre LangSmith, Deep Agents, LangGraph; workshops focados em agentes enterprise saindo de PoC.
Comunidade · langchain · langchain, interrupt-2026, agents, enterprise, conferencia, langsmith
Post do LessWrong argumenta que quando o Claude descreve 'sensação' de comer banana, está ativando padrões linguísticos vinculados a potássio, doçura, textura — mas não está experimentando qualia em sentido forte. Investigação cuidadosa do que é 'fenomenologia sintética' em LLMs.
Comunidade · lesswrong · lesswrong, claude, phenomenology, qualia, alignment, anthropic
Snap confirmou que a parceria anunciada de US$ 400 milhões com a Perplexity foi 'encerrada amigavelmente' no Q1/2026, antes mesmo de chegar a um rollout amplo. Sinaliza dificuldade de Perplexity em monetizar via embed em apps de terceiros.
Comunidade · web-search · snap, perplexity, parceria, partnership-failure