O próximo grande modelo da OpenAI, codinome 'Spud' (provavelmente GPT-5.5 ou GPT-6), completou pré-treino em ~24/março. Polymarket dá 78% de probabilidade de lançamento até 30/abril. Sam Altman disse aos funcionários que é um 'modelo muito forte' que pode 'acelerar a economia'. Ainda não foi lançado até 18/abril.
Google Gemini atingiu 750 milhões de usuários e lançou Gemini 3.1 Pro com score de 90.8% no ComplexFuncBench. Gemini 3.1 adiciona análise de voz e imagem em tempo real, e algoritmo de compressão que reduz memória KV-cache em 6x, cortando custos de inferência significativamente.
Boston Dynamics integrou Gemini Robotics-ER 1.6 do DeepMind ao software Orbit para inspeções industriais com Spot. O modelo permite leitura de instrumentos analógicos e digitais, raciocínio espacial avançado e detecção de sucesso de tarefas — capacidades críticas para robótica industrial autônoma.
Alibaba publicou Qwen 3.6-35B-A3B no HuggingFace (15/abril) sob licença Apache 2.0 — variante menor e aberta do flagship proprietário Qwen3.6-Plus. Modelo MoE multimodal (imagem+texto), já com 82K downloads e 784 likes. Unsloth lançou versão GGUF com 442K downloads para rodar localmente.
OpenAI lançou GPT-5.4-Cyber, versão especializada em cibersegurança com acesso expandido para equipes de segurança. Codex Security já contribuiu para correção de 3.000+ vulnerabilidades críticas. Movimento alinha-se com programa de $100M da Anthropic para defesas cibernéticas com IA.
Grok 4.20 Beta 2 domina leaderboards em medicina, raciocínio legal e benchmarks gerais. Grok Computer beta está live com testes públicos em larga escala iminentes — agente que controla desktop do usuário. xAI mira Grok 5 para Q2 2026.
Anthropic lançou Claude Design, produto experimental que permite criar protótipos, slides, one-pagers e mockups a partir de descrições textuais. Powered by Opus 4.7, lê codebases e design systems da empresa para manter consistência visual. Disponível para planos Pro, Max, Team e Enterprise. Ações da Figma caíram imediatamente após o anúncio.
Em abril 2026, Cursor, Claude Code e OpenAI Codex estão convergindo em um ambiente de desenvolvimento unificado. Cursor relançou interface para orquestrar agentes paralelos, OpenAI publicou plugin oficial que roda dentro do Claude Code, e early adopters rodam os três juntos. Context engineering com MCP v2.1 é o novo diferenciador.
Claude Code adicionou recurso de Routines — workflows repetitivos e programáveis que automatizam tarefas de desenvolvimento recorrentes. Inclui também cache de prompt forçado de 5min/1h, session recap, fullscreen TUI, notificações push mobile e melhorias no resume/model switching.
Databricks anunciou Unity AI Gateway, camada de governança que controla acesso a LLMs, governa uso de servidores MCP e APIs por agentes, e aplica políticas consistentes entre modelos e ferramentas. Posiciona governança como peça-chave para IA agêntica em produção enterprise.
Ferramentas e código · Databricks Blog · databricks, ai-gateway, governança, agentes, mcp, enterprise
xAI lançou APIs de voz: Grok STT ($0.10/h batch, $0.20/h streaming) com transcrição em 25 idiomas, diarização e timestamps; Grok TTS ($4.20/1M chars) com 5 vozes expressivas em 20 idiomas e tags de controle vocal ([laugh], [sigh], <whisper>). STT alega 5% de erro em reconhecimento de entidades vs 12% do ElevenLabs.
Ferramentas e código · marktechpost · xAI, Grok, speech-to-text, TTS, API, voz
Meta apresenta KernelEvolve, um agente de IA que trata otimização de kernels como problema de busca — gera e avalia centenas de candidatos automaticamente para hardware heterogêneo, melhorando infraestrutura de ranking em produção.
No MCP Dev Summit North America (2-3 abril, NYC), discussões sobre gateways MCP, migração para gRPC, e protocol hardening para produção. Uber descreveu uso interno de MCP em escala que coloca o protocolo firmemente em produção. MCP ultrapassou 97M de downloads/mês em março 2026.
Meta detalha como usou IA para extrair e manter 'tribal knowledge' de pipelines de dados em larga escala. Context files de ~1000 tokens, opt-in, com quality gate multi-round e auto-upgrade — exemplo real de context engineering aplicado.
Paper descreve sistema multi-agente integrando Elicit, NotebookLM, ChatGPT e Claude Code para melhorar acurácia de geração de código via intent clarification, knowledge retrieval e sub-agentes especializados. Propõe arquitetura com Intent Translator + RAG semântico + framework de agentes Claude.
Pesquisa · HuggingFace Papers · context-engineering, multi-agent, claude-code, notebooklm, paper
Survey categoriza métodos de credit assignment para RL com LLMs por granularidade e metodologia, distinguindo abordagens para cenários de reasoning vs. agentic. Cobre token-level credit, Monte Carlo, TD, modelos game-theoretic e information-theoretic.
Elon Musk anunciou fusão entre SpaceX e xAI, consolidando seu império de tecnologia. A xAI, que está mirando o Grok 5 para Q2, agora opera sob o mesmo guarda-chuva que a SpaceX — um movimento que pode acelerar aplicações de IA em exploração espacial.
Comunidade · web-search · elon-musk, xai, spacex, merger, negocios
No podcast No Priors, Karpathy revelou estar em 'AI psychosis' desde dezembro — 16h/dia emitindo comandos a agentes. Sua proporção de código próprio vs. IA inverteu de 80/20 para 0/100. Seu novo sistema de 'autoresearch' roda centenas de experimentos semi-autônomos para descobrir técnicas de treino para nanochat.
Comunidade · Global Advisors / No Priors Podcast · karpathy, agentes, autoresearch, produtividade, vibe-coding
Desenvolvedores reportam distúrbios de sono e sobrecarga cognitiva com ferramentas de IA para código. Simon Willison (25 anos de experiência) no Lenny's Podcast: 'Cognição humana tem limites — abrir mão de sono para fazer agent coding é insustentável'. Aponta elementos de gambling e adição no design dessas ferramentas.
Comunidade · Digital Today · simon-willison, saúde-mental, dev-tools, vício, produtividade
OpenAI ultrapassa $25 bilhões em receita anualizada e dá passos iniciais para IPO potencialmente em late 2026. Anthropic se aproxima de $19 bilhões. Competição financeira entre labs de IA atinge novos patamares.
Comunidade · web-search · openai, anthropic, receita, negocios, ipo
O maior subreddit de programação (r/programming) baniu todo conteúdo relacionado a LLMs de IA, priorizando apenas discussões de alta qualidade sobre IA. Sinal de fadiga e backlash da comunidade dev contra hype de IA.
Comunidade · web-search · reddit, comunidade, backlash, programadores, llm