Radar do FAROL27 notas

sábado, 18 de abril de 2026

Modelos

OpenAI: próximo grande modelo 'Spud' (GPT-5.5/6) com 78% de chance até abril

O próximo grande modelo da OpenAI, codinome 'Spud' (provavelmente GPT-5.5 ou GPT-6), completou pré-treino em ~24/março. Polymarket dá 78% de probabilidade de lançamento até 30/abril. Sam Altman disse aos funcionários que é um 'modelo muito forte' que pode 'acelerar a economia'. Ainda não foi lançado até 18/abril.

Modelos · LumiChats · openai, gpt-6, spud, pretraining, sam-altman

Google Gemini atinge 750M de usuários e lança 3.1 Pro

Google Gemini atingiu 750 milhões de usuários e lançou Gemini 3.1 Pro com score de 90.8% no ComplexFuncBench. Gemini 3.1 adiciona análise de voz e imagem em tempo real, e algoritmo de compressão que reduz memória KV-cache em 6x, cortando custos de inferência significativamente.

Modelos · Tech Insider · google, gemini, 3.1-pro, adoção, 750m-usuarios

Claude Mythos Preview atinge 99 pontos no LM Council — maior score da história

Claude Mythos Preview alcança 99/100 no LM Council, com cluster frontier comprimido: Gemini 3.1 Pro e GPT-5.4 empatados em 94.

Modelos · LM Council · anthropic, claude-mythos, benchmark, leaderboard, frontier

Boston Dynamics integra Gemini Robotics-ER 1.6 na plataforma Spot

Boston Dynamics integrou Gemini Robotics-ER 1.6 do DeepMind ao software Orbit para inspeções industriais com Spot. O modelo permite leitura de instrumentos analógicos e digitais, raciocínio espacial avançado e detecção de sucesso de tarefas — capacidades críticas para robótica industrial autônoma.

Modelos · Robotics & Automation News · google-deepmind, boston-dynamics, robótica, gemini, spot, inspeção-industrial

Qwen 3.6-35B-A3B publicado no HuggingFace sob Apache 2.0

Alibaba publicou Qwen 3.6-35B-A3B no HuggingFace (15/abril) sob licença Apache 2.0 — variante menor e aberta do flagship proprietário Qwen3.6-Plus. Modelo MoE multimodal (imagem+texto), já com 82K downloads e 784 likes. Unsloth lançou versão GGUF com 442K downloads para rodar localmente.

Modelos · HuggingFace · qwen, alibaba, open-weights, moe, multimodal, apache-2.0

OpenAI lança GPT-5.4-Cyber com acesso expandido para equipes de segurança

OpenAI lançou GPT-5.4-Cyber, versão especializada em cibersegurança com acesso expandido para equipes de segurança. Codex Security já contribuiu para correção de 3.000+ vulnerabilidades críticas. Movimento alinha-se com programa de $100M da Anthropic para defesas cibernéticas com IA.

Modelos · thehackernews · OpenAI, GPT, cybersecurity, segurança, enterprise

xAI: Grok 4.20 Beta 2 lidera benchmarks; Grok Computer entra em beta público

Grok 4.20 Beta 2 domina leaderboards em medicina, raciocínio legal e benchmarks gerais. Grok Computer beta está live com testes públicos em larga escala iminentes — agente que controla desktop do usuário. xAI mira Grok 5 para Q2 2026.

Modelos · IBTimes · xai, grok, benchmarks, computer-use, agentes

Top Local Models List — Abril 2026: Qwen 3.5, Gemma 4, GLM-5 lideram

Latent.space publica ranking dos melhores modelos locais de abril 2026: Qwen 3.5 (mais recomendado), Gemma 4 (usabilidade local), GLM-5/GLM-4.7 (top performance), MiniMax M2.5/M2.7 (workloads agentic). Modelos chineses representam 41% dos downloads no HF.

Modelos · latent-space · local-llm, qwen, gemma, glm, minimax, open-source

Ferramentas e código

Anthropic lança Claude Design para criação rápida de visuais

Anthropic lançou Claude Design, produto experimental que permite criar protótipos, slides, one-pagers e mockups a partir de descrições textuais. Powered by Opus 4.7, lê codebases e design systems da empresa para manter consistência visual. Disponível para planos Pro, Max, Team e Enterprise. Ações da Figma caíram imediatamente após o anúncio.

Ferramentas e código · TechCrunch · anthropic, claude-design, opus-4.7, design, protótipos

EY implanta 130.000 agentes de IA em escala enterprise

EY implantou 130.000 agentes de IA e Canva reformulou plataforma inteira em torno de workflows agênticos, marcando adoção enterprise em escala real.

Ferramentas e código · Asanify · agentic-ai, enterprise, EY, canva, workforce

Cursor, Claude Code e Codex convergem em ambiente único de desenvolvimento

Em abril 2026, Cursor, Claude Code e OpenAI Codex estão convergindo em um ambiente de desenvolvimento unificado. Cursor relançou interface para orquestrar agentes paralelos, OpenAI publicou plugin oficial que roda dentro do Claude Code, e early adopters rodam os três juntos. Context engineering com MCP v2.1 é o novo diferenciador.

Ferramentas e código · Packmind · cursor, claude-code, codex, dev-tools, context-engineering

Claude Code ganha Routines para automação de workflows repetitivos

Claude Code adicionou recurso de Routines — workflows repetitivos e programáveis que automatizam tarefas de desenvolvimento recorrentes. Inclui também cache de prompt forçado de 5min/1h, session recap, fullscreen TUI, notificações push mobile e melhorias no resume/model switching.

Ferramentas e código · 9to5Mac · anthropic, claude-code, routines, automação, dev-tools

Databricks lança Unity AI Gateway para governança de agentes

Databricks anunciou Unity AI Gateway, camada de governança que controla acesso a LLMs, governa uso de servidores MCP e APIs por agentes, e aplica políticas consistentes entre modelos e ferramentas. Posiciona governança como peça-chave para IA agêntica em produção enterprise.

Ferramentas e código · Databricks Blog · databricks, ai-gateway, governança, agentes, mcp, enterprise

xAI lança APIs standalone de Speech-to-Text e Text-to-Speech do Grok

xAI lançou APIs de voz: Grok STT ($0.10/h batch, $0.20/h streaming) com transcrição em 25 idiomas, diarização e timestamps; Grok TTS ($4.20/1M chars) com 5 vozes expressivas em 20 idiomas e tags de controle vocal ([laugh], [sigh], <whisper>). STT alega 5% de erro em reconhecimento de entidades vs 12% do ElevenLabs.

Ferramentas e código · marktechpost · xAI, Grok, speech-to-text, TTS, API, voz

Meta lança KernelEvolve: agente autônomo que otimiza kernels de produção

Meta apresenta KernelEvolve, um agente de IA que trata otimização de kernels como problema de busca — gera e avalia centenas de candidatos automaticamente para hardware heterogêneo, melhorando infraestrutura de ranking em produção.

Ferramentas e código · engineering-meta · meta, agentes, infraestrutura, kernels, otimizacao, producao

MCP Dev Summit: gateways, gRPC e protocol hardening em foco

No MCP Dev Summit North America (2-3 abril, NYC), discussões sobre gateways MCP, migração para gRPC, e protocol hardening para produção. Uber descreveu uso interno de MCP em escala que coloca o protocolo firmemente em produção. MCP ultrapassou 97M de downloads/mês em março 2026.

Ferramentas e código · InfoQ · mcp, gateway, grpc, observabilidade, protocol, enterprise

Meta usa IA para mapear tribal knowledge em pipelines de dados

Meta detalha como usou IA para extrair e manter 'tribal knowledge' de pipelines de dados em larga escala. Context files de ~1000 tokens, opt-in, com quality gate multi-round e auto-upgrade — exemplo real de context engineering aplicado.

Ferramentas e código · engineering-meta · meta, context-engineering, data-pipelines, tribal-knowledge, automacao

Claude Code lidera satisfação de desenvolvedores com 46%

Pesquisa com 906 engenheiros mostra Claude Code como ferramenta de codificação por IA mais amada (46%), seguida de Cursor e Copilot.

Ferramentas e código · How Do I Use AI / Pragmatic Engineer · claude-code, cursor, developer-survey, coding-tools

IBM lança serviço de segurança autônoma com agentes de IA

IBM apresenta serviço de segurança autônoma usando agentes especializados de IA para detectar e responder a ameaças em tempo real.

Ferramentas e código · AI Business · ibm, security, autonomous, agentic-ai, enterprise

ChatGPT adiciona integração com Outlook (email e calendário)

ChatGPT passa a integrar caixas de correio e calendários Outlook compartilhados para leitura, organização e gestão de eventos.

Ferramentas e código · OpenAI · openai, chatgpt, outlook, integração, enterprise

Pesquisa

Paper: Context Engineering para assistentes de código multi-agente

Paper descreve sistema multi-agente integrando Elicit, NotebookLM, ChatGPT e Claude Code para melhorar acurácia de geração de código via intent clarification, knowledge retrieval e sub-agentes especializados. Propõe arquitetura com Intent Translator + RAG semântico + framework de agentes Claude.

Pesquisa · HuggingFace Papers · context-engineering, multi-agent, claude-code, notebooklm, paper

Paper: From Reasoning to Agentic — Credit Assignment em RL para LLMs

Survey categoriza métodos de credit assignment para RL com LLMs por granularidade e metodologia, distinguindo abordagens para cenários de reasoning vs. agentic. Cobre token-level credit, Monte Carlo, TD, modelos game-theoretic e information-theoretic.

Pesquisa · huggingface-papers · paper, reinforcement-learning, credit-assignment, agentes, reasoning, llm

Comunidade

Elon Musk anuncia fusão entre SpaceX e xAI

Elon Musk anunciou fusão entre SpaceX e xAI, consolidando seu império de tecnologia. A xAI, que está mirando o Grok 5 para Q2, agora opera sob o mesmo guarda-chuva que a SpaceX — um movimento que pode acelerar aplicações de IA em exploração espacial.

Comunidade · web-search · elon-musk, xai, spacex, merger, negocios

Karpathy relata 'AI psychosis': 16h/dia com agentes e autoresearch

No podcast No Priors, Karpathy revelou estar em 'AI psychosis' desde dezembro — 16h/dia emitindo comandos a agentes. Sua proporção de código próprio vs. IA inverteu de 80/20 para 0/100. Seu novo sistema de 'autoresearch' roda centenas de experimentos semi-autônomos para descobrir técnicas de treino para nanochat.

Comunidade · Global Advisors / No Priors Podcast · karpathy, agentes, autoresearch, produtividade, vibe-coding

Simon Willison alerta para elementos de vício em ferramentas de IA para coding

Desenvolvedores reportam distúrbios de sono e sobrecarga cognitiva com ferramentas de IA para código. Simon Willison (25 anos de experiência) no Lenny's Podcast: 'Cognição humana tem limites — abrir mão de sono para fazer agent coding é insustentável'. Aponta elementos de gambling e adição no design dessas ferramentas.

Comunidade · Digital Today · simon-willison, saúde-mental, dev-tools, vício, produtividade

OpenAI ultrapassa $25B e Anthropic se aproxima de $19B em receita anualizada

OpenAI ultrapassa $25 bilhões em receita anualizada e dá passos iniciais para IPO potencialmente em late 2026. Anthropic se aproxima de $19 bilhões. Competição financeira entre labs de IA atinge novos patamares.

Comunidade · web-search · openai, anthropic, receita, negocios, ipo

r/programming bane todo conteúdo sobre LLMs de IA

O maior subreddit de programação (r/programming) baniu todo conteúdo relacionado a LLMs de IA, priorizando apenas discussões de alta qualidade sobre IA. Sinal de fadiga e backlash da comunidade dev contra hype de IA.

Comunidade · web-search · reddit, comunidade, backlash, programadores, llm