Radar do FAROL18 notas

quinta-feira, 23 de abril de 2026

Modelos

Claude Mythos 5 confirmado mas retido por protocolo ASL-4 de segurança

Anthropic confirma o Claude Mythos 5 com 10 trilhões de parâmetros, mas não lançará publicamente — testes internos acionaram o protocolo ASL-4, reservado para modelos próximos de limiares genuinamente perigosos. Mythos Preview disponível para ~50 parceiros via Project Glasswing (93,9% SWE-bench Verified).

Modelos · red-anthropic · anthropic, mythos, asl-4, seguranca, frontier-model

OpenAI lanca GPT-5.5 com foco em coding, computer-use e super-app — 6 semanas apos GPT-5.4

OpenAI anuncia GPT-5.5, apenas 6 semanas apos o GPT-5.4, reafirmando ritmo acelerado. Destaques: melhor coding e debugging, pesquisa online, analise de dados, operacao de software, e menor necessidade de orientacao humana. Disponivel para Plus/Pro/Business/Enterprise no ChatGPT e Codex. GPT-5.5 Pro tambem na API. Greg Brockman: 'o que e especial e quanto mais ele faz com menos orientacao'.

Modelos · techcrunch · openai, gpt-5-5, coding, computer-use, super-app, api

Google Gemini 3.1 Pro lidera benchmarks; TurboQuant reduz memória KV-cache em 6x

Gemini 3.1 Pro assume liderança nos principais benchmarks. O algoritmo TurboQuant do Google reduz memória de KV-cache em 6x, mantendo desempenho frontier e cortando custos de inferência drasticamente.

Modelos · web-search · google, gemini, turboquant, compressao, eficiencia, inference

Anthropic confirma e corrige 3 bugs que degradaram qualidade do Claude em marco-abril

Anthropic reconhece que usuarios nao estavam imaginando coisas: 3 mudancas distintas degradaram a qualidade do Claude. (1) Reasoning effort de high para medium no Claude Code em 4/mar, (2) bug de cache clearing a cada turno em 26/mar, (3) system prompt revisado em 16/abr para reduzir verbosidade. Todos corrigidos. Cobertura do The Register complementa o postmortem oficial.

Modelos · theregister · anthropic, claude, bug, qualidade, claude-code, postmortem

Qwen 3.6-27B dense lançado — modelo denso multimodal Apache 2.0

Qwen lança o 3.6-27B, versão densa (não-MoE) do novo ciclo 3.6, multimodal (image-text-to-text), Apache 2.0. Já com 24K downloads e trending no HuggingFace.

Modelos · huggingface · qwen, alibaba, open-weights, multimodal, apache-2

Apple Siri com Gemini chega no iOS 26.4

Apple lança Siri turbinada por Gemini do Google com o iOS 26.4, marcando integração profunda de LLM no assistente da Apple para centenas de milhões de iPhones.

Modelos · web-search · apple, siri, gemini, google, ios, consumer-ai

z-lab Qwen3.6-27B-DFlash: LLM com decoding por difusao e speculative decoding

Z-Lab subiu o Qwen3.6-27B-DFlash no HuggingFace e ele esta entre os trending de modelos hoje (score 141, 200 likes em ~9 dias). Combina diffusion-based language modeling com speculative decoding e flash decoding — tres ideias de eficiencia em um so modelo, MIT, citando arxiv:2602.06036.

Modelos · huggingface · qwen, diffusion-language-model, speculative-decoding, dflash, mit-license, eficiencia

Ferramentas e código

Anthropic lança Managed Agents — orquestração de agentes como serviço

Anthropic lança Managed Agents: camada de execução gerenciada para workflows agenticos com sandboxing, estado de sessão, credenciais e persistência. Custo de US$ 0,08 por hora de sessão — de ideia a produção em dias.

Ferramentas e código · infoq · anthropic, agentes, managed-agents, orquestracao, saas

Claude Code ganha Code Review baseado em agentes

Novo sistema de revisão de PRs do Claude Code usa múltiplos revisores IA simultâneos. Disponível em research preview para planos Team e Enterprise.

Ferramentas e código · infoq · claude-code, code-review, agentes, dev-tools

OpenAI lança Workspace Agents no ChatGPT — automação de workflows para times

OpenAI rola workspace agents no ChatGPT, evolução dos custom GPTs, movidos a Codex. Automatizam workflows complexos para equipes inteiras.

Ferramentas e código · web-search · openai, chatgpt, workspace-agents, codex, automacao

Cursor, Claude Code e Codex convergem para ambiente de dev unificado

Cursor, Claude Code e OpenAI Codex convergem para um único ambiente de desenvolvimento. Early adopters rodam os três juntos: Cursor como camada de interface, Claude Code como motor de raciocínio e Codex para geração de código.

Ferramentas e código · fazm-blog · cursor, claude-code, codex, convergencia, dev-tools, agentes

Anthropic publica post-mortem sobre queda de qualidade do Claude Code

Anthropic publicou post-mortem confirmando 3 mudanças que degradaram o Claude Code entre março e abril: (1) redução do nível de reasoning de high para medium em 4/mar, (2) bug de cache limpo a cada turno em 26/mar, (3) prompt de redução de verbosidade em 16/abr causando -3% em coding benchmarks. Correções estão live desde v2.1.116 (20/abr).

Ferramentas e código · DevToolPicks / The Register · anthropic, claude-code, postmortem, qualidade, debugging

OpenAI publica privacy-filter — modelo open-source para detecção de PII

OpenAI libera o privacy-filter no HuggingFace (Apache 2.0), modelo de token-classification para detecção de PII. Já com 1,9K downloads e 411 likes, compatível com transformers.js.

Ferramentas e código · huggingface · openai, privacidade, pii, token-classification, open-source

Mercado

Anthropic atinge US$ 1 trilhão de valuation, ultrapassando OpenAI

Anthropic alcança US$ 1 trilhão em mercado secundário, superando a OpenAI. Receita anualizada saltou de US$ 9B (dez/2025) para US$ 30B (mar/2026), impulsionada pelo Claude Code que gera US$ 2,5B/ano sozinho.

Mercado · quantosei-news · anthropic, valuation, receita, claude-code

AMI Labs de Yann LeCun levanta US$ 1,03B em seed para 'world models

Advanced Machine Intelligence Labs, fundada pelo Turing Award Yann LeCun, levanta US$ 1,03B em seed (valuation US$ 3,5B). Aposta em 'world models' como arquitetura alternativa aos LLMs.

Mercado · web-search · ami-labs, yann-lecun, world-models, seed-funding, arquiteturas-alternativas

Google fecha deal multibilionário com Thinking Machines Lab

Google aprofunda relação com Thinking Machines Lab via novo acordo multibilionário, reforçando sua estratégia de infraestrutura e pesquisa em IA.

Mercado · techcrunch · google, thinking-machines-lab, investimento, parceria

Comunidade

Visa abre trilhos de pagamento para agentes autônomos de IA

Visa abre rails de pagamento para agentes IA autônomos, permitindo que agentes realizem transações financeiras de forma programática. Marco regulatório e de infraestrutura para a economia agentica.

Comunidade · web-search · visa, pagamentos, agentes-autonomos, infraestrutura

Karpathy abandona IA para código e adota workflow de 'segundo cérebro' com agentes

Andrej Karpathy parou de usar IA para escrever código e agora usa para construir um 'segundo cérebro' — workflow autoresearch que transforma pesquisa bruta em wiki auto-mantida via agentes de coding.

Comunidade · medium · andrej-karpathy, segundo-cerebro, autoresearch, agentes, workflow