Anthropic confirma o Claude Mythos 5 com 10 trilhões de parâmetros, mas não lançará publicamente — testes internos acionaram o protocolo ASL-4, reservado para modelos próximos de limiares genuinamente perigosos. Mythos Preview disponível para ~50 parceiros via Project Glasswing (93,9% SWE-bench Verified).
OpenAI anuncia GPT-5.5, apenas 6 semanas apos o GPT-5.4, reafirmando ritmo acelerado. Destaques: melhor coding e debugging, pesquisa online, analise de dados, operacao de software, e menor necessidade de orientacao humana. Disponivel para Plus/Pro/Business/Enterprise no ChatGPT e Codex. GPT-5.5 Pro tambem na API. Greg Brockman: 'o que e especial e quanto mais ele faz com menos orientacao'.
Modelos · techcrunch · openai, gpt-5-5, coding, computer-use, super-app, api
Gemini 3.1 Pro assume liderança nos principais benchmarks. O algoritmo TurboQuant do Google reduz memória de KV-cache em 6x, mantendo desempenho frontier e cortando custos de inferência drasticamente.
Anthropic reconhece que usuarios nao estavam imaginando coisas: 3 mudancas distintas degradaram a qualidade do Claude. (1) Reasoning effort de high para medium no Claude Code em 4/mar, (2) bug de cache clearing a cada turno em 26/mar, (3) system prompt revisado em 16/abr para reduzir verbosidade. Todos corrigidos. Cobertura do The Register complementa o postmortem oficial.
Qwen lança o 3.6-27B, versão densa (não-MoE) do novo ciclo 3.6, multimodal (image-text-to-text), Apache 2.0. Já com 24K downloads e trending no HuggingFace.
Apple lança Siri turbinada por Gemini do Google com o iOS 26.4, marcando integração profunda de LLM no assistente da Apple para centenas de milhões de iPhones.
Z-Lab subiu o Qwen3.6-27B-DFlash no HuggingFace e ele esta entre os trending de modelos hoje (score 141, 200 likes em ~9 dias). Combina diffusion-based language modeling com speculative decoding e flash decoding — tres ideias de eficiencia em um so modelo, MIT, citando arxiv:2602.06036.
Anthropic lança Managed Agents: camada de execução gerenciada para workflows agenticos com sandboxing, estado de sessão, credenciais e persistência. Custo de US$ 0,08 por hora de sessão — de ideia a produção em dias.
Cursor, Claude Code e OpenAI Codex convergem para um único ambiente de desenvolvimento. Early adopters rodam os três juntos: Cursor como camada de interface, Claude Code como motor de raciocínio e Codex para geração de código.
Anthropic publicou post-mortem confirmando 3 mudanças que degradaram o Claude Code entre março e abril: (1) redução do nível de reasoning de high para medium em 4/mar, (2) bug de cache limpo a cada turno em 26/mar, (3) prompt de redução de verbosidade em 16/abr causando -3% em coding benchmarks. Correções estão live desde v2.1.116 (20/abr).
Ferramentas e código · DevToolPicks / The Register · anthropic, claude-code, postmortem, qualidade, debugging
OpenAI libera o privacy-filter no HuggingFace (Apache 2.0), modelo de token-classification para detecção de PII. Já com 1,9K downloads e 411 likes, compatível com transformers.js.
Anthropic alcança US$ 1 trilhão em mercado secundário, superando a OpenAI. Receita anualizada saltou de US$ 9B (dez/2025) para US$ 30B (mar/2026), impulsionada pelo Claude Code que gera US$ 2,5B/ano sozinho.
Advanced Machine Intelligence Labs, fundada pelo Turing Award Yann LeCun, levanta US$ 1,03B em seed (valuation US$ 3,5B). Aposta em 'world models' como arquitetura alternativa aos LLMs.
Visa abre rails de pagamento para agentes IA autônomos, permitindo que agentes realizem transações financeiras de forma programática. Marco regulatório e de infraestrutura para a economia agentica.
Comunidade · web-search · visa, pagamentos, agentes-autonomos, infraestrutura
Andrej Karpathy parou de usar IA para escrever código e agora usa para construir um 'segundo cérebro' — workflow autoresearch que transforma pesquisa bruta em wiki auto-mantida via agentes de coding.
Comunidade · medium · andrej-karpathy, segundo-cerebro, autoresearch, agentes, workflow