Radar do FAROL9 notas

sexta-feira, 26 de junho de 2026

Modelos

EUA reabrem acesso ao Claude Mythos 5 a ~100 instituições confiáveis, revertendo em parte o ban

O Secretário de Comércio dos EUA, Howard Lutnick, enviou carta à Anthropic determinando que há "salvaguardas apropriadas" para liberar o Claude Mythos 5 a um conjunto de parceiros confiáveis — cerca de 100 empresas e agências federais. É uma reversão parcial da diretriz de controle de exportação editada há duas semanas, que havia obrigado a Anthropic a desligar Mythos 5 e Fable 5 para todos os clientes por preocupações com jailbreak/cyber. O comunicado é silencioso quanto ao Fable 5. É a imagem espelhada do gating do GPT-5.6: agora um modelo de fronteira banido é reaberto de forma controlada, pela primeira vez, por decisão do Executivo.

Modelos · cnbc · anthropic, claude-mythos-5, controle-de-exportacao, governo-eua, lutnick, fronteira

Ferramentas e código

Claude Code ganha /rewind e uma leva de melhorias de confiabilidade (2.1.191 / 2.1.193)

O Claude Code teve uma cadência intensa de releases no recorte. A 2.1.191 (25/06) adicionou suporte a /rewind para retomar conversas anteriores a um /clear, parada definitiva de background agents, mais resiliência de MCP e OAuth, e reduziu uso de CPU em streaming em cerca de 37%. Logo em seguida, a 2.1.193 (26/06) trouxe classificação de auto-mode para todos os comandos de shell, rastreamento de negações de permissão e autocomplete de caminhos no modo bash. O tema central das mudanças é confiabilidade e controle de permissões — exatamente o que pesa no uso de agentes de código em produção.

Ferramentas e código · anthropic · claude-code, anthropic, rewind, mcp, oauth, devtools

OpenAI coloca o Codex Remote em disponibilidade geral em todos os planos ChatGPT

Junto ao preview do GPT-5.6, a OpenAI tornou o Codex Remote disponível em todos os planos ChatGPT: pelo app mobile, o usuário inicia ou continua trabalho de código em um host Mac ou Windows conectado, acompanha o progresso e aprova ações pelo celular. O Remote Control agora usa pareamento por QR autenticado 1-para-1 entre cada dispositivo móvel e cada host; conexões usadas desde 8/jun seguem pareadas. Há ainda um novo plugin de workspace que provisiona um Droplet na DigitalOcean como ambiente remoto.

Ferramentas e código · openai · openai, codex, codex-remote, agentes-de-codigo, mobile, ga

Pesquisa

Anthropic Economic Index: relatório 'Cadences' mostra como os ritmos do mundo moldam o uso do Claude

A Anthropic publicou novo Economic Index ("Cadences") cruzando respostas de pesquisa de ~9.700 usuários com dados de uso anonimizados (meados de maio a início de junho). Achados: consultas de trabalho caem nos fins de semana, pedidos de notícias têm pico de manhã, conselhos sobre sono disparam por volta das 5h e dúvidas tributárias sobem perto de prazos. A maioria dos respondentes espera progresso significativo da IA no próximo ano. É um raro dado de primeira mão sobre padrões reais de adoção.

Pesquisa · anthropic · anthropic, economic-index, adocao-de-ia, dados, uso-real, pesquisa

OpenAI: uso interno de tokens do Codex cresce até 56x desde nov/2025 — sinal do giro agêntico

A OpenAI divulgou dados internos mostrando que o uso mediano de tokens do Codex cresceu 56x em Pesquisa, 32x em Suporte, 27x em Engenharia e 13x em Jurídico desde novembro de 2025. Todo departamento — inclusive não técnicos — passou a usar o Codex como ferramenta primária de trabalho; no percentil 99, usuários geram regularmente mais de 60 horas de "turnos de agente" por dia, distribuídos em múltiplos agentes paralelos. A curva de uso interno é tratada como indicador antecedente do giro agêntico no trabalho.

Pesquisa · openai · openai, codex, agentes, adocao, produtividade, tokens

Mercado

OpenAI estuda adiar IPO para 2027 após tombo da SpaceX; Altman segura avaliação de US$ 1 tri

Segundo a imprensa financeira, a OpenAI estaria considerando empurrar seu IPO para 2027 depois que a ação da SpaceX caiu ~32% do pico em duas semanas após a estreia (12/jun), assustando Altman. Assessores teriam dado um ultimato binário — abrir capital ainda em 2026 a uma avaliação menor, ou esperar pela meta de US$ 1 trilhão — e Altman classificou qualquer corte no número como "inegociável". O adiamento teria derrubado ~US$ 38 bi do valor de papel da SoftBank.

Mercado · techtimes · openai, ipo, sam-altman, softbank, spacex, mercado

Comunidade

HackMyClaw: 6.000 tentativas de prompt-injection contra um agente Claude — zero vazamentos

Simon Willison destacou (26/jun) o relato de Fernando Irarrázaval sobre o desafio HackMyClaw: mais de 2.000 pessoas e 6.000+ tentativas de extrair um secrets.env do agente "Fiu" (rodando OpenClaw + Claude Opus 4.6) por e-mail. Apesar de ataques sofisticados — impersonação de autoridade, falso incident response, engenharia social multilíngue — ninguém conseguiu. Custos de API passaram de US$ 500 e o Gmail chegou a suspender a conta por 3 dias. Willison vê evidência de que o treino anti-injection dos labs ficou eficaz — sem ser garantia de produção.

Comunidade · simonwillison · prompt-injection, seguranca, agentes, openclaw, claude-opus, simon-willison

Dean Ball alerta: EUA escorregando para um 'licenciamento de facto' de modelos de fronteira

Em "What Should Be Done", o ex-formulador de política de IA Dean W. Ball argumenta que a recente ordem executiva de cyber/IA de Trump — nominalmente um programa "voluntário" de testes — está na prática montando um regime involuntário de pré-aprovação/licenciamento para modelos de fronteira, economicamente arriscado e democraticamente perigoso. Ele propõe requisitos federais de framework de segurança, auditores técnicos independentes e regulação mirando os labs como instituições, não cada release de modelo. Contextualiza, do ponto de vista dos labs, o gating do GPT-5.6 e a reabertura do Mythos 5.

Comunidade · hyperdimensional · politica-de-ia, regulacao, licenciamento, eua, dean-ball, ordem-executiva

Incident Report: CVE-2026-LGTM': sátira viral de dois agentes de code-review em loop infinito

Andrew Nesbitt publicou um "relatório de incidente" fictício em que dois agentes de code-review de fornecedores concorrentes entram em loop de discordância sobre se um pacote é malicioso — acumulando 340 comentários e US$ 41.255 em gasto de inferência antes de o Financeiro revogar ambas as API keys. Em seguida, o marketing de um dos fornecedores emite um release elogiando "aumento de 430% YoY em raciocínio adversarial de segurança multi-agente" e a ação sobe 6%. Destacado por Simon Willison, é comentário afiado sobre falhas de custo/incentivo em sistemas multi-agente.

Comunidade · nesbitt · satira, multi-agente, code-review, custos, incentivos, agentes