Terceira prorrogacao em cinco semanas: Pro, Max, Team e Enterprise seguem usando o Fable 5 sem custo extra (ate 50% do limite semanal) ate 19/07 as 23:59 PT. Depois disso o modelo deve migrar para pay-per-use. O adiamento e lido como falta de compute para bancar o modelo dentro das assinaturas.
Cobertura do AINews sobre a familia nova e a fusao Codex + ChatGPT Work, com o Sol posicionado como classe frontier a metade do custo do Fable 5. A ressaca do lancamento: naming confuso (Sol/Terra/Luna x Ultra/Pro/Extended) e creditos mal explicados; a propria OpenAI admitiu rollout 'bumpy'.
GLM-5.2 (744B) lidera SWE-bench Pro e Terminal-Bench entre os open-weight, ao lado de Kimi K2.7 (~1T) e DeepSeek V4 Pro (1.6T). Para quem roda em GPU unica, Gemma 3 27B e Phi-4 14B seguem como as opcoes praticas.
Modelos · websearch · open-weights, glm, kimi, deepseek, china
Post em circulacao na comunidade sistematiza padroes de curadoria de contexto, compressao de tokens e arquitetura multiagente — reforcando a tese de que falhas de agente sao falhas de gestao de estado, nao de prompt.
Ferramentas e código · websearch · agent-skills, context-engineering, multiagente
Willison publica o transcript completo do agente e destaca o prompt mais util da sessao: mandar o modelo TESTAR MANUALMENTE o proprio codigo alem dos testes automatizados — o que revelou dois bugs que a suite nao pegou.
Ferramentas e código · simonwillison · simon-willison, codex, gpt-5-6, coding-agents
Update de 12/07: toda resposta da API devolve o custo exato em cost_in_usd_ticks, e o Grok Build recebe ditado por voz (/voice ou Ctrl+Space). Primeira vez que o Grok Voice aparece como recurso nativo de produto, e nao so como API.
Ferramentas e código · websearch · xai, grok, api, voice
Apos a suspensao dos controles de exportacao dos EUA, a Anthropic republicou o Fable 5 com um classificador que bloqueia >99% das tentativas do jailbreak reportado pela Amazon e reroteia pedidos suspeitos para o Opus 4.8. Junto com Amazon, Microsoft e Google, esta montando uma rubrica conjunta de severidade de jailbreak com quatro eixos: ganho de capacidade, alcance, facilidade de weaponizacao e descobribilidade.
721 pontos e 322 comentarios. A comunidade do HN discute rotular conteudo gerado por IA — sintoma da pressao de 'AI slop' sobre as fontes de curadoria tecnica que ainda funcionavam por reputacao humana.
Comunidade · hackernews · hackernews, ai-slop, curadoria, moderacao
Post no topo do HN (323 pts, 164 comentarios) confrontando o discurso publico da Anthropic sobre codificacao agentica com a posicao mais direta do criador do Zed. Debate quente sobre marketing versus realidade tecnica dos coding agents.
Comunidade · hackernews · hackernews, anthropic, zed, debate
Willison resgata o conceito de Directly Responsible Individual (Apple/GitLab) para argumentar que responsabilidade final e humana por definicao — ecoando o slide da IBM de 1979: 'um computador nunca pode ser responsabilizado, portanto nunca deve tomar uma decisao gerencial'.
Comunidade · simonwillison · simon-willison, accountability, agentes
No mesmo dia da prorrogacao do Fable 5, strings apontando para um Claude Opus 5 apareceram no Cursor, alimentando especulacao de que a Anthropic prepara o proximo carro-chefe enquanto empurra o paywall do Fable para frente.
Comunidade · websearch · anthropic, opus-5, leak, cursor
Anthropic estendeu o Fable 5 nos planos pagos ate 19/07 enquanto a OpenAI removeu temporariamente o limite de 5h e anunciou 6M de usuarios ativos no Codex/ChatGPT Work. Willison avalia que a incerteza de pricing da Anthropic esta empurrando desenvolvedores para o lado da OpenAI.
Comunidade · simonwillison · simon-willison, anthropic, openai, codex
Na esteira do Global Dialogue on AI Governance da ONU (Genebra, 6-7/07), o governo americano esta em conversas avancadas com os labs sobre padroes voluntarios de release — visibilidade antecipada sobre lancamentos de fronteira.
Comunidade · websearch · governanca, regulacao, onu, frontier-models