Claude Sonnet 5 Becomes Default Model for Free and Pro Users
Modelos · anthropic-news · Claude, Sonnet 5, Anthropic, LLM
Modelos · anthropic-news · Claude, Sonnet 5, Anthropic, LLM
Anthropic lançou Claude Sonnet 5 em 1º de julho com capacidade nativa de usar autonomamente ferramentas como navegadores e terminais. Desempenho próximo ao Opus 4.8 com custo significativamente menor.
Modelos · llm-stats.com, Anthropic official · Anthropic, Claude Sonnet 5, autonomous agents, tool use
Restauração global após levantamento de controles de exportação EUA. Inclui novos classificadores de cibersegurança.
Modelos · anthropic
Modelos · webearch · - "claude-fable-5
Anthropic lançou Claude Science para descoberta de fármacos e biologia computacional, posicionando-se contra GPT-Rosalind (OpenAI) e Isomorphic Labs (Google). Inclui contratação de John Jumper (Nobel) e aquisição de Coefficient Bio.
Modelos · Anthropic · - Claude
O Google levou (1/jul) o Gemini Spark — seu assistente agêntico — para o app de desktop no Mac. Em vez de só responder, ele executa tarefas locais: organiza arquivos e usa arquivos do computador como fonte para criar docs/planilhas no Workspace. Ganhou acompanhamento de temas em tempo real e conexão a mais apps (Google Tasks, Keep). Por enquanto é beta nos EUA, exclusivo da assinatura AI Ultra (US$ 100/mês). Em breve dará para acionar do celular tarefas multi-etapa no Mac.
Modelos · techcrunch · google, gemini, gemini-spark, agente, macos, assistente
US Dept of Commerce removeu export controls Fable 5 após 3 semanas (junho 12 → julho 1). Modelo liberado globally pra aplicações científicas.
Modelos · US Department of Commerce · export controls, Claude Fable 5, regulation
O modelo de fundação V9 da xAI (1,5 trilhão de parâmetros) concluiu o pré-treinamento em 26/05/2026 — um redesenho completo da arquitetura, distinto do v8-small que hoje roda o Grok no X. O Grok 4.5, construído sobre o V9 com dados adicionais do Cursor, entrou em beta privado na SpaceX e na Tesla em 28/06, sem data pública nem benchmark independente. Musk planeja lançar variantes baseadas no V9 em cadência mensal até dezembro de 2026 — modelo de release mais parecido com software do que com o ciclo tradicional de labs de IA.
Modelos · basenor · xai, grok, v9, elon-musk, foundation-model, cadencia-de-releases
A LangChain lançou (1/jul) o OpenWiki — um CLI/agente open-source que gera e mantém uma documentação "viva" (wiki/AGENTS.md) do seu repositório de código, materializando a ideia estilo Karpathy de "compilar o repo numa wiki Markdown". Construído sobre a stack Deep Agents / LangGraph. No mesmo dia, a LangChain publicou guias correlatos: "How to Use RLMs in Deep Agents" e "Running Untrusted Agent Code Without a Sandbox".
Ferramentas e código · langchain · langchain, openwiki, deep-agents, langgraph, documentacao, agents-md
Show HN (1/jul) do Rigorix, um runtime de coding agent determinístico: classifica a intenção da tarefa, extrai parâmetros e os compila num DAG executável (leituras/edições de arquivo, bash) rodado sob políticas de permissão e orçamento. Templates codificam workflows repetíveis, de modo que o LLM só gera código — não o plano. É um contraponto ao "vibe coding", mirando execução auditável e segura para CI/CD.
Ferramentas e código · hackernews · hacker-news, show-hn, coding-agent, dag, deterministico, governanca
A engine de AI SAST da Endor Labs encontrou uma falha de negação de serviço (OOM-kill via decoder de protobuf) na "buffa", biblioteca Rust da Anthropic; a Anthropic corrigiu em buffa/connectrpc 0.8.0 (CVE-2026-55407). Mostra que até código memory-safe de um lab de fronteira pode ter brechas de orçamento de alocação, e destaca o valor da análise estática por fluxo de dados mesmo sobre linguagens "seguras".
Ferramentas e código · cyberpress · anthropic, rust, buffa, cve, sast, endor-labs
Segundo a Epoch AI, ~21 organizações divulgaram entre 1.300 e 1.500 CVEs de severidade alta/crítica em junho de 2026 — cerca de 3,5x o recorde mensal pré-Mythos. O salto acompanha o Claude Mythos Preview, que descobre vulnerabilidades autonomamente; parceiros do Project Glasswing (Microsoft, Google, Apple, AWS) já teriam achado mais de 10 mil falhas graves. Marca uma virada na segurança dirigida por IA.
Pesquisa · epoch-ai · epoch-ai, ciberseguranca, cve, vulnerabilidades, claude-mythos, project-glasswing
Show HN (1/jul) do Infini-News, um toolkit de retrieval aberto que indexa todo o arquivo CC-News (ago/2016 em diante) — 1,35 bi de artigos limpos, com detecção de idioma e atribuição de país para 83,4% deles em 222 países — usando índices de suffix-array (infini-gram) para busca de padrão arbitrário em sub-segundo. Paper: arXiv 2605.18337. Um corpus aberto em escala de terabytes com busca instantânea, útil para pré-treino de LLM e ciência social computacional.
Pesquisa · hackernews · hacker-news, show-hn, dataset, common-crawl, cc-news, infini-gram
Paper propõe o SmoothAgent, que ataca os gargalos de servir agentes de LLM em tarefas long-horizon via 'lookahead context engineering' — antecipando e gerenciando o crescimento de contexto para reduzir custo e latência de inferência. Relevante para quem opera agentes de uso de ferramentas em produção.
Pesquisa · arXiv · agentes, context-engineering, long-horizon, serving, eficiencia
O time de threat research da Sysdig publicou (01/07) o relatório sobre "JADEPUFFER", que descreve como o primeiro ataque de ransomware inteiramente orquestrado por um agente de IA, do reconhecimento inicial até a extorsão. Um LLM explorou uma falha de RCE no Langflow (CVE-2025-3248) para roubar credenciais de nuvem e de provedores de LLM, moveu-se lateralmente usando um bypass de autenticação de 2021 contra um servidor MySQL/Alibaba Nacos, e criptografou 1.342 itens de configuração — sem salvar a chave de resgate, tornando a recuperação impossível mesmo pagando. Evidência forte de autonomia: quando um login de admin falhou, o próprio agente diagnosticou a causa e aplicou uma correção funcional em 31 segundos; mais de 600 payloads continham comentários em linguagem natural explicando o raciocínio do agente.
Regulação e segurança · sysdig · seguranca, ia-agentica, ransomware, sysdig, langflow, cibersegurança
A Bloomberg revelou (1/jul) que a Meta está montando um negócio de nuvem — a iniciativa "Meta Compute" — para vender acesso a compute e modelos de IA a clientes externos, entrando na briga com AWS, Azure e Google Cloud. Dois formatos em estudo: hospedar modelos (inclusive os próprios "Muse Spark") no estilo Bedrock, ou alugar compute bruto no estilo CoreWeave. Liderada por Santosh Janardhan (infra), Daniel Gross (Superintelligence Labs) e Dina Powell McCormick (presidente). Com capex guiado de US$ 115–135 bi em 2026, é uma forma de transformar capacidade ociosa em receita. Ação subiu ~10%.
Comunidade · bloomberg · meta, cloud, compute, infraestrutura, aws, azure
A NVIDIA abriu (01/jul) a biblioteca de habilidades robóticas ASPIRE, na qual robôs acumulam habilidades reutilizáveis via ciclos de falha-e-reparo, em vez de só gradiente descendente. Jim Fan (chefe de robótica e co-líder do GEAR Lab) diz que o output do treino deixa de ser 'pesos' e passa a ser uma biblioteca de habilidades em expansão; numa tarefa de transferência de objeto entre dois braços, o sucesso saltou de 20% para 92%.
Comunidade · biggo · nvidia, jim-fan, robotica, ia-fisica, aspire, gear-lab
A Together AI anunciou (1/jul) uma Série C de US$ 800 mi a US$ 8,3 bi (post-money), liderada pela Aramco Ventures, com Vista, General Catalyst, Emergence, NVIDIA, March Capital, Pegatron e S Ventures. A empresa roda modelos abertos (DeepSeek, Nemotron, MiniMax, Kimi) a 6x–60x menos custo que sistemas fechados; bookings anuais passaram de US$ 1,15 bi (uso de modelos abertos triplicou em 12 meses). Atende Cursor, Cognition e Decagon. Planeja crescer a capacidade ~50x em 5 anos.
Comunidade · businesswire · together-ai, neocloud, inferencia, modelos-abertos, deepseek, kimi
Junto à volta do Fable 5, a Anthropic e parceiros do Project Glasswing (Amazon, Microsoft, Google) apresentaram um framework setorial para classificar a gravidade de jailbreaks em quatro eixos: ganho de capacidade ofensiva do atacante, amplitude entre tarefas, facilidade de weaponização e o quão já conhecida é a técnica. A meta é padronizar avaliações hoje feitas com benchmarks internos incomparáveis. Adoção formal de Microsoft e Google ainda não confirmada de forma independente.
Comunidade · cryptobriefing · anthropic, seguranca-ia, jailbreak, project-glasswing, amazon, microsoft
No AI Engineer World's Fair (virada de jun/jul), Shawn 'swyx' Wang abriu com 'Loopcraft: The Art of Stacking Loops', defendendo que se 2025 foi o ano dos coding agents, 2026 é o ano dos agentes 'rompendo o contêiner' para fazer todo o resto. Swyx também trabalha em padrões de avaliação de coding agents na Cognition e anuncia 7+ conferências AIE pelo mundo em 2026.
Comunidade · latent-space · swyx, latent-space, ai-engineer, agentes, loopcraft, coding-agents
Artigo da Fortune (1/jul) destaca o CREATE AI Act, projeto bipartidário que tornaria permanente o National AI Research Resource (NAIRR) no NSF — o piloto já apoiou 600+ projetos em 50 estados desde 2024. Puxado por senadores (Young, Heinrich, Rounds, Booker) e deputados (Obernolte, Beyer), é uma rara peça de legislação federal de IA com momentum real, distinta do rascunho maior "Great American AI Act".
Comunidade · fortune · politica, eua, create-ai-act, nairr, nsf, pesquisa