Em post no LinkedIn e perfil da TechCrunch, Arthur Mensch reposiciona a Mistral: forward-deployed engineers no estilo Palantir, ARR acima de US$ 400 mi e um modelo open-weight 'muito empolgante' com acesso antecipado em julho.
A Anthropic apresentou o Claude Science, aplicação que otimiza o modelo para uso em laboratórios científicos, com foco em operações de P&D de farmacêuticas.
Novo Leanstral 1.5, MoE de 119B com ~6B ativos sob Apache-2.0, aparece no HF (criado em 01/07) — a família de agente de código open-source da Mistral, alinhada à promessa de abrir pesos em julho.
NVIDIA anuncia recorde de 35 supercomputadores de IA/HPC em desenvolvimento na Europa com a nova plataforma Vera Rubin (FP64 nativo, CUDA-X), atendendo mais de 3 milhões de pesquisadores.
A versão oficial do DeepSeek V4 chega em meados de julho com 1M de contexto em toda a linha e, pela primeira vez, tarifação de API diferenciada por horário de pico (até 2x o valor normal).
Modelos · news · deepseek, v4, precificacao, api, contexto-1m, china
Post de 02/07 da LangChain analisa por que os custos de agentes de código explodem (acúmulo de contexto, retries, sub-agentes) e traz táticas de sumarização e controle de loop para conter a fatura.
Ferramentas e código · blog · langchain, agentes, custo, context-engineering, claude-code, tokens
Modelo agêntico Mixture-of-Experts de 35B (InternScience) que atinge desempenho de nível trilhão de parâmetros escalando trajetórias de longo horizonte, com treino em três estágios (SFT, professores de domínio e destilação multi-professor).
O framework Vera avaliou agentes não determinísticos — incluindo OpenClaw, Hermes, Codex e Claude Code — com taxa média de sucesso de ataque de 93,9% em ataques multi-canal. Os autores liberam também o Vera-Bench, com 1.600 casos executáveis cobrindo 124 categorias de risco.
"Don't Blame the Large Language Model: How Scaffolding Evolution Shapes Coding Agent Quality" (Ben Sghaier, Li, Adams, Hassan — 04/07) é um estudo longitudinal que isola mudanças no "scaffolding" (a camada de orquestração/ferramentas/loops de raciocínio ao redor do LLM) mantendo o modelo constante, e mostra flutuações significativas de qualidade no SWE-bench Verified ligadas a alterações arquiteturais específicas do scaffolding — não do modelo em si.
Documentos abertos em processo expõem a troca tensa entre Dario Amodei e o subsecretário Emil Michael: o Pentágono queria liberar o Claude para 'qualquer uso legal', incluindo armas letais autônomas e vigilância; a Anthropic recusou.
Comunidade · news · anthropic, pentagono, governanca, armas-autonomas, dario-amodei, politica-ia
Na edição 360 (03/07), Andrew Ng alerta que mídia social, mídia tradicional e um exército de marketeiros produzem uma cacofonia de hype que muitas vezes é pitch de vendas disfarçado — e pede senso crítico.
Comunidade · news · andrew-ng, the-batch, hype, senso-critico, opiniao
Microsoft comunicou ao time de 11 mil pessoas do Copilot que o produto precisa "conquistar o direito de existir" e vai unificar os apps Copilot (consumidor e empresa) num único produto até o fim do verão. Nova camada paga "AutoPilot" trará agentes "always-on" para tarefas rotineiras.
Comunidade · web · microsoft, copilot, reestruturacao, autopilot, agentes, produto