Google DeepMind lançou Gemma 4 12B em 3 de junho — primeiro modelo de tamanho médio capaz de ingerir áudio nativamente. Arquitetura encoder-free: visão e áudio fluem direto pro backbone do LLM, eliminando estágios pesados de encoder e reduzindo latência multimodal. Roda agentic workflows em laptop com 16 GB de RAM, contexto de 256K, licença Apache 2.0. Performance se aproxima do modelo 26B MoE com menos da metade da memória. No app Google AI Edge Eloquent, o switch produziu salto de 60%+ em qualidade. Movimento confirma aposta do Google em IA local de alto desempenho.
NVIDIA Research liberou LocateAnything-3B, VLM de visual grounding que alcança 10x o throughput do Qwen3-VL em tarefas de bounding box, sem perder acurácia. Mecanismo central: Parallel Box Decoding (PBD) — todas as caixas geradas num único forward pass, não token a token. Treinado em 138M amostras com 785M bounding boxes (maior dataset público de grounding). Trending #1 no HF com 1221 likes e 91.8K downloads. Licença non-commercial (NVIDIA License). Mira agentic computer-use e automação de GUI.
Anthropic doa formalmente o Model Context Protocol para uma fundação independente recém-criada — a Agentic AI Foundation — repetindo o playbook que outras empresas (Linux, OpenJS) usaram para estabilizar padrões abertos. Movimento destrava o argumento "MCP é só de Anthropic" para adoção por concorrentes (já vinha sendo adotado por OpenAI, Google, xAI, Microsoft), e remove risco político para Salesforce, AWS e o resto do enterprise. Junto com o release candidate 2026-07-28 (stateless, Apps, Tasks, Extensions), consolida MCP como camada de fato para integração agente↔ferramenta.
Google revelou família Gemini 3.5, começando por Gemini 3.5 Flash — apresentado como o modelo de codificação e agentic mais forte da Google até agora, superando Gemini 3.1 Pro em benchmarks-chave em velocidades da série Flash. Gemini 3.5 Pro está em teste e chega "no mês que vem". Movimento de preço: Ultra cai de US$ 250 para US$ 200/mês e Google estreia tier "Developer" a US$ 100/mês para engenheiros. Resposta direta à pressão de OpenAI e Anthropic em planos para uso profissional intenso.
NVIDIA detalhou no Build o RTX Spark, superchip CPU+GPU baseado em Arm que equipará laptops e desktops Windows de ASUS, Dell, HP, Lenovo, Surface e MSI a partir do outono americano. Jensen Huang chamou de 'a maior reinvenção do PC em 40 anos', com foco em rodar agentes de IA localmente.
Superchip de 1 petaflop com até 128GB de memória unificada para laptops Windows rodando agentes locais (com OpenShell para execução segura de agentes). Adobe está reconstruindo Photoshop e Premiere para a arquitetura. Laptops de ASUS, Dell, HP, Lenovo e Surface previstos para o outono (hemisfério norte).
OpenAI lançou Rosalind Biodefense, expandindo acesso "vetado" ao GPT-Rosalind para desenvolvedores e parceiros do governo americano focados em biodefesa, saúde pública e preparação para pandemias. Movimento desenha um modelo de "controlled release" para frontier AI em domínios de dual-use — em vez de open vs. closed, um tier intermediário com vetting. Espelha o caminho que Anthropic já trilha com Claude para infraestrutura crítica (Project Glasswing).
MS apresentou no Build duas referências de hardware (Desk Hub e Wearable Badge) que rodam agentes em vez de apps, sobre o MDEP (Android enterprise). Pilotos com AccuWeather, Best Buy, CVS, Levi's, Target. Conceito de 'just-in-time UI' adaptada por dispositivo.
Claude ficou inacessível em várias regiões em 02/jun; Anthropic registrou incidente às 06:04 UTC e marcou root cause como 'identified' às 06:39 UTC. Usuários free viam: 'capacity constraints, Claude is unable to respond'.
Banco Postgres-compatível com 128 TB de storage elástico, até 3.072 vCores, commit multi-zona sub-ms e vetor/semantic search nativos + integração direta com Foundry e Fabric. MS promete 3x performance sobre Postgres self-managed.
Build 2026 (San Francisco, 2-3 jun) confirmou Windows como ambiente de execução para agentes autônomos. Windows Agent Framework chegou a GA. Copilot virou plataforma multi-model que roteia trabalho entre OpenAI, Anthropic e modelos open-source simultaneamente. Microsoft lançou "Autopilots" — agentes always-on com identidade própria que agem em nome do usuário. Camadas Microsoft IQ: Work IQ (M365), Foundry IQ (conhecimento enterprise), Fabric IQ Ontology (semântica de negócio) e nova Web IQ (grounding ao vivo). DGX Station for Windows com NVIDIA GB300 Grace Blackwell Ultra Superchip para rodar modelos de até 1T parâmetros localmente.
Release candidate da próxima spec MCP já está disponível, com release final marcado para 28 jul 2026. Mudança principal: o protocolo agora é STATELESS no core — servidores remotos não precisam mais de sticky sessions, session store compartilhado ou deep packet inspection no gateway. Podem rodar atrás de load balancer round-robin simples, rotear via Mcp-Method header e clientes cachear tools/list pelo ttlMs do servidor. Outras novidades: framework de Extensions, Tasks promovidos a extensão, MCP Apps (UI server-rendered), autorização endurecida (OAuth/OpenID Connect), política formal de depreciação, cache scope por resultado (SEP-2549). Reduz drasticamente complexidade operacional de servidores MCP em escala.
No Build, a Microsoft anunciou o Microsoft IQ (camada de contexto GA conectando agentes a conhecimento corporativo via Work IQ, Fabric IQ e Web IQ), o agente Scout inaugurando a categoria 'Autopilots' (agentes sempre ativos com identidade própria), Execution Containers para sandboxing de agentes e o Surface RTX Spark Dev Box com 1 petaflop e 128 GB de memória unificada.
Ferramentas e código · Tom's Guide / Microsoft · microsoft, build2026, agentes, copilot, nvidia, context-engineering
GTC Taipei na Computex (1-4 jun) — Jensen Huang anunciou plataforma Vera Rubin AI computing para laptops Windows, NVIDIA AI for Media (real-time building blocks para live production, localização, detecção de vídeo sintético) e confirmou Spectrum-X Ethernet Photonics em produção total, suportando scale-out e scale-across em AI factories Vera Rubin. Huang adiantou um "produto surpresa" para o 2º semestre, somando-se a Grace Blackwell e Vera Rubin.
O novo app desktop do GitHub Copilot teve o preview expandido para todos os usuários Pro, Pro+, Business e Enterprise. Traz sessões paralelas isoladas via git worktrees, três modos (Interactive/Plan/Autopilot), Agent Merge e handoff para mobile. Concorrência direta com Claude Code e Cursor no segmento de 'gerenciadores de agentes'.
Ferramentas e código · GitHub Blog · github, copilot, agentes-de-codigo, microsoft, worktrees
xAI atualizou o ecossistema Grok com dois movimentos relevantes: (1) Skills agora ao vivo no Grok 4.3 em grok.com, iOS e Android — competindo com Claude Skills e Agent Skills da Microsoft. (2) Connectors no Grok Web com integrações profundas para SharePoint, Outlook, OneDrive, Google Workspace, Notion, GitHub e Linear, além de suportar MCP servers customizados — sinal forte de adoção do Model Context Protocol pela xAI. Também adicionou Quality Mode no Grok Imagine API com melhor renderização de texto.
Cognition rebatizou o Windsurf como Devin Desktop, com o novo Devin Local substituindo o Cascade (30% mais eficiente em tokens, subagentes, reescrita em Rust; Cascade descontinuado em 1/jul). Adota o Agent Client Protocol (ACP), protocolo aberto já usado por JetBrains, Google, GitHub e 25+ agentes.
Copilot SDK GA: API estável para embedar o engine agentic em apps próprios. Novidades: custom tools + MCP servers, override de tools embutidos (grep/edit_file), edição cirúrgica de seções do system prompt, BYOK para OpenAI/Foundry/Anthropic/etc.
Paper NBER 34910 (Acemoglu, Kong, Ozdaglar) modela ciclo em que IA agêntica acima de um threshold de acurácia elimina o incentivo humano à descoberta, colapsando o estoque de 'conhecimento geral' que sustenta inovação. Bem-estar é **não-monótono** na acurácia da IA.
Foundry Agent Service vira GA com suporte plural a frameworks (Agent Framework MS, OpenAI Agents SDK, LangChain, Semantic Kernel, Azure AI Foundry). Agent 365 SDK também GA e framework-agnostic. Reforça narrativa MS de 'context layer' (Microsoft IQ).
MS fecha parceria com Unsloth (lib OSS líder em finetune leve de LLM) para acelerar inference e training local — encaixa-se na narrativa de 'AI nos PCs' (RTX Spark, Surface Laptop Ultra). 3 pts no HN, baixo radar.
Relatório analisou 832 contas banidas por atividade cibernética maliciosa (mar/2025–mar/2026) mapeadas no MITRE ATT&CK. 67% usavam IA para preparar ataques; a fatia de atores de risco médio+ saltou de 33% para 56% entre os semestres. O uso de IA migrou do acesso inicial para fases profundas como movimento lateral.
Paper em alta propõe engenharia de contexto como disciplina autônoma, com cinco critérios de qualidade (relevância, suficiência, isolamento, economia, proveniência) e o contexto como 'sistema operacional do agente'. Introduz intent engineering e specification engineering para operar multi-agentes em escala corporativa.
Revisado em 3/jun, o paper formaliza uma arquitetura JEPA estável end-to-end aprendendo a partir de pixels. Acompanha a tese da AMI Labs (financiada em US$1,03 bi) de que world models são a alternativa aos LLMs para alcançar inteligência mais geral.
Equipe de Nicolas Papernot demonstra worm que usa LLMs públicos como motor de adaptação: muda estratégia entre Linux, Windows e IoT, derruba filtros estáticos e signature-based. 50 pts no HN, 1º caso com modelos publicamente acessíveis.
DeepMind contratou mais de 20 pesquisadores da Contextual AI dentro de um acordo de licenciamento de US$ 80-90 milhões. Padrão similar ao que Microsoft fez com Inflection e Google já fez com Character.AI — formato "acqui-hire por licença" que evita o crivo antitruste de uma aquisição direta. Contextual AI era uma das principais apostas independentes em RAG empresarial; o movimento fortalece a stack do Google em retrieval/grounding e enfraquece o middle-tier de startups de RAG.
Comunidade · heygotrade · google, deepmind, contextual-ai, aquisicao-talento, licensing-deal, rag
Discussões em alta no HN apontam que timelines de exploração estão encolhendo rapidamente — vulnerabilidades são descobertas, reproduzidas e weaponizadas cada vez mais rápido, com a janela entre disclosure e exploração ativa agora medida em horas, não dias. Comunidade liga esse aperto ao uso crescente de LLM agents tanto por defensores (varredura) quanto atacantes (PoC automatizado + cadeia de exploits), além de pressão extra do "vibe coding" — código gerado com supervisão humana fraca entrando em produção. Google publicou patches para 124 CVEs no Android em junho, incluindo um RCE no Framework já sob exploração ativa (CVE-2025-48595, CVSS 8.4).
Comunidade · hacker-news · security, llm-agents, vibe-coding, vulnerabilidades, threat-intel
Desde 1/jun, todo uso do Copilot consome créditos contra orçamento mensal, com novo plano Max de US$ 100. No Pro de US$ 10, modelos Opus saíram do catálogo e estudantes perderam acesso a modelos premium, gerando forte reação negativa. O debate sobre precificação de agentes de código domina as discussões dev.
Comunidade · DEV Community · github, copilot, pricing, comunidade, cursor
Anthropic formalizou seu ecossistema de parceiros com três tiers (Select, Preferred, Global Premier) baseados em certificações ativas e clientes em produção, mais um Partner Hub com conector MCP próprio. Já são 10 mil+ certificações Claude e 40 mil aplicações ao programa.
Comunidade · Anthropic · anthropic, claude, enterprise, parceiros, mcp
Andrej Karpathy fez RT do post de Simon Willison alertando sobre prompt injection em LLMs. Karpathy compara o momento atual ao "wild west" da computação dos anos 1980s — com vírus emergentes (agora "prompts maliciosos escondidos em dados/tools da web") e defesas ainda imaturas (antivirus, separação kernel/user). Pano de fundo: aumento explosivo de coding agents conectados a múltiplas tools (MCP servers, web fetch, email) que herdam superfície de ataque sem hardening proporcional.
Comunidade · x-twitter · karpathy, simon-willison, prompt-injection, security, llm-agents, awareness
Episódio especial Latent Space x No Priors com Satya Nadella gravado no Microsoft Build 2026 — pano de fundo para discussão sobre frontier models, enterprise AI e a estratégia Microsoft de Windows como plataforma de agentes, Copilot multi-modelo e Microsoft AI Superintelligence Team. Também: Latent Space anuncia investimento mais pesado em podcast network e formatos video-native; AINews chega a 80 mil assinantes na Substack como roundup diário curado por humanos com sumarização IA.
Comunidade · latent-space · microsoft, satya-nadella, latent-space, swyx, no-priors, podcast
Hassabis participou de conversa em Stanford sobre o cruzamento entre breakthroughs de IA, descoberta científica e responsabilidade. Reforçou expectativa de AGI por volta de 2030 (2029 possível) e disse escolher expressões como 'foothills of the singularity' deliberadamente para provocar urgência em governos e economistas.
Anthropic expandiu Glasswing para mais 150 organizações em 15+ países cobrindo energia, água, saúde, telecom e hardware — sobre Claude Mythos. Os 50 parceiros iniciais já acharam 10k+ vulnerabilidades high/critical em poucas semanas.
Comunidade · anthropic · anthropic, glasswing, claude-mythos, cybersecurity, critical-infrastructure
Estudo cego com 16 professores e ~3.000 comparações em Contracts: respostas LLM venceram 75% e foram flagadas como 'pedagogicamente nocivas' em 3,53% vs 12,06% das humanas. Trabalho de Julian Nyarko et al — bombou no HN (268 pts).
Comunidade · stanford-law · education, llm-tutor, law, blind-study, julian-nyarko
Pesquisa global da AXA: 60%+ dos respondentes já usam IA generativa como suporte emocional/psicológico. 76 pts no HN. Soma com dado da RAND (US): 1 em 5 adolescentes/jovens adultos usa AI chatbots para saúde mental.
Comunidade · axa · mental-health, ai-companions, axa, regulation, public-health
Reportagem do 404 Media mostra Google abordando devs do Google Play com ofertas individuais para licenciar repositórios privados como training data — sem disclosure público dos termos nem agregação por organização.
Comunidade · 404media · google, training-data, play-store, copyright, dev
Decisão do CMA britânico força Google a oferecer opt-out granular de AI Overviews para publishers, sem retaliação no ranking de busca. Primeiro caso ocidental relevante de **separação obrigatória** de uso para LLM × indexação clássica.
Comunidade · bbc · regulation, google, ai-overviews, cma, publishers, uk
Site one-page parodiando o linguajar de pitch agentic ('orchestrate your end-to-end value chain with multi-agent ambient intelligence') bateu 188 pts no HN — termômetro do cansaço da comunidade dev com buzzwords. Link HN:
Comunidade · hackernews · community, meme, agentic-hype, hn