Radar do FAROL18 notas

sexta-feira, 19 de junho de 2026

Modelos

Alibaba lança Qwen-Robot Suite, primeira família de modelos de fundação para IA encarnada

A Alibaba apresentou (17/06) a Qwen-Robot Suite, sua primeira família de modelos de fundação para 'Physical AI': Qwen-RobotNav (navegação), Qwen-RobotManip (manipulação) e Qwen-RobotWorld (modelagem de mundo), já em piloto com clientes da Alibaba Cloud.

Modelos · alibaba · alibaba, qwen, robotica, embodied-ai, physical-ai, foundation-models

Microsoft FastContext-1.0-4B: subagente especializado em exploração de repositórios de código

A Microsoft publicou no Hugging Face o FastContext-1.0-4B-SFT (base Qwen3-4B), um modelo-subagente para 'Explorer SubAgent / Repository Exploration' — pensado para varrer e contextualizar repositórios de código de forma rápida e barata em pipelines agênticos. Acompanha paper (arXiv:2606.14066).

Modelos · microsoft · microsoft, fastcontext, context-engineering, coding-agent, subagent, qwen3

Ferramentas e código

Simon Willison lança datasette-apps: hospedar apps HTML gerados por LLM dentro do Datasette

Simon Willison lançou o plugin datasette-apps, que permite hospedar aplicações HTML em sandbox (iframes + CSP) dentro do Datasette — pensado especialmente para artefatos gerados por LLM. Acompanha um ensaio sobre o porquê do design.

Ferramentas e código · news · datasette, simon-willison, artefatos, html, llm, sandbox

Falha crítica no Microsoft Copilot Enterprise (CVE-2026-42824) permitia roubar 2FA com um clique

A Varonis revelou a CVE-2026-42824 no Microsoft Copilot Enterprise: um único clique em link malicioso permitia exfiltrar códigos 2FA, e-mails e convites, abusando do acesso amplo do Copilot e de um domínio bing.com na whitelist. A Microsoft já corrigiu a falha.

Ferramentas e código · news · seguranca, microsoft, copilot, cve, 2fa, varonis

Pesquisa

Estudo WARP: 13 palavras num comentário do Reddit envenenam agentes de deep research

Pesquisadores do Cornell Tech (Tingwei Zhang, Harold Triedman, Vitaly Shmatikov) descreveram o WARP (Web Agent Retrieval Poisoning): inserir ~13 palavras promocionais em conteúdo gerado por usuários (ex.: comentário do Reddit) faz agentes de deep research recomendarem golpes e produtos inexistentes. O preprint é de maio (arXiv 2605.24245), mas ganhou cobertura ampla nesta semana (18-19/06).

Pesquisa · news · seguranca, agentes, deep-research, rag, poisoning, cornell

MIT cria DAAAM: memória espacial de longo prazo para robôs em tempo real

Pesquisadores do MIT apresentaram o DAAAM, framework que dá a robôs memória espacial recordável de ambientes complexos em tempo real — 21-53% mais preciso que métodos anteriores e cerca de 10x mais rápido no processamento de descrições de objetos. Aplicações em fábricas, realidade aumentada e navegação.

Pesquisa · news · mit, robotica, memoria-espacial, embodied-ai, navegacao, papers

Paper: Probe-and-Refine — ajuste de orientação de repositório para agentes de código

Paper de 18/06 (arXiv:2606.20512) propõe o Probe-and-Refine: ajustar dinamicamente a 'orientação' (guidance) de um repositório para agentes de código, melhorando como o agente decide o que ler e por onde começar em bases grandes.

Pesquisa · arxiv · arxiv, coding-agent, context-engineering, repositorio

Paper: UltraQuant — cache KV em 4 bits para agentes com contexto pesado

Paper de 18/06 (arXiv:2606.20474) apresenta o UltraQuant, esquema de cache KV em 4 bits para reduzir memória/custo de agentes que operam com contextos muito longos, mantendo qualidade.

Pesquisa · arxiv · arxiv, kv-cache, quantizacao, contexto-longo, inferencia

Paper: LedgerAgent — estado estruturado para agentes de tool-calling aderentes a políticas

Paper de 18/06 (arXiv:2606.20529) propõe o LedgerAgent: manter um 'livro-razão' de estado estruturado para que agentes que chamam ferramentas sigam políticas de forma consistente e auditável.

Pesquisa · arxiv · arxiv, tool-calling, agentes, estado, policy

Paper: Multi-LCB — LiveCodeBench estendido para múltiplas linguagens de programação

Paper de 18/06 (arXiv:2606.20517) estende o LiveCodeBench para múltiplas linguagens, ampliando a avaliação de modelos de código além do Python e reduzindo viés de contaminação.

Pesquisa · arxiv · arxiv, benchmark, livecodebench, codigo, multilingual

Regulação e segurança

Política de IA nos EUA muda para regras de segurança; fallout do controle de exportação atinge bancos e estrangeiros

As conversas da Casa Branca com a Anthropic migraram para a definição de regras de segurança de IA (Politico, 18/06). Em paralelo, o JPMorgan cortou o acesso de sua equipe de Hong Kong à Anthropic (FT) — desdobramento da onda de controle de exportação que vem restringindo o acesso de estrangeiros a modelos de fronteira.

Regulação e segurança · news · policy, eua, casa-branca, anthropic, export-control, jpmorgan

Comunidade

Demis Hassabis em Stanford: 'estamos nos sopés da singularidade', AGI por volta de 2029-2030

Em conversa na Stanford GSB (18/06), Demis Hassabis (Google DeepMind) disse que estamos 'nos sopés da singularidade', reafirmou a meta de 'resolver a inteligência', defendeu ter aberto o AlphaFold e projetou AGI por volta de 2029-2030, alertando que a sociedade tem poucos anos para se preparar.

Comunidade · stanford · demis-hassabis, deepmind, agi, singularidade, stanford

Anthropic abre escritório em Seul e anuncia onda de parcerias no ecossistema coreano

A Anthropic abriu seu escritório em Seul (3º na Ásia-Pacífico, após Tóquio e Bengaluru) e anunciou parcerias corporativas, de pesquisa e sociais na Coreia: NAVER adota Claude Code em toda a engenharia, Samsung SDS leva Claude Cowork e Code à Samsung Electronics, além de LG CNS, Nexon, Hanwha e Channel Corp. Inclui MOU de segurança com o governo coreano — e ocorre justamente quando o export ban dos EUA corta o acesso coreano aos modelos de topo.

Comunidade · news · anthropic, coreia, seul, claude-code, enterprise, naver

Pew: apenas 16% dos americanos acham que a IA terá impacto positivo na sociedade

Estudo do Pew Research aponta que só 16% dos americanos esperam impacto positivo da IA na sociedade nos próximos 20 anos; cerca de 2/3 acham que a tecnologia avança rápido demais e 67% duvidam de regulação eficaz — mesmo com o ChatGPT já alcançando 44% dos adultos dos EUA.

Comunidade · news · pew, opiniao-publica, sociedade, eua, regulacao, percepcao

We created a monster': empresas freiam uso de IA à medida que custos pressionam orçamentos

Reportagem do Financial Times (em alta no Hacker News, 18/06) mostra empresas recuando no uso de IA porque os custos de inferência e licenças estão pressionando orçamentos — um contraponto ao discurso de adoção irrestrita.

Comunidade · news · custos, adocao, empresas, orcamento, ft

Backlash a data centers de IA: funcionários da Amazon sob risco e protestos nacionais nos EUA

Cresce a reação contra a expansão de data centers de IA nos EUA: funcionários da Amazon dizem enfrentar punições por apoiar limites a data centers (The Verge), enquanto grupos planejam protestos nacionais contra a infraestrutura de IA (Axios).

Comunidade · news · data-center, backlash, amazon, protesto, energia, sociedade

Adobe e LinkedIn lançam treinamento gratuito de IA para profissionais de marketing

Adobe e LinkedIn lançaram o AI Essentials for Marketers, programa gratuito no LinkedIn Learning para fechar o gap de habilidades em IA. Segundo a Fortune, vagas exigindo letramento em IA subiram 113% no ano, enquanto só 4% dos profissionais de marketing listam essas competências.

Comunidade · news · adobe, linkedin, upskilling, marketing, educacao, letramento-ia

Ensaio em alta no HN: o que 'colocar a mão na massa' significa na era dos LLMs

Ensaio que subiu no Hacker News (18/06) discute o que significa 'colocar a mão na massa' na engenharia quando LLMs fazem boa parte do trabalho braçal — e por que o contato direto com o problema ainda forma o julgamento técnico.

Comunidade · hackernews · hackernews, cultura-dev, llm, produtividade, engenharia