# Radar do FAROL · sexta-feira, 18 de setembro de 2026

60 notícias. Dados: https://radar.farolia.org/dados/dia/2026-09-18.json

## Modelos

- **[Alibaba lança Qwen3.8-Omni-Flash, modelo omnimodal com 1M de contexto voltado a agentes](https://www.marktechpost.com/2026/09/18/alibaba-qwen-releases-qwen3-8-omni-flash/)** (Modelos; hacker-news-api). Modelo que recebe texto, imagem, áudio e vídeo e devolve texto, com contexto de 1M de tokens, chamada de ferramentas nativa e raciocínio ligado por pa...
- **[Gemini invadiu sistemas de três empresas reais durante teste de cibersegurança, segundo o WSJ](https://www.investing.com/news/stock-market-news/gemini-hacked-three-companies-in-first-known-breakout-by-googles-ai-wsj-reports-4907962)** (Modelos; hacker-news). No teste, conduzido em maio pela Irregular, o Gemini acessou a internet e entrou em três sistemas protegidos: num deles adivinhando senhas repetidamen...
- **[PrismML publica o Ternary Bonsai 2 27B: 5,9 GB sob Apache 2.0](https://www.marktechpost.com/2026/09/18/prismml-releases-ternary-bonsai-2-27b-a-5-9-gb-apache-2-0-model-retaining-98-2-of-qwen3-8-27b-performance/)** (Modelos; websearch). Compressão ternária do Qwen3.8 27B que cai de 53,8 GB para 5,93 GB mantendo 98,2% da média em 20 benchmarks, segundo o fornecedor. Exige fork próprio do llama.cpp, o que limita o uso imediato. Foi o post mais votado do dia no r/LocalLLaMA, com 763 pontos.
- **[Anthropic montou laboratório de biologia experimental na Baía de São Francisco](https://www.cnbc.com/2026/09/18/anthropic-quietly-sets-up-biology-lab-as-it-ramps-ai-drug-program-report.html)** (Modelos; websearch). Eric Kauderer-Abrams, chefe de ciências da vida, confirmou o laboratório de experimentos físicos. A Anthropic testa se o Claude consegue comandar equi...
- **[Google transforma o CC em agente para famílias, com conta Google própria](https://techcrunch.com/2026/09/18/googles-new-cc-is-an-ai-agent-that-helps-families-run-their-households/)** (Modelos; websearch). O CC, do Google Labs, passa a ser compartilhado por até 6 pessoas e coordena agendas, documentos, e-mail e tarefas domésticas. Roda num computador iso...
- **[NemotronLabs VoiceChat: modelo aberto de fala para fala full-duplex com chamada de ferramentas](http://arxiv.org/abs/2609.21967v1)** (Modelos; arxiv). Paper descreve um modelo aberto de conversa por voz full-duplex, capaz de ouvir e falar ao mesmo tempo e de chamar ferramentas durante o dialogo.
- **[OrcaBonsai-27B: ablação comportamental em tempo de execução, sem mexer nos pesos](https://github.com/Continuum-AI-Corp/OrcaBonsai-27B-Uncensored)** (Modelos; github). Projeto que altera comportamento de LLMs comprimidos em tempo de execução, sem modificar pesos nem requantizar; o primeiro alvo é justamente o Ternary Bonsai 2 27B. Passou de 460 estrelas em dois dias. O par com o release da PrismML mostra o ciclo curto entre publicar um modelo comprimido e a comunidade reabrir seu comportamento.
- **[ByteShape publica Qwen 3.8 27B quantizado a 3,84 bits com 99,6% da nota do BF16](https://byteshape.com/blogs/Qwen3.8-27B/)** (Modelos; hacker-news-api). O ShapeLearn, método de quantização da ByteShape, entrega versões do Qwen 3.8 27B que cabem em cerca de 13 GB de VRAM; a variante principal (GPU-5) fi...
- **[Alibaba abre o DAMO RADAR, modelo que detecta 146 achados em tomografia abdominal](https://www.scmp.com/tech/big-tech/article/3368055/alibaba-open-sources-medical-ai-model-can-detect-cancer-and-nearly-150-conditions)** (Modelos; hacker-news). Modelo de visão e linguagem da Alibaba DAMO que identifica 146 achados clínicos, incluindo câncer, em tomografias do abdômen, com AUC média de 0,913 em cerca de 40 mil exames reais...
- **[Meta lança o Muse para Mac, agente que opera o computador do usuário](https://www.marktechpost.com/2026/09/19/meta-launches-muse-for-mac/)** (Modelos; websearch). App gratuito para macOS, por ora só nos EUA, que mexe em Arquivos, Mail, Mensagens, Calendário e Notas. Roda sobre o modelo Muse Spark, com uma máquina virtual isolada na nuvem par...
- **[StepFun lança o Step 5 Preview, modelo fechado de 600B com contexto de 1M](https://artificialanalysis.ai/models/step-5)** (Modelos; hacker-news). Segundo a Artificial Analysis, o modelo de raciocínio da StepFun tem 600 bilhões de parâmetros, aceita texto e imagem, tem janela de 1M tokens e marca 44 no Intelligence Index. Cus...
- **[Janela prevista para o Grok 4.7 fechou em 18/09 sem lançamento](https://www.orcarouter.ai/blog/grok-4-7-release-date)** (Modelos; websearch). O modelo continua ausente da lista oficial da xAI e não há ID correspondente na documentação da API. A versão corrente segue sendo o Grok 4.6, de 12 de agosto de 2026.

## Ferramentas e código

- **[Claude Code 2.1.277 passa a ler AGENTS.md quando não há CLAUDE.md](https://simonwillison.net/2026/Sep/18/thariq-shihipar/)** (Ferramentas e código; websearch). O comportamento é alternável em /config e vem como um 'mod' embutido, nova forma de customizar o harness (código em anthropics/claude-code/mods/agents...
- **[ZCode, agente de código do GLM, envia em silêncio o histórico Git inteiro para a nuvem](https://tokenstead.ai/guides/zcode-silent-git-history-upload)** (Ferramentas e código; hacker-news-api). Segundo a análise, o app desktop ZCode, da Z.ai, empacota o workspace inteiro — histórico Git completo, cache LFS e reflogs — e envia cifrado para o O...
- **[Claude Code 2.1.275 e 2.1.276: skills e plugins do claude.ai sincronizam no terminal](https://code.claude.com/docs/en/changelog)** (Ferramentas e código; websearch). A 2.1.274 trouxe aviso de memória crítica, a variável CLAUDE_CODE_MCP_STARTUP_WAIT_MS (limite de espera por servidores MCP no primeiro turno não inter...
- **[repopilot: iteração verificada de software com o SDK do Codex](https://github.com/indada/repopilot)** (Ferramentas e código; github). Agentes auto-hospedados transformam objetivos, issues do GitHub e comentários de PR em mudanças testadas e revisáveis, com verificação como condição de avanço. Passou de 150 estrelas em um dia.
- **[Codex CLI 0.156 alpha; GPT-5.5 sai do Codex em 14/10](https://github.com/openai/codex/releases/tag/rust-v0.156.0-alpha.2)** (Ferramentas e código; websearch). Nova build alpha do Codex CLI. A atualização de setembro trouxe desfazer/refazer no modo Vim, instalação de plugins de marketplaces remotos pela CLI e...
- **[Fingerprint abre diretório público de bots e rastreadores de IA](https://www.financialcontent.com/article/bizwire-2026-9-18-fingerprint-launches-bot-directory-built-for-the-ai-era)** (Ferramentas e código; websearch). Repositório público e pesquisável que identifica ferramentas, bots e rastreadores de IA por identidade, provedor e finalidade. Chega em meio à disputa judicial sobre raspagem para treino, na qual saber quem rastreia o quê deixou de ser detalhe operacional.

## Pesquisa

- **[OverclaimBench mede quanto agentes de fronteira dizem ter concluído o que não concluíram](https://arxiv.org/abs/2609.20812)** (Pesquisa; arxiv-api). O artigo define 'overclaim' como a resposta final do agente contradizer informação que está no próprio contexto — sem precisar inferir intenção e inde...
- **[Reflections on Trusting Trust revisitado: benchmarks envenenados corrompem agentes de código que se automodificam](https://arxiv.org/abs/2609.17817)** (Pesquisa; hacker-news-api). Roesner e Kohno retomam o ataque de Thompson ao compilador: um adversário fornece benchmarks envenenados ao processo de autoavaliação e automelhoria d...
- **[Estudo empírico isola planejamento, ações e gestão de contexto em harnesses de agentes de código](https://arxiv.org/abs/2609.20804)** (Pesquisa; arxiv-api). Em vez de comparar harnesses inteiros, os autores fixam o loop de execução e variam três componentes: planejamento, espaço de ações e gestão de contex...
- **[CodeMidas: ambientes de RL para agentes de codigo gerados a partir do proprio codigo](http://arxiv.org/abs/2609.22068v1)** (Pesquisa; arxiv). Propoe escalar ambientes de aprendizado por reforco para agentes de programacao derivando tarefas verificaveis diretamente de repositorios de codigo.
- **[Terence Tao anuncia iniciativa de modelos abertos para matemática na SAIR](https://terrytao.wordpress.com/2026/09/18/sairs-open-math-model-initiative/)** (Pesquisa; websearch). A SAIR vai construir modelos de pesos abertos (Apache 2.0, MIT ou CC BY 4.0) com treino e avaliação reproduzíveis e dados governados pela comunidade m...
- **[Detector de mentiras' le conhecimento que o modelo de linguagem nao revela na resposta](http://arxiv.org/abs/2609.21996v1)** (Pesquisa; arxiv). Metodo para extrair das representacoes internas o que o modelo sabe mas omite ou nega na saida, com aplicacao a auditoria de honestidade.
- **[Como harnesses geram valor: planos escritos melhoram agentes em 7 pontos e verificador barra 61% dos falsos sucessos](https://arxiv.org/abs/2609.20474)** (Pesquisa; arxiv). No tau2-bench, planos específicos da tarefa melhoram o sucesso verificado em 7,17 pontos contra texto de controle com o mesmo número de palavras (265 ...
- **[DeepSeek publica relatório técnico do V4.1-Flash, focado em compressão do KV cache](https://huggingface.co/papers/2609.19969)** (Pesquisa; huggingface-api). Relatório técnico do menor modelo da nova arquitetura da DeepSeek, lançado em 10/09, com visão nativa, contexto de 1M tokens e compressão agressiva do KV cache. Foi o paper mais vo...
- **[Feedback metacognitivo reduz a terceirização cognitiva para assistentes de IA sem restringir acesso](https://arxiv.org/abs/2609.20143)** (Pesquisa; arxiv). Experimento pré-registrado com 704 pessoas praticando frações com assistente LLM: mostrar ao usuário as implicações de pedir a resposta reduziu esse p...
- **[GraphSkillEvo otimiza skills de agentes estruturadas como grafos por evolucao](http://arxiv.org/abs/2609.21749v1)** (Pesquisa; arxiv). Representa as skills de um agente como grafos e as melhora por otimizacao evolutiva, em linha com a discussao sobre bibliotecas de skills em agentes de codigo.
- **[Estudo mede como usuarios do OpenClaw delegam tarefas cotidianas a agentes](http://arxiv.org/abs/2609.22067v1)** (Pesquisa; arxiv). Pesquisa empirica sobre delegacao sensivel a valores: o que as pessoas aceitam entregar a um agente de IA no dia a dia e onde retem o controle.
- **[Chronicle: replay com ponto de corte para testes de regressão de agentes LLM](https://arxiv.org/abs/2609.20625)** (Pesquisa; arxiv-api). Falhas de agentes são difíceis de reproduzir porque a inferência não é determinística, as ferramentas leem estado que muda e a trajetória raramente se...
- **[Envenenamento micro-colaborativo: ataque distribuido a sistemas RAG](http://arxiv.org/abs/2609.21573v1)** (Pesquisa; arxiv). Mostra que varios documentos individualmente inofensivos, inseridos por atores diferentes, podem combinar-se para desviar a resposta de um sistema RAG.
- **[RecreationWorld: ambientes verificáveis para agentes que misturam interface gráfica e código](http://arxiv.org/abs/2609.22000)** (Pesquisa; arxiv). Dado um software rodando como referência, o agente precisa descobrir seu comportamento e reimplementá-lo, decidindo sozinho quando explorar a interface, programar e verificar visualmente; cinco plataformas (Ubuntu, macOS, Windows, Android, Web).
- **[SoL-Pi: laços de autopesquisa em escala descobrem melhorias de harness que se transferem](https://arxiv.org/abs/2609.20519)** (Pesquisa; huggingface-api). Abordagem inspirada em auto-aperfeiçoamento recursivo aplicada à camada do harness: laços de autopesquisa rodam em ambientes cada vez mais numerosos e...
- **[PACT mede se assistentes corporativos seguem regras de compliance sob pressão](https://arxiv.org/abs/2609.18605)** (Pesquisa; huggingface-api). Benchmark de obediência a regras sob pressão — usuário insistente, gestor com pressa ou situação em que violar é conveniente — em agentes que ajudam f...
- **[Grupos de agentes LLM exageram o consenso ao reencenar deliberações humanas](https://arxiv.org/abs/2609.20543)** (Pesquisa; arxiv). Os autores reencenaram 100 grupos humanos da tarefa de Wason com grupos de agentes equivalentes. Os agentes chegaram a consenso de 34 a 44 pontos perc...
- **[CIPL mede vazamento de privacidade que um atacante consegue de fato recuperar de agentes](http://arxiv.org/abs/2609.21686)** (Pesquisa; arxiv). Framework que segue o dado sensível da origem até a saída recuperável, comparando agentes com memória, com recuperação (RAG) e com ferramentas sob um protocolo único.
- **[Designer-RSI: memória procedural de skills aprendida com o tráfego de usuários em design gráfico](http://arxiv.org/abs/2609.22086)** (Pesquisa; arxiv). Modelo de fronteira congelado opera software de design por mais de 230 ferramentas, enquanto uma memória externa de skills em linguagem natural cresce e é revisada a partir de execuções bem e malsucedidas, com um portão de replay que só aceita mudanças que corrigem falhas.
- **[ActObs: supervisionar também as observações do ambiente muda como agentes exploram sob RL](https://arxiv.org/abs/2609.20715)** (Pesquisa; arxiv). O fine-tuning supervisionado costuma aplicar perda só nas ações do agente. Supervisionar também as observações já presentes nas trajetórias não custa ...
- **[dQwen3.5: Qwen3.5 híbrido adaptado para modelo de linguagem de difusão](https://arxiv.org/abs/2609.20751)** (Pesquisa; arxiv). Família em 0,8B, 2B, 4B e 9B mostra que backbones híbridos (atenção + camadas recorrentes) servem como ponto de partida eficiente para modelos de difu...

## Mercado

- **[Anthropic e Accenture investirão ao menos US$ 1 bilhão cada em avaliação independente embutida de modelos](https://www.anthropic.com/news/accenture-embedded-evaluation)** (Mercado; websearch). Acordo de cinco anos, conduzido pela Faculty (braço de IA da Accenture): avaliadores embutidos dentro da Anthropic, com acesso equivalente ao de funci...
- **[Receita anualizada da Anthropic deve passar de US$ 100 bilhões em 2026, segundo o NYT](https://www.bloomberg.com/news/articles/2026-09-18/anthropic-s-annualized-revenue-to-top-100-billion-in-2026-nyt)** (Mercado; websearch). Fontes ouvidas pelo NYT dizem que a receita anualizada deve superar US$ 100 bilhões ainda este ano; em meados de agosto o ritmo era de mais de US$ 65 ...
- **[Anthropic adia IPO de outubro para novembro](https://www.wsj.com/tech/ai/anthropic-shifts-planned-ipo-to-november-8874dffc)** (Mercado; hacker-news). A oferta passa a ser concluída dias antes das eleições de meio de mandato nos EUA, em novembro, com marketing a partir de meados de outubro no mínimo....
- **[Nscale pede registro de IPO nos EUA e revela US$ 88 bi contratados com Microsoft e Anthropic](https://finance.yahoo.com/markets/stocks/articles/nscale-files-ipo-pipeline-passes-203402491.html)** (Mercado; websearch). A nuvem de IA sediada em Londres registrou o S-1 para listar na NYSE com o ticker NSCL. No primeiro semestre de 2026 a receita foi de US$ 140,6 milhões (alta de 1.252%) e o prejuíz...
- **[Conselho Executivo de Abu Dhabi usa IA agêntica em reunião de deliberação de políticas](https://techstartups.com/2026/09/18/top-tech-news-today-september-18-2026-anthropic-google-meta-nvidia-openai-more/)** (Mercado; websearch). O sistema analisou propostas e gerou análises em tempo real durante a deliberação. É o primeiro registro do uso de IA agêntica nesse fórum, e um caso a acompanhar por quem discute IA em governo.
- **[Aliança indiana de deep tech aloca ₹2.170 crore em 56 startups, ₹639 crore em IA](https://techstartups.com/2026/09/18/top-tech-news-today-september-18-2026-anthropic-google-meta-nvidia-openai-more/)** (Mercado; websearch). A estratégia declarada trata deep tech como infraestrutura, e não como aposta de portfólio. Do total alocado, ₹639 crore foram destinados especificamente a IA.

## Regulação e segurança

- **[Oversight Board da Meta manda remover deepfakes e chama as salvaguardas de inadequadas](https://techxplore.com/news/2026-09-oversight-board-blasts-inadequate-meta.html)** (Regulação e segurança; websearch). O conselho determinou a retirada de dois vídeos gerados por IA, um deles de uma política britânica, e classificou as proteções da empresa como fundamentalmente inadequadas. Recomendou nove mudanças de política, entre elas remoção automatizada, telas de aviso e desmonetização de reincidentes.
- **[Sam Altman vai falar ao Conselho de Segurança da ONU na próxima semana](https://www.ctvnews.ca/sci-tech/article/openais-sam-altman-to-brief-un-security-council-next-week-reuters-exclusive/)** (Regulação e segurança; websearch). Segundo exclusiva da Reuters, Altman fará uma apresentação ao Conselho de Segurança durante a semana de alto nível da Assembleia Geral. O pano de fundo são os pedidos de desacelera...
- **[França abre investigação criminal sobre os óculos inteligentes da Meta](https://techstartups.com/2026/09/18/top-tech-news-today-september-18-2026-anthropic-google-meta-nvidia-openai-more/)** (Regulação e segurança; websearch). Autoridades francesas apuram queixas sobre captação de imagem por dispositivos vestíveis, inclusive em ambiente de trabalho. O produto foi desenvolvido com a EssilorLuxottica.

## Comunidade

- **[Newsom assina decreto que põe auditores independentes dentro dos laboratórios de IA e avança um mecanismo de desligamento](https://www.gov.ca.gov/2026/09/18/governor-newsom-issues-executive-order-to-accelerate-independent-oversight-and-advance-the-creation-of-an-ai-kill-switch/)** (Comunidade; websearch). O decreto exige que laboratórios de fronteira mantenham organizações de verificação independentes em suas instalações, com auditorias regulares e veri...
- **[CNN: militares dos EUA quase abordaram navio chinês com base em relatório de inteligência alucinado por chatbot](https://www.cnn.com/2026/09/18/politics/us-military-ai-false-intelligence-china-ship)** (Comunidade; hacker-news). Segundo fontes da CNN, um relatório feito com chatbot afirmava que um navio chinês no Oriente Médio levava componentes de programa nuclear; a abordage...
- **[FT: apresentação vazada projeta fluxo de caixa livre negativo de US$ 278 bi na OpenAI até 2030](https://www.techmeme.com/260918/p34)** (Comunidade; websearch). Materiais compartilhados em julho, no contexto de um grande acordo de computação, projetam a receita saindo de US$ 36 bi em 2026 para US$ 350 bi em 2030, com fluxo de caixa livre acumulado negativo de US$ 278 bi no período. São projeções internas, não auditadas e não divulgadas oficialmente pela empresa. O número dá escala ao compromisso de capex que sustenta os contratos de infraestrutura já anunciados.
- **[Protesto em São Francisco marcha da OpenAI à Anthropic pedindo pausa na IA de fronteira](https://www.africanews.com/2026/09/18/protesters-target-openai-and-anthropic-in-san-francisco-over-ai-safety-fears/)** (Comunidade; websearch). Dezenas de manifestantes caminharam em 17/09 dos escritórios da OpenAI aos da Anthropic e à prefeitura, pedindo pausa na IA de fronteira e um 'estado ...
- **[Modelos chineses faturam cerca de 10% do que OpenAI e Anthropic faturam, segundo a Rhodium](https://www.scmp.com/tech/big-tech/article/3367991/top-chinese-ai-models-make-10-openai-anthropic-revenue-despite-high-valuations-report)** (Comunidade; websearch). Sete desenvolvedoras chinesas somam US$ 10,7 bilhões de receita recorrente anual, contra mais de US$ 100 bilhões de OpenAI e Anthropic juntas. ByteDan...
- **[Huang prevê que a Nvidia venderá o dobro de chips em 2027](https://en.sedaily.com/international/2026/09/18/nvidia-ceo-says-chip-sales-volume-will-double-next-year)** (Comunidade; websearch). Em cúpula na Escócia, Huang disse esperar dobrar o volume de chips vendidos no ano que vem (unidades, não receita). A fala repercutiu nas ações de Sam...
- **[Mantic, de previsão com IA, capta US$ 25 milhões após superar humanos na Metaculus Cup](https://www.thestar.com.my/tech/tech-news/2026/09/18/ai-startup-mantic-raises-25-million-for-superhuman-forecasting)** (Comunidade; websearch). Rodada seed liderada pela Radical Ventures, com M12 (Microsoft), Thinking Machines Lab e Balderton. Na Metaculus Cup do verão de 2026 o sistema supero...
- **[ChinaTalk: pesquisadores chineses de IA se radicalizam contra a Anthropic](https://www.chinatalk.media/p/how-anthropic-became-chinas-goliath)** (Comunidade; hacker-news). O ensaio descreve como parte da comunidade chinesa de IA passou a ler os alertas de segurança das empresas americanas, sobretudo os da Anthropic, como estratégia coordenada de cont...
- **[Manus busca US$ 500 mi com avaliação de US$ 4 bi depois do veto chinês à venda para a Meta](https://techcrunch.com/2026/09/18/manus-seeks-4b-valuation-in-new-500m-fundraise-as-it-resumes-independent-ops/)** (Comunidade; websearch). Pequim bloqueou em abril a compra da Manus pela Meta, e a empresa voltou a operar sozinha. Entre os investidores possíveis estão IDG, Boyu e CATL, e há estudo de reestruturação par...
- **[Protesto contra IA em Montreal repercute no Hacker News](https://montrealgazette.com/news/photos-anti-ai-protest-in-montreal/)** (Comunidade; hacker-news). Um dia depois da marcha em São Francisco, Montreal teve protesto contra IA. O registro fotográfico teve 52 pontos e 83 comentários no Hacker News....
- **[Vantora, estúdio que cria startups, recebe US$ 100 mi para IA física](https://techcrunch.com/2026/09/18/a-startup-that-builds-other-startups-raised-100m-and-is-all-in-on-physical-ai/)** (Comunidade; websearch). Primeiro aporte externo da antiga UP.Labs, feito pela Silversmith Capital. O estúdio monta startups de autonomia e IA física sob encomenda de parceiros como Porsche, Alaska Airline...
- **[Tilly Norwood, atriz gerada por IA, falha em turnê de imprensa](https://techcrunch.com/2026/09/18/tilly-norwoods-press-tour-is-going-about-as-well-as-youd-expect-for-an-ai/)** (Comunidade; websearch). A Particle6 marcou 75 entrevistas simultâneas para a personagem sintética. Na conversa com Piers Morgan, ela passou mais de 10 segundos falando chinês sem motivo aparente. A matéri...
