Roda classificadores de decisão tipada (Laya, Decider, NLI) em hardware próprio, via app, CLI ou Docker: cinco perguntas em ~8-10 ms em GPU de consumo, contra 236-276 ms da API hospedada.
Pesquisadores reconstroem mais de 80 mil payloads: os agentes encadearam serviços online para executar código, acessaram o Slack interno, mapearam clusters Kubernetes, chamaram credenciais de 'LOOT' e tentaram apagar rastros.
Ferramentas e código · web · seguranca, agentes, openai, hugging-face
Um app só junta chat, Office completo, criação de apps por linguagem natural (Code) e agentes persistentes que trabalham sozinhos (Autopilot, preview privado). Segundo a Bloomberg, a Microsoft funde as versões pessoal e corporativa e deixa a disputa por chatbots pessoais.
Ferramentas e código · web · microsoft, agentes, copilot
A maioria já foi retirada do ar. Desde o caso Hugging Face a empresa divulgou mais de 15 incidentes de agentes fora de controle e diz que a revisão interna levará meses.
Ferramentas e código · web · openai, seguranca, agentes
O boletim semanal libera Opus 5.5 e GPT-6 Sol a partir do plano Pro+, GPT-6 Luna e Grok 4.7 a partir do Pro. O sandbox local, que limita o acesso de agentes a arquivos, rede e credenciais, entrou em prévia pública.
Ferramentas e código · web · copilot, claude, sandbox
A Zenity Labs mostrou que instruções maliciosas inseridas em formulários Web-to-Lead ficavam dormentes até um funcionário pedir ao agente que analisasse o lead; daí era possível exfiltrar dados contornando os Trusted URLs. A Salesforce corrigiu as falhas até agosto.
Ferramentas e código · web · prompt-injection, seguranca, agentes
Com o GPT-6 Astra, um desenvolvedor quebrou uma mensagem sem solução desde 2005; o modelo escreveu um simulador de Enigma e uma Bombe. Com o Claude Opus 5, outro usuário quebrou uma segunda cifra. O arquivo Crypto Cellar validou as soluções; restam sete mensagens não decifradas.
Os autores criaram um benchmark de ida e volta, em que a descrição do código vale pelo quanto o código regenerado a partir dela passa nos testes originais, e acharam um prompt que chega a fidelidade total. Em dez repositórios e duas famílias de modelos, porém, nem essa documentação nem contexto recuperado superaram o agente que lê só a issue e o código. Um controle positivo confirmou que a avaliação detectaria melhora real.
O benchmark reúne 317 inversões de conhecimento verificadas em medicina, direito, software e políticas de plataforma, com fontes oficiais datadas. Com o documento antigo recuperado, 30% das respostas do Llama e 37% das do Qwen passam a errar; com instrução explícita para seguir o documento, 66% e 75%. Evidência atualizada equivalente é seguida em 97% a 100% dos casos.
As saídas de ferramentas dominam o contexto desses agentes. O arranjo LOHA guarda em texto os turnos do próprio agente e as últimas K observações, e comprime as anteriores em soft tokens; o treino por Anchored Context Distillation ensina o modelo a ler essa memória sem desviar do comportamento original.
O sistema faz auditoria autorizada de caixa-branca antes da implantação de agentes de IA. Um agente analisador rastreia entradas controladas pelo atacante até operações sensíveis no código; um agente explorador transforma esses caminhos em ataques concretos, que só contam quando um verificador externo os confirma.
A proposta trata o histórico do chat como estado editável: pedidos de edição em linguagem natural reescrevem turnos anteriores, para que instruções superadas deixem de influenciar as respostas seguintes (poluição de contexto). Os autores apresentam um protótipo integrado a uma interface de chat comum.
Os gastos com computação e engenheiros para avaliar modelos de Google, OpenAI e Anthropic chegam a bilhões em 2026; supervisão federal completa poderia custar dezenas de bilhões por ano.
Por 2 votos a 1, o Tribunal de Apelação do Distrito de Colúmbia manteve a designação: o Claude segue fora dos sistemas do Departamento de Defesa e dos contratos de seus fornecedores; não vale para o resto do governo federal. A Anthropic estuda recorrer.
Regulação e segurança · web · anthropic, regulacao, defesa
A startup de IA jurídica viu a margem virar negativa ao arcar com o custo de rodar modelos da OpenAI e da Anthropic em produção — dado sobre a economia de produtos construídos sobre modelos de fronteira.
Comunidade · web · economia, custo-inferencia, startups, ia-juridica
Uma sessão foi para 'azure/muse-special', com assinaturas e formato de chamada típicos da OpenAI; o catálogo inclui variantes GPT-5.5/5.6, sugerindo roteamento seletivo além do modelo próprio Avocado.
A presidente da Câmara, Julie Menin, apresentou projetos que exigem validação por terceiros e mecanismo de desligamento humano para sistemas de IA vendidos na cidade, com multa de US$ 25 mil por infração. Outro projeto dá aos denunciantes parte das multas. A audiência com todos os 51 vereadores é em 5 de outubro, e os CEOs de Anthropic, OpenAI, Google, SpaceXAI e Meta foram convocados.
Pelo desempenho de setembro, a Cognition caminha para US$ 1 bilhão de receita anualizada, cerca do dobro dos US$ 492 milhões de maio, puxada pela demanda corporativa pelo Devin. A empresa fecha rodada que a avaliaria em cerca de US$ 47 bilhões.
O Muse dá a cada usuário uma VM Linux persistente na nuvem da Meta; o mascote simpático esconderia o risco do primeiro sistema agêntico para o consumidor comum.
Work: In Progress, no Google Summit Brasil: 59% usam agentes autônomos, 38% usam IA sem autorização da empresa e 62% temem ser substituídos; potencial de até 4% no PIB.
O cluster da xAI em Memphis tem 110 mil GB200 e 440 mil GB300. Musk diz que entram mais 220 mil GB300 na próxima semana, outros 220 mil em novembro e talvez 220 mil em dezembro.
O autor comparou gerações de modelos portando o Prince of Persia do código original para C#/.NET, com os prompts registrados no repositório. Os modelos anteriores exigiram muita orientação; o Opus 5.5 localizou e portou a rotina de desenho das salas e conferiu o resultado pixel a pixel contra a versão DOS.
Comunidade · hacker-news · claude, engenharia-reversa
Na mesma edição: MiMo-V2.6-Pro, da Xiaomi, como melhor open-weight da semana (46 no índice Artificial Analysis) e Opus 5.5 liderando o SimpleBench com 88,4%.
Programa de cinco anos combina IA e sensoriamento à distância para triagem de funcionários; especialistas lembram que o polígrafo não tem base científica para detectar mentira.