EvoSafeHarness sintetiza políticas de segurança específicas por agente e reduz ataques de 45,6% para 10%
Grupo de UC Berkeley e Cornell propõe busca conjunta de uma política em linguagem natural e da lógica de código que a executa, adaptada a cada modelo e domínio. No DecodingTrust-Ag...
Pesquisa · huggingface · seguranca-de-agentes, harness, berkeley, prompt-injection