HarnessRisk muestra por qué una sola demostración de inyección de prompts no puede medir la seguridad de un agente
HarnessRisk informa de amplias diferencias de seguridad entre combinaciones de modelos y harnesses de agentes, y encuentra que la configuración es más vulnerable que las demás fases del ciclo de vida que probó.