Search for a command to run...
ToolHazard: Skalierung adversarialer Umgebungen für die Sicherheitsevaluierung und das Alignment LLM-basierter Agenten