Signal2026-08-13
Papers With Code

ToolHazard: Scaling Adversarial Environments for Security Evaluation and Alignment of LLM-based Agents

Part of

Self-Driving Car Security Evaluation