AgentGuard Benchmark

56 security samples across 20 detection rules. 100% detection, 0 false positives.

56
Total Samples
56
Detected
0
False Positives
100%
Detection Rate

Detection Rules

Rule IDDescriptionDetected
ASI01Prompt Injection via user input4/4
ASI02Unrestricted Tool Execution5/5
ASI03Information Disclosure via logging3/3
ASI04Agent Goal Manipulation2/2
ASI05Supply Chain Tool Poisoning2/2
ASI06Cross-Agent Interference2/2
ASI07Credential Exposure3/3
ASI08Excessive Agency2/2
ASI09Insecure Output Handling2/2
ASI10Unbounded Resource Consumption2/2
ASI-MEMORY-POISONAgent Memory Poisoning3/3
ASI-TOOL-TRUSTBlind Tool Output Trust3/3
ASI-CHAIN-AMPLIFYChain Amplification (destructive loops)3/3
ASI-AGENT-COLLUSIONMulti-Agent Collusion2/2
ASI-PROMPT-TEMPLATEPrompt Template Injection2/2
ASI-STEGANO-INJECTSteganographic Command Injection2/2
JS-TAINTJavaScript Taint Tracking2/2

Framework Scan Results

FrameworkFilesFindings
LangChain1,784452
LlamaIndex2,9511,003
AutoGen549229
CAMEL899746
CrewAI84391
Qwen-Agent239441
Total6,5063,262

AgentGuard | Benchmark Source | Security Specification