⚡ Arena Harness: Adversarial AI evaluation & red-teaming framework. Dual-axis scoring, D1 threat taxonomy (14 categories), poisoned context testing, and JSONL evidence receipts.
python threat-modeling jailbreak-detection ai-evaluation prompt-injection llm-security ai-red-teaming adversarial-ai epistemic-evaluation feynman-gate jsonl-evidence security-evals
-
Updated
Sep 3, 2026 - Python