Open, falsifiable AI safety evaluation framework and benchmark for AI decision systems, testing human dignity × harm containment, minimum sufficient intervention, victim protection, reversibility, and return paths.
benchmark ai-safety red-teaming ai-alignment ai-evaluation reversibility safety-evaluation human-agency human-dignity harm-containment
-
Updated
Sep 19, 2026 - Python