A Safety Evaluation Paper Argues Single-Dimension Scores Hide How Aligned Models Actually Fail · Polylog