Benchmark Scope 39/195 (86 unrated)
Benchmark Mean 53.8 / 100
Data Completeness 96.5% (Harmonized)
Index Status Preview Release

9-Paradigm Psychometric Battery (N=1,080)

Calibrated experimental paradigms isolating human error discernment, automation bias, and cognitive forcing functions.

EXP-01 Legal & Jurisprudence

Legal Liability & Clause Verification

Detection of subtle indemnification inversions masked by legalese.

Sample 120
Discrim (D) 0.38
Accuracy 64.2%
EXP-02 Medicine & Clinical Care

Clinical Pharmacological Dosing

Identification of lethal drug interactions in discharge summaries.

Sample 120
Discrim (D) 0.42
Accuracy 58.7%
EXP-03 Software Engineering

Software Concurrency & Precision

Verification of floating-point precision loss in compiling code.

Sample 120
Discrim (D) 0.4
Accuracy 61.3%
EXP-04 Quantitative Finance

Quantitative Financial Arbitrage

Discernment of hidden tail-risk ruin beneath fluent Sharpe claims.

Sample 120
Discrim (D) 0.39
Accuracy 55.4%
EXP-05 Decision Architecture

Choice-Overload & Epistemic Fatigue

Quantifying operator decision quality degradation across option sets.

Sample 120
Discrim (D) 0.36
Accuracy 52.1%
EXP-06 Human-Autonomy Teaming

Autonomous Delegation Boundary

Measuring human propensity to surrender manual emergency override control.

Sample 120
Discrim (D) 0.44
Accuracy 49.6%
EXP-07 Epistemic Psychology

Empirical Belief-Updating vs Entrenchment

Evaluating belief updates when presented with empirical counter-data.

Sample 120
Discrim (D) 0.37
Accuracy 59.8%
EXP-08 Cognitive Sovereignty

Hypothesis Preservation Post-Superiority

Assessing independent human hypothesis generation after machine dominance.

Sample 120
Discrim (D) 0.41
Accuracy 53.9%
EXP-09 Human Factors Engineering

Cognitive-Forcing Interface Benchmark

Head-to-head comparison between passive review and mandatory pre-commitment.

Sample 120
Discrim (D) 0.43
Accuracy 57.1%