Frontier multi-disciplinary academic knowledge.
Tests models on 2,158 frontier-level, closed-ended academic questions requiring genuine subject mastery rather than retrieval.
Model
Score
GPT-5.6 SolMax • Pro
Score on this Mercor-extended benchmark: 77.3%
GPT-5.6 TerraMax
Score on the original open-source benchmark: 44.9% / Score on this Mercor-extended benchmark: 70.7%
Opus 5High
Score on the original open-source benchmark: 52.0% / Score on this Mercor-extended benchmark: 61.0%
Fable 5High
Score on the original open-source benchmark: 51.5% / Score on this Mercor-extended benchmark: 58.7%
GPT-5.4xHigh
Score on the original open-source benchmark: 44.1% / Score on this Mercor-extended benchmark: 56.1%
APEX NEWSLETTER
New benchmarks, leaderboard shifts, and research from the APEX team.
By subscribing you agree to receive updates from Mercor.Unsubscribe anytime.