Programmatic Reasoning IQ Rankings
Each model's estimated Programmatic Reasoning IQ, ranked highest to lowest. Defaults to current-generation models.
Programmatic Reasoning IQ Rankings
More / ExperimentalProgrammatic Reasoning IQ vs CostEach model's estimated Programmatic Reasoning IQ against its effective cost per 1M I/O Tokens (sticker price × measured or imputed usage multiplier).Data: Artificial Analysis, ARC Prize, Vals Index v2 Cost per Test +6 moreOpen chartCoreIQ Bell CurveEach model's estimated IQ, placed on a standard normal IQ distribution.Data: ARC Prize, Epoch AI FrontierMath, ProofBench 1.1 +21 moreOpen chartIQ BenchmarksTerminal-Bench 4.0 ScoresExact AA v4.3.2 model/configuration; never substitute older benchmark versions. Contributes to Programmatic Reasoning using a provisional calibrated scale.Data: Artificial AnalysisOpen chartIQ BenchmarksLiveCodeBench Benchmark ScoresEach model's LiveCodeBench score. Color = provider.Data: Vals.ai, Vals.ai LiveCodeBenchOpen chartIQ BenchmarksProgramBench ScoresAlmost Resolved score: share of ProgramBench tasks passing at least 95% of hidden tests. Color = provider.Data: Vals.ai ProgramBenchOpen chartIQ BenchmarksIOI V2 Scores2024–2026 olympiad tasks, no interactive grading feedback. Version 2 only; separately calibrated from archived V1. Contributes to Programmatic Reasoning using a provisional calibrated scale.Data: Vals.ai IOI V2Open chartIQ BenchmarksSWE-rebench Benchmark ScoresEach model's SWE-rebench resolved rate. Color = provider.Data: SWE-rebenchOpen chart