BenchAtlas

Rankings / DeepSeek

Deepseek R1 Distill Qwen 14B

released 2025-01-20

BenchAtlas Index

as of 2026-09-11
26.1
base configuration
rank #403
10 families · 4 categories · medium

Benchmark evidence

16 results
coding
LiveCodeBench v6
implementation=artificial-analysis
37.6 %independentArtificial Analysis
SciCode23.9 %independentArtificial Analysis
external indices
Intelligence Index v4.17.8 pointsindependentArtificial Analysis
AA Math Index55.7 pointsindependentArtificial Analysis
ECI135.4 pointsindependentEpoch AI Benchmarking Hub
knowledge science
GPQA Diamond
implementation=artificial-analysis
48.4 %independentArtificial Analysis
GPQA Diamond44.7 %independentEpoch AI Benchmarking Hub
2025-03-10
Humanity's Last Exam
implementation=artificial-analysis
4.1 %independentArtificial Analysis
MMLU-Pro
implementation=artificial-analysis
74.0 %independentArtificial Analysis
long context instruction
AA-LCR10.3 %independentArtificial Analysis
IFBench22.1 %independentArtificial Analysis
reasoning math
AIME
implementation=artificial-analysis
66.7 %independentArtificial Analysis
AIME
year=2025 · implementation=artificial-analysis
55.7 %independentArtificial Analysis
MATH-500
implementation=artificial-analysis
94.9 %independentArtificial Analysis
MATH Level 587.1 %independentEpoch AI Benchmarking Hub
2025-03-11
OTIS Mock AIME 2024–202550.6 %independentEpoch AI Benchmarking Hub
2026-08-28