Phi 4 Reasoning Plus — Benchmarks

Benchmark scores for Phi 4 Reasoning Plus aggregated from public leaderboards, with how it ranks among open models. See hardware requirements for what you need to run it.

Knowledge

BenchmarkScoreOpen rankAll models
MMLU-Pro76.0%#26 / 119#82 / 259

Scores aggregated from public benchmark sources (each linked from the benchmark pages). llmrun does not run these benchmarks.