PhaseoPhaseo
PhaseoPhaseo
Checking statusChecking statusVisit status page
Component-level status is unavailable.

Explore

  • Models
  • Chat
  • Providers
  • Apps
  • Rankings
  • Tools
  • Monitor

Resources

  • Compare
  • Migration Guides
  • Methodology
  • Blog

Community

  • Discord
  • GitHub
  • LinkedIn
  • Reddit
  • X

Build

  • Documentation
  • API Reference
  • Quickstart
  • SDKs

Company

  • About
  • Trust Centre
  • Mission
  • Pricing
  • Works With
  • Acknowledgements
  • Support
  • Privacy
  • Terms

Explore

  • Models
  • Chat
  • Providers
  • Apps
  • Rankings
  • Tools
  • Monitor

Build

  • Documentation
  • API Reference
  • Quickstart
  • SDKs

Resources

  • Compare
  • Migration Guides
  • Methodology
  • Blog

Company

  • About
  • Trust Centre
  • Mission
  • Pricing
  • Works With
  • Acknowledgements
  • Support
  • Privacy
  • Terms

Community

  • Discord
  • GitHub
  • LinkedIn
  • Reddit
  • X

© 2025 • Phaseo

Report:Issue·Support

Spotted a data issue or broken page?Open an issueorcontact support

PhaseoPhaseo
ModelsChatCompareProvidersAppsRankings
ModelsChatCompareProvidersAppsRankings

Benchmarks

Compare model capability across independent evaluations.

Artificial Analysis

Intelligence, coding, agents and evaluation cost

Source: Artificial Analysis ↗
Intelligence

Overall model capability

631 evaluated models

Coding

Software engineering capability

256 evaluated models

Agentic

Multi-step task performance

146 evaluated models

Evaluation cost

Full Intelligence Index evaluation · USD

90 evaluated models

All benchmarks 670

Artificial Analysis Intelligence Index v4

631 models

Artificial Analysis Coding Index v4

256 models

GPQA

230 models

AIME 2025

149 models

MMLU-Pro

149 models

Artificial Analysis Agentic Index v4

146 models

LisanBench

139 models

MMLU

136 models

GPQA Diamond

134 models

MMMU

121 models

LiveBench

119 models

SWE-Bench

118 models

Humanity's Last Exam

104 models

MMMU Pro

96 models

AIME 2024

95 models

IFEval

91 models

Artificial Analysis Evaluation Cost (USD)

90 models

MATH

84 models

SimpleQA

84 models

NYT Connections

81 models

HumanEval

80 models

LMArena Text

77 models

Aider-Polyglot

71 models

SimpleBench

70 models

Mathvista

67 models

MMLU Redux

67 models

Confabulations

66 models

LiveCodeBench

66 models

AI2D

61 models

Elimination Game

61 models

GSM8K

59 models

HMMT 2025

58 models

LiveCodeBench V6

56 models

MathVision

53 models

MMStar

53 models

Video MMMU

52 models

Showing 36 of 670

Sign Up