analytics AI Model Ranks
dashboard Terminal compare_arrows Compare bar_chart Benchmarks article News rocket_launch Projects code API handshake Partner

Loading benchmark data...

ROTATING

Model Performance Benchmarks

Comprehensive evaluation across reasoning, coding, knowledge, and more.

Arena Elo Rating

Human preference ranking via LMSys Chatbot Arena

Overall

MMLU

Massive Multitask Language Understanding

Knowledge

GPQA Diamond

Graduate-level physics, chemistry & biology reasoning

Reasoning

HumanEval

Code generation from docstrings

Coding

Inference Speed

Tokens per second — throughput comparison

Speed

Complete Model Rankings

# Model Provider Arena Elo MMLU HumanEval GPQA Speed