Themed ranking
Fastest and most reliable
Ranked by real measured throughput (tokens/sec) at each model's best-performing provider, tracked daily.
As of August 9, 2026, OpenAI: gpt-oss-120b ranks #1 for fastest and most reliable at throughput (tok/s) 777 tok/s.
- #1 OpenAI: gpt-oss-120b - Throughput (tok/s) 777 tok/s
- #2 Google: Gemma 4 31B (free) - Throughput (tok/s) 279 tok/s
- #3 MiniMax: MiniMax M2.7 - Throughput (tok/s) 215 tok/s
- #4 NVIDIA: Nemotron 3 Super (free) - Throughput (tok/s) 183 tok/s
- #5 Poolside: Laguna XS 2.1 (free) - Throughput (tok/s) 156 tok/s
- #6 OpenAI: GPT-5.6 Luna Pro (batch) - Throughput (tok/s) 154 tok/s
- #7 Google: Gemini 2.5 Flash Lite (batch) - Throughput (tok/s) 139 tok/s
- #8 StepFun: Step 3.7 Flash - Throughput (tok/s) 137 tok/s
- #9 NVIDIA: Nemotron 3 Ultra (free) - Throughput (tok/s) 130 tok/s
- #10 Google: Gemini 3.6 Flash (batch) - Throughput (tok/s) 129 tok/s
Source: OpenRouter (openrouter.ai/rankings), as of August 9, 2026.
Benchmark scores: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings).
Methodology: smophy.ai/benchmark/methodology
Token counts originate from each provider's own tokenizer and are not directly comparable across providers.
