See the balls
See the actual tokens
Ⅱ
Pause
↻
Reset
1,000 output tokens
One trip to the other side = 1,000 output tokens · A round trip = 2,000
GPT-OSS 120B
Cerebras · 1,852 t/s
120B
params
↗
GPT-OSS 20B
Groq · 960 t/s
20B
params
↗
Nemotron 3.5 Lightning
DeepInfra (pre-release) · 669 t/s
30B / 3B
params
↗
GLM-5.2
Baseten · 572 t/s
744B
params
↗
Qwen3.8 Max Preview
Alibaba Cloud · ~465 t/s
~2.4T
params
↗
Kimi K2.7 Code
Crusoe (NVFP4) · 462 t/s
1T
params
↗
GLM-5.2
Together AI · 439 t/s
744B
params
↗
DeepSeek V4 Flash
Makora · 232 t/s
284B / 13B
params
↗
GPT-5.6 Luna
OpenAI · 204 t/s
Undisclosed
params
↗
Gemini 3.5 Flash
Google AI Studio · 195 t/s
Undisclosed
params
↗
GPT-5.6 Terra
Amazon · 174 t/s
Undisclosed
params
↗
Kimi K3
Fireworks · 162 t/s
2.8T
params
↗
GPT-5.6 Terra
OpenAI · 145 t/s
Undisclosed
params
↗
Muse Spark 1.2
Meta · ~131 t/s
Undisclosed
params
↗
DeepSeek V4 Flash
DeepSeek · 121 t/s
284B / 13B
params
↗
Claude Sonnet 5
Google · 87 t/s
Undisclosed
params
↗
Claude Fable 5
Anthropic · 73 t/s
Undisclosed
params
↗
GPT-5.6 Sol
OpenAI · 71 t/s
Undisclosed
params
↗
Grok 4.5
SpaceXAI · 60 t/s
Undisclosed
params
↗
Claude Opus 5
Anthropic · 54 t/s
Undisclosed
params
↗