#ModelOutput SpeedPaper
1Mercury 21118.92β€”
2HyperNova 60B 2605420.96β€”
3Granite 4.0 H Small406.40β€”
4Step 3.7 Flash397.59β€”
5LFM2.5-VL-1.6B364.75β€”
6Gemini 3.5 Flash-Lite362.19β€”
7LFM2.5-8B-A1B331.57β€”
8gpt-oss-120b (low)323.73β€”
9Nemotron 3 Nano Omni 30B A3B Reasoning322.69β€”
10Gemini 3.1 Flash-Lite298.64β€”
11Step 3.5 Flash 2603297.02β€”
12Nova Micro289.82β€”
13gpt-oss-120b (high)275.72β€”
14gpt-oss-20b (low)273.04β€”
15Gemini 3.5 Flash (medium)265.21β€”
16Gemini 3.5 Flash (high)250.26β€”
17Ministral 3 3B248.58β€”
18gpt-oss-20b (high)242.74β€”
19Gemini 3.5 Flash (minimal)228.30β€”
20Qwen3.5 Omni Flash226.36β€”
21Nova 2.0 Lite (Non-reasoning)225.16β€”
22Gemini 3.6 Flash (high)219.36β€”
23Qwen3.7 Max199.57β€”
24Command A+197.45β€”
25NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)195.86β€”
26Qwen3 Next 80B A3B Instruct190.67β€”
27Qwen3 Next 80B A3B (Reasoning)182.11β€”
28Nemotron 3 Ultra 550B A55B (Reasoning)180.38β€”
29Nova 2.0 Lite (low)179.28β€”
30Nova 2.0 Lite (high)175.55β€”
Output Speed (Artificial Analysis) aa-output-speed Leaderboard