Inference provider
Parasail
37 models served. Speed, latency and price below are medians across this provider's catalogue, not per-endpoint measurements.
Models served
37
Median output speed
72 t/s
Median latency
414ms
Median price / 1M
$0.29
Catalogue
Strongest and fastest on this provider
What the catalogue looks like at the top end, on the two axes that usually decide the choice.
Highest Intelligence Index
Among models this provider serves
- GLM 5.2Z.ai52.6
- V4 Flash 0731DeepSeek51.8
- V4 Flash 0423DeepSeek51.8
- MiniMax M3MiniMax45.4
- V4 ProDeepSeek45.3
- Kimi K2.6Moonshot AI45.1
- Kimi K2.7 CodeMoonshot AI43.0
- GLM 5.1Z.ai41.0
- MiMo-V2.5Xiaomi38.0
- 34.3
View as table
| Model | Intelligence |
|---|---|
| GLM 5.2 (Z.ai) | 52.6 |
| V4 Flash 0731 (DeepSeek) | 51.8 |
| V4 Flash 0423 (DeepSeek) | 51.8 |
| MiniMax M3 (MiniMax) | 45.4 |
| V4 Pro (DeepSeek) | 45.3 |
| Kimi K2.6 (Moonshot AI) | 45.1 |
| Kimi K2.7 Code (Moonshot AI) | 43.0 |
| GLM 5.1 (Z.ai) | 41.0 |
| MiMo-V2.5 (Xiaomi) | 38.0 |
| Qwen3.5 397B A17B (Qwen) | 34.3 |
Fastest output
Median tokens per second
- gpt-oss-120bOpenAI773 t/s
- gpt-oss-20bOpenAI252 t/s
- 234 t/s
- Gemma 4 31BGoogle232 t/s
- Qwen3.5-35B-A3BQwen203 t/s
- Qwen3.6 35B A3BQwen177 t/s
- V4 Flash 0731DeepSeek148 t/s
- GLM 5.2Z.ai142 t/s
- Kimi K2.7 CodeMoonshot AI140 t/s
- 137 t/s
View as table
| Model | Tokens/s |
|---|---|
| gpt-oss-120b (OpenAI) | 773 |
| gpt-oss-20b (OpenAI) | 252 |
| Llama 3.3 70B Instruct (Meta) | 234 |
| Gemma 4 31B (Google) | 232 |
| Qwen3.5-35B-A3B (Qwen) | 203 |
| Qwen3.6 35B A3B (Qwen) | 177 |
| V4 Flash 0731 (DeepSeek) | 148 |
| GLM 5.2 (Z.ai) | 142 |
| Kimi K2.7 Code (Moonshot AI) | 140 |
| Llama 3.2 3B Instruct (Meta) | 137 |
Full catalogue
All 37 models on Parasail
Filter by creator
37 of 37 models| GLM 5.2 Z.aiopen | 52.6 | $0.23 |
| V4 Flash 0731 DeepSeekopen | 51.8 | $0.02 |
| V4 Flash 0423 DeepSeekopen | 51.8 | $0.02 |
| MiniMax M3 MiniMaxopen | 45.4 | $0.11 |
| V4 Pro DeepSeekopen | 45.3 | $0.09 |
| Kimi K2.6 Moonshot AIopen | 45.1 | $0.23 |
| Kimi K2.7 Code Moonshot AIopen | 43.0 | $0.32 |
| GLM 5.1 Z.aiopen | 41.0 | $0.29 |
| MiMo-V2.5 Xiaomiopen | 38.0 | $0.03 |
| Qwen3.5 397B A17B Qwenopen | 34.3 | $0.21 |
| Qwen3.6 35B A3B Qwenopen | 32.1 | $0.09 |
| Qwen3.5-35B-A3B Qwenopen | 29.9 | $0.09 |
| gpt-oss-120b OpenAIopen | 24.1 | $0.02 |
| Qwen3.5-9B Qwenopen | 21.8 | $0.02 |
| Qwen3 Coder Next Qwenopen | 21.3 | $0.03 |
| Trinity Large Thinking Arcee AIopen | 18.6 | $0.08 |
| gpt-oss-20b OpenAIopen | 15.2 | $0.01 |
| Llama 4 Maverick Metaopen | 14.5 | $0.03 |
| Qwen3 VL 235B A22B Instruct Qwenopen | 14.4 | $0.06 |
| Qwen3 Next 80B A3B Instruct Qwenopen | 13.8 | $0.03 |
| Qwen3 VL 8B Instruct Qwenopen | 8.2 | $0.02 |
| Gemma 4 26B A4B Googleopen | — | $0.03 |
| Gemma 4 31B Googleopen | — | $0.03 |
| Cydonia 24B V4.1 TheDrummeropen | — | $0.03 |
| UI-TARS 7B ByteDanceopen | — | $0.01 |
| Qwen3 235B A22B Instruct 2507 Qwenopen | — | $0.02 |
| Mistral Small 3.2 24B Mistral AIopen | — | $0.01 |
| Gemma 3 27B Googleopen | — | $0.02 |
| Skyfall 36B V2 TheDrummeropen | — | $0.05 |
| Qwen2.5 VL 72B Instruct Qwenopen | — | $0.03 |
| Llama 3.3 70B Instruct Metaopen | — | $0.01 |
| UnslopNemo 12B TheDrummeropen | — | $0.03 |
| Rocinante 12B TheDrummeropen | — | $0.03 |
| Llama 3.2 3B Instruct Metaopen | — | $0.01 |
| Llama 3 8B Lunaris Sao10Kopen | — | $0.003 |
| Mistral Nemo Mistral AIopen | — | $0.002 |
| MythoMax 13B Grypheopen | — | $0.007 |