Inference provider
SiliconFlow
35 models served. Speed, latency and price below are medians across this provider's catalogue, not per-endpoint measurements.
Models served
35
Median output speed
76 t/s
Median latency
506ms
Median price / 1M
$0.355
Catalogue
Strongest and fastest on this provider
What the catalogue looks like at the top end, on the two axes that usually decide the choice.
Highest Intelligence Index
Among models this provider serves
- GLM 5.2Z.ai52.6
- V4 Flash 0731DeepSeek51.8
- V4 Flash 0423DeepSeek51.8
- V4 ProDeepSeek45.3
- Kimi K2.6Moonshot AI45.1
- Kimi K2.7 CodeMoonshot AI43.0
- Nex-N2-ProNex AGI41.7
- GLM 5.1Z.ai41.0
- GLM 5Z.ai40.6
- Qwen3.6 27BQwen37.7
View as table
| Model | Intelligence |
|---|---|
| GLM 5.2 (Z.ai) | 52.6 |
| V4 Flash 0731 (DeepSeek) | 51.8 |
| V4 Flash 0423 (DeepSeek) | 51.8 |
| V4 Pro (DeepSeek) | 45.3 |
| Kimi K2.6 (Moonshot AI) | 45.1 |
| Kimi K2.7 Code (Moonshot AI) | 43.0 |
| Nex-N2-Pro (Nex AGI) | 41.7 |
| GLM 5.1 (Z.ai) | 41.0 |
| GLM 5 (Z.ai) | 40.6 |
| Qwen3.6 27B (Qwen) | 37.7 |
Fastest output
Median tokens per second
- gpt-oss-120bOpenAI773 t/s
- Qwen3 32BQwen423 t/s
- gpt-oss-20bOpenAI252 t/s
- Gemma 4 31BGoogle232 t/s
- Qwen3.5-35B-A3BQwen203 t/s
- Qwen3.6 35B A3BQwen177 t/s
- V4 Flash 0731DeepSeek148 t/s
- 145 t/s
- GLM 5.2Z.ai142 t/s
- Kimi K2.7 CodeMoonshot AI140 t/s
View as table
| Model | Tokens/s |
|---|---|
| gpt-oss-120b (OpenAI) | 773 |
| Qwen3 32B (Qwen) | 423 |
| gpt-oss-20b (OpenAI) | 252 |
| Gemma 4 31B (Google) | 232 |
| Qwen3.5-35B-A3B (Qwen) | 203 |
| Qwen3.6 35B A3B (Qwen) | 177 |
| V4 Flash 0731 (DeepSeek) | 148 |
| Qwen3.5-122B-A10B (Qwen) | 145 |
| GLM 5.2 (Z.ai) | 142 |
| Kimi K2.7 Code (Moonshot AI) | 140 |
Full catalogue
All 35 models on SiliconFlow
Filter by creator
35 of 35 models| GLM 5.2 Z.aiopen | 52.6 | $0.23 |
| V4 Flash 0731 DeepSeekopen | 51.8 | $0.02 |
| V4 Flash 0423 DeepSeekopen | 51.8 | $0.02 |
| V4 Pro DeepSeekopen | 45.3 | $0.09 |
| Kimi K2.6 Moonshot AIopen | 45.1 | $0.23 |
| Kimi K2.7 Code Moonshot AIopen | 43.0 | $0.32 |
| Nex-N2-Pro Nex AGIopen | 41.7 | $0.09 |
| GLM 5.1 Z.aiopen | 41.0 | $0.29 |
| GLM 5 Z.aiopen | 40.6 | $0.25 |
| Qwen3.6 27B Qwenopen | 37.7 | $0.32 |
| Kimi K2.5 Moonshot AIopen | 36.0 | $0.26 |
| Qwen3.5-27B Qwenopen | 34.6 | $0.13 |
| M2.5 MiniMaxopen | 34.5 | $0.08 |
| Qwen3.5-122B-A10B Qwenopen | 32.8 | $0.21 |
| Qwen3.6 35B A3B Qwenopen | 32.1 | $0.09 |
| Qwen3.5-35B-A3B Qwenopen | 29.9 | $0.09 |
| Step 3.5 Flash StepFunopen | 26.5 | $0.03 |
| V3.2 DeepSeekopen | 25.1 | $0.05 |
| gpt-oss-120b OpenAIopen | 24.1 | $0.02 |
| Qwen3.5-9B Qwenopen | 21.8 | $0.02 |
| V3.1 Terminus DeepSeekopen | 21.7 | $0.09 |
| GLM 4.5 Air Z.aiopen | 16.7 | $0.07 |
| gpt-oss-20b OpenAIopen | 15.2 | $0.01 |
| Qwen3 Coder 30B A3B Instruct Qwenopen | 13.6 | $0.01 |
| Qwen3 VL 30B A3B Instruct Qwenopen | 9.9 | $0.02 |
| Gemma 4 26B A4B Googleopen | — | $0.03 |
| Gemma 4 31B Googleopen | — | $0.03 |
| Qwen3 VL 30B A3B Thinking Qwenopen | — | $0.20 |
| V3.2 Exp DeepSeekopen | — | $0.05 |
| V3.1 DeepSeekopen | — | $0.09 |
| Qwen3 30B A3B Instruct 2507 Qwenopen | — | $0.007 |
| Hunyuan A13B Instruct Tencentopen | — | $0.05 |
| R1 0528 DeepSeekopen | — | $0.20 |
| Qwen3 32B Qwenopen | — | $0.03 |
| V3 0324 DeepSeekopen | — | $0.04 |