Inference provider
CoreWeave
18 models served. Speed, latency and price below are medians across this provider's catalogue, not per-endpoint measurements.
Models served
18
Median output speed
131 t/s
Median latency
351ms
Median price / 1M
$0.258
Catalogue
Strongest and fastest on this provider
What the catalogue looks like at the top end, on the two axes that usually decide the choice.
Highest Intelligence Index
Among models this provider serves
- GLM 5.2Z.ai52.6
- V4 Flash 0731DeepSeek51.8
- V4 Flash 0423DeepSeek51.8
- V4 ProDeepSeek45.3
- Kimi K2.6Moonshot AI45.1
- Kimi K2.7 CodeMoonshot AI43.0
- Qwen3.6 27BQwen37.7
- Qwen3.6 35B A3BQwen32.1
- Qwen3.5-35B-A3BQwen29.9
- gpt-oss-120bOpenAI24.1
View as table
| Model | Intelligence |
|---|---|
| GLM 5.2 (Z.ai) | 52.6 |
| V4 Flash 0731 (DeepSeek) | 51.8 |
| V4 Flash 0423 (DeepSeek) | 51.8 |
| V4 Pro (DeepSeek) | 45.3 |
| Kimi K2.6 (Moonshot AI) | 45.1 |
| Kimi K2.7 Code (Moonshot AI) | 43.0 |
| Qwen3.6 27B (Qwen) | 37.7 |
| Qwen3.6 35B A3B (Qwen) | 32.1 |
| Qwen3.5-35B-A3B (Qwen) | 29.9 |
| gpt-oss-120b (OpenAI) | 24.1 |
Fastest output
Median tokens per second
- gpt-oss-120bOpenAI773 t/s
- gpt-oss-20bOpenAI252 t/s
- 234 t/s
- Gemma 4 31BGoogle232 t/s
- Qwen3.5-35B-A3BQwen203 t/s
- Qwen3.6 35B A3BQwen177 t/s
- V4 Flash 0731DeepSeek148 t/s
- GLM 5.2Z.ai142 t/s
- Kimi K2.7 CodeMoonshot AI140 t/s
- Granite 4.1 8BIBM Granite121 t/s
View as table
| Model | Tokens/s |
|---|---|
| gpt-oss-120b (OpenAI) | 773 |
| gpt-oss-20b (OpenAI) | 252 |
| Llama 3.3 70B Instruct (Meta) | 234 |
| Gemma 4 31B (Google) | 232 |
| Qwen3.5-35B-A3B (Qwen) | 203 |
| Qwen3.6 35B A3B (Qwen) | 177 |
| V4 Flash 0731 (DeepSeek) | 148 |
| GLM 5.2 (Z.ai) | 142 |
| Kimi K2.7 Code (Moonshot AI) | 140 |
| Granite 4.1 8B (IBM Granite) | 121 |
Full catalogue
All 18 models on CoreWeave
Filter by creator
18 of 18 models| GLM 5.2 Z.aiopen | 52.6 | $0.23 |
| V4 Flash 0731 DeepSeekopen | 51.8 | $0.02 |
| V4 Flash 0423 DeepSeekopen | 51.8 | $0.02 |
| V4 Pro DeepSeekopen | 45.3 | $0.09 |
| Kimi K2.6 Moonshot AIopen | 45.1 | $0.23 |
| Kimi K2.7 Code Moonshot AIopen | 43.0 | $0.32 |
| Qwen3.6 27B Qwenopen | 37.7 | $0.32 |
| Qwen3.6 35B A3B Qwenopen | 32.1 | $0.09 |
| Qwen3.5-35B-A3B Qwenopen | 29.9 | $0.09 |
| gpt-oss-120b OpenAIopen | 24.1 | $0.02 |
| gpt-oss-20b OpenAIopen | 15.2 | $0.01 |
| Granite 4.1 8B IBM Graniteopen | 6.4 | $0.005 |
| Gemma 4 31B Googleopen | — | $0.03 |
| V3.1 DeepSeekopen | — | $0.09 |
| Qwen3 30B A3B Instruct 2507 Qwenopen | — | $0.007 |
| Llama 3.3 70B Instruct Metaopen | — | $0.01 |
| Llama 3.1 70B Instruct Metaopen | — | $0.03 |
| Llama 3.1 8B Instruct Metaopen | — | $0.005 |