Skip to content
llmwaves

Inference provider

CoreWeave

18 models served. Speed, latency and price below are medians across this provider's catalogue, not per-endpoint measurements.

Models served

18

Median output speed

131 t/s

Median latency

351ms

Median price / 1M

$0.258

Catalogue

Strongest and fastest on this provider

What the catalogue looks like at the top end, on the two axes that usually decide the choice.

Highest Intelligence Index

Among models this provider serves

View as table
ModelIntelligence
GLM 5.2 (Z.ai)52.6
V4 Flash 0731 (DeepSeek)51.8
V4 Flash 0423 (DeepSeek)51.8
V4 Pro (DeepSeek)45.3
Kimi K2.6 (Moonshot AI)45.1
Kimi K2.7 Code (Moonshot AI)43.0
Qwen3.6 27B (Qwen)37.7
Qwen3.6 35B A3B (Qwen)32.1
Qwen3.5-35B-A3B (Qwen)29.9
gpt-oss-120b (OpenAI)24.1

Fastest output

Median tokens per second

View as table
ModelTokens/s
gpt-oss-120b (OpenAI)773
gpt-oss-20b (OpenAI)252
Llama 3.3 70B Instruct (Meta)234
Gemma 4 31B (Google)232
Qwen3.5-35B-A3B (Qwen)203
Qwen3.6 35B A3B (Qwen)177
V4 Flash 0731 (DeepSeek)148
GLM 5.2 (Z.ai)142
Kimi K2.7 Code (Moonshot AI)140
Granite 4.1 8B (IBM Granite)121

Full catalogue

All 18 models on CoreWeave

Filter by creator
18 of 18 models
GLM 5.2
Z.aiopen
52.6$0.23
V4 Flash 0731
DeepSeekopen
51.8$0.02
V4 Flash 0423
DeepSeekopen
51.8$0.02
V4 Pro
DeepSeekopen
45.3$0.09
Kimi K2.6
Moonshot AIopen
45.1$0.23
Kimi K2.7 Code
Moonshot AIopen
43.0$0.32
Qwen3.6 27B
Qwenopen
37.7$0.32
Qwen3.6 35B A3B
Qwenopen
32.1$0.09
Qwen3.5-35B-A3B
Qwenopen
29.9$0.09
gpt-oss-120b
OpenAIopen
24.1$0.02
gpt-oss-20b
OpenAIopen
15.2$0.01
Granite 4.1 8B
IBM Graniteopen
6.4$0.005
Gemma 4 31B
Googleopen
$0.03
V3.1
DeepSeekopen
$0.09
Qwen3 30B A3B Instruct 2507
Qwenopen
$0.007
Llama 3.3 70B Instruct
Metaopen
$0.01
Llama 3.1 70B Instruct
Metaopen
$0.03
Llama 3.1 8B Instruct
Metaopen
$0.005