Skip to content
llmwaves

Inference provider

StreamLake

22 models served. Speed, latency and price below are medians across this provider's catalogue, not per-endpoint measurements.

Models served

22

Median output speed

73 t/s

Median latency

514ms

Median price / 1M

$0.534

Catalogue

Strongest and fastest on this provider

What the catalogue looks like at the top end, on the two axes that usually decide the choice.

Highest Intelligence Index

Among models this provider serves

View as table
ModelIntelligence
GLM 5.2 (Z.ai)52.6
V4 Flash 0731 (DeepSeek)51.8
V4 Flash 0423 (DeepSeek)51.8
V4 Pro (DeepSeek)45.3
Kimi K2.6 (Moonshot AI)45.1
MiMo-V2.5-Pro (Xiaomi)42.9
GLM 5.1 (Z.ai)41.0
GLM 5 (Z.ai)40.6
Kimi K2.5 (Moonshot AI)36.0
M2.5 (MiniMax)34.5

Fastest output

Median tokens per second

View as table
ModelTokens/s
GLM 4.7 (Z.ai)502
V4 Flash 0731 (DeepSeek)148
GLM 5.2 (Z.ai)142
Qwen3 Coder Next (Qwen)129
Qwen3.5 397B A17B (Qwen)116
V3.2 (DeepSeek)100
M2.5 (MiniMax)91
Kimi K2.6 (Moonshot AI)89
V4 Flash 0423 (DeepSeek)87
KAT-Coder-Air V2.5 (KwaiPilot)82

Full catalogue

All 22 models on StreamLake

Filter by creator
22 of 22 models
GLM 5.2
Z.aiopen
52.6$0.23
V4 Flash 0731
DeepSeekopen
51.8$0.02
V4 Flash 0423
DeepSeekopen
51.8$0.02
V4 Pro
DeepSeekopen
45.3$0.09
Kimi K2.6
Moonshot AIopen
45.1$0.23
MiMo-V2.5-Pro
Xiaomiopen
42.9$0.09
GLM 5.1
Z.aiopen
41.0$0.29
GLM 5
Z.aiopen
40.6$0.25
Kimi K2.5
Moonshot AIopen
36.0$0.26
M2.5
MiniMaxopen
34.5$0.08
GLM 4.7
Z.aiopen
34.5$0.16
Qwen3.5 397B A17B
Qwenopen
34.3$0.21
KAT-Coder-Pro V2
KwaiPilot
33.9$0.04
V3.2
DeepSeekopen
25.1$0.05
V3.1 Terminus
DeepSeekopen
21.7$0.09
Qwen3 Coder Next
Qwenopen
21.3$0.03
KAT-Coder-Air V2.5
KwaiPilot
$0.02
KAT-Coder-Pro V2.5
KwaiPilot
$0.11
Qwen3 30B A3B Instruct 2507
Qwenopen
$0.007
Qwen3 235B A22B Instruct 2507
Qwenopen
$0.02
R1 0528
DeepSeekopen
$0.20
DeepSeek V3
DeepSeekopen
$0.04