Models /GLM 5.1 /Where to run
Provider guide

Where to run GLM 5.1

23 live offers tracked.

CHEAPEST
$0.97 / $3.04
per 1M tokens in / out
FASTEST MEASURED
76 tok/s
measured throughput · $1.00 input / $3.20 output per million tokens
Baidu$0.95 in/1M$2.99 out/1M31 tok/s203Kfp812m agoStreamLake$0.97 in/1M$3.04 out/1M34 tok/s200Kfp812m agoOpenRouterCHEAPEST$0.97 in/1M$3.04 out/1M205K15m agoGMICloud$0.98 in/1M$3.08 out/1M44 tok/s203Kfp812m agoChutes$0.98 in/1M$3.08 out/1M27 tok/s203Kfp86h agoDeepInfra$1.05 in/1M$3.50 out/1M203Kfp46h agoAtlasCloud$1.26 in/1M$3.96 out/1M38 tok/s203Kfp812m agoAlibaba Cloud$1.33 in/1M$4.18 out/1M46 tok/s203Kfp812m agoNovita AI$1.38 in/1M$4.40 out/1M205K6h agoFireworks AI$1.40 in/1M$4.40 out/1M203K6d agoFriendli$1.40 in/1M$4.40 out/1M62 tok/s203K12m agoWaferzero-retention$1.00 in/1M$3.20 out/1M76 tok/s203Kfp412m agoDeepInfrazero-retention$1.05 in/1M$3.50 out/1M43 tok/s203Kfp412m agoSiliconFlowzero-retention$1.19 in/1M$3.74 out/1M51 tok/s205Kfp812m agoPhalazero-retention$1.21 in/1M$4.20 out/1M27 tok/s203K6h agoDigitalOcean Gradientzero-retention$0.97 in/1M$4.30 out/1M19 tok/s164K12m agoZ.AIzero-retention$1.40 in/1M$4.40 out/1M52 tok/s203Kfp86h agoNovita AIzero-retention$1.38 in/1M$4.40 out/1M31 tok/s205Kfp812m agoCrusoezero-retention$1.20 in/1M$4.40 out/1M70 tok/s203Kfp812m agoParasailzero-retention$1.40 in/1M$4.40 out/1M58 tok/s203Kfp812m agoCoreWeavezero-retention$1.40 in/1M$4.40 out/1M75 tok/s203Kfp812m agoNebius AI Studiozero-retention$1.40 in/1M$4.40 out/1M32 tok/s203Kfp812m agoVenice AIzero-retention$1.54 in/1M$4.84 out/1M38 tok/s200Kfp812m ago
Full specs, hardware verdicts and benchmarks on theGLM 5.1 model page →