Provider guide
Where to run GLM 4.7 Flash
5 live listings tracked.
FASTEST MEASURED
24 tok/s
measured throughput · $0.060 input / $0.40 output per million tokens
OpenRouter$0.060 in/1M$0.40 out/1M—200K—2 hours agoDeepInfraCHEAPEST$0.060 in/1M$0.40 out/1M—203Kbf1628 days agoNovita AIzero-retention through OpenRouterDirect and through OpenRouter$0.070 in/1M$0.40 out/1M—200Kbf162 hours ago direct23 days ago through OpenRouterVenice AIzero-retention$0.060 in/1M$0.40 out/1M20 tok/s128Kfp82 hours agoCloudflare Workers AI$0.060 in/1M$0.40 out/1M24 tok/s131K—2 hours ago
Full specs, hardware verdicts and benchmarks on the GLM 4.7 Flash model page →