Provider guide
Where to run GLM 4.7 Flash
5 live listings tracked.
FASTEST MEASURED
23 tok/s
measured throughput · $0.060 input / $0.40 output per million tokens
OpenRouter$0.060 in/1M$0.40 out/1M—200K—6 min agoDeepInfraCHEAPEST$0.060 in/1M$0.40 out/1M—203Kbf1628 days agoNovita AIzero-retention through OpenRouterDirect and through OpenRouter$0.070 in/1M$0.40 out/1M—200Kbf166 hours ago direct23 days ago through OpenRouterVenice AIzero-retention$0.060 in/1M$0.40 out/1M21 tok/s128Kfp84 min agoCloudflare Workers AI$0.060 in/1M$0.40 out/1M23 tok/s131K—4 min ago
Full specs, hardware verdicts and benchmarks on the GLM 4.7 Flash model page →