Provider guide
Where to run GLM 5.2
40 live offers tracked — output prices vary 4.0× between the cheapest and most expensive host, so the provider choice matters as much as the model choice.
StreamLake$0.63 in/1M$1.98 out/1M31 tok/s1Mfp838m agoBaidu$0.76 in/1M$2.38 out/1M46 tok/s1Mfp814h agoDeepInfra$0.75 in/1M$2.40 out/1M—1Mfp47h agoOpenRouterCHEAPEST$0.76 in/1M$2.42 out/1M—1M—40m agoAmbient$0.76 in/1M$2.42 out/1M—101Kfp88d agoDecart$1.20 in/1M$2.50 out/1M—1Mfp87d agoAlibaba Cloud$0.83 in/1M$2.60 out/1M42 tok/s1M—7d agoGMICloud$0.92 in/1M$2.90 out/1M35 tok/s1Mfp838m agoAlibaba Cloud$0.97 in/1M$3.04 out/1M44 tok/s1Mfp838m agoChutes$1.25 in/1M$3.95 out/1M26 tok/s1Mfp438m agoAtlasCloud$1.26 in/1M$3.96 out/1M26 tok/s1Mfp838m agoWafer$1.26 in/1M$3.96 out/1M74 tok/s1Mfp438m agoNovita AI$1.40 in/1M$4.40 out/1M—1M—7h agoCloudflare Workers AI$1.40 in/1M$4.40 out/1M78 tok/s262K—38m agoFriendli$1.40 in/1M$4.40 out/1M94 tok/s1M—38m agoIo Net$3.66 in/1M$8.01 out/1M88 tok/s262Kfp85d agoDecartzero-retention$0.60 in/1M$1.50 out/1M37 tok/s1Mfp438m agoNovita AIzero-retention$0.63 in/1M$1.98 out/1M23 tok/s1Mfp838m agoDeepInfrazero-retention$0.75 in/1M$2.40 out/1M35 tok/s1Mfp438m agoCoreWeavezero-retention$0.76 in/1M$2.42 out/1M100 tok/s262Kfp438m agoAkashMLzero-retention$0.77 in/1M$2.42 out/1M36 tok/s97Kfp838m agoInceptronzero-retention$0.94 in/1M$2.90 out/1M17 tok/s1Mfp438m agoSail Researchzero-retention$1.00 in/1M$3.50 out/1M54 tok/s1Mfp838m agoSiliconFlowzero-retention$1.19 in/1M$3.74 out/1M33 tok/s1Mfp838m agoPhalazero-retention$1.26 in/1M$3.96 out/1M28 tok/s1M—38m agoMorphzero-retention$1.10 in/1M$4.10 out/1M46 tok/s1M—38m agoIonstreamzero-retention$1.40 in/1M$4.40 out/1M77 tok/s1Mfp438m agoCrusoezero-retention$1.40 in/1M$4.40 out/1M113 tok/s1Mfp838m agoDigitalOcean Gradientzero-retention$1.05 in/1M$4.40 out/1M48 tok/s262K—38m agoParasailzero-retention$1.40 in/1M$4.40 out/1M112 tok/s262Kfp438m agoBasetenzero-retention$1.40 in/1M$4.40 out/1M65 tok/s1Mfp838m agoFireworks AIzero-retention$1.40 in/1M$4.40 out/1M45 tok/s1M—38m agoZ.AIzero-retention$1.40 in/1M$4.40 out/1M17 tok/s1Mfp838m agoVenice AIzero-retention$1.40 in/1M$4.40 out/1M43 tok/s1Mfp838m agoTogether AIzero-retention$1.40 in/1M$4.40 out/1M85 tok/s512K—38m agoWaferfast tier$2.10 in/1M$6.60 out/1M95 tok/s1Mfp438m agoCloudflare Workers AIfast tier$2.10 in/1M$6.60 out/1M66 tok/s262K—38m agoFireworks AIfast tierzero-retention$2.10 in/1M$6.60 out/1M93 tok/s1M—38m agoBasetenfast tier$2.10 in/1M$6.60 out/1M135 tok/s524Kfp838m agoAlibaba Cloudfast tier$2.31 in/1M$7.26 out/1M69 tok/s1Mfp838m ago
Full specs, hardware verdicts and benchmarks on theGLM 5.2 model page →