← 全部模型

GLM · 近 7 天

GLM 5.3 Flash

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-09-05 16:01 UTC · 2026-08-29 – 2026-09-05 UTC
社区口碑分67.4/100305 条评论 · 近 7 天

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

2 条精选摘录

正面速度与延迟

“GLM 5.3 flash以50/60tok/s的解码速度运行,prefill为2k tok/秒,并发4个流每个25-30tok/s解码”

Redditen机器翻译
展开原文

GLM 5.3 flash running at 50/60tok/s decode with 2k tok/sec prefill and concurrency of 4 streams at 25-30tok/s decode each

正面速度与延迟

“glm 5.3 flash、ds 4 flash 0723、qwen 3.8 flash next都很好,应该可以运行。不确定问题是什么。它们正以非常快的速度越来越接近sota模型。”

Redditen机器翻译
展开原文

glm 5.3 flash, ds 4 flash 0723, qwen 3.8 flash next are all great and should fit. Not sure what the issue is. They are getting closer and closer to sota models, very fast.