GLM · 近 7 天
GLM 5.2
0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。
更新于 2026-09-08 18:27 UTC · 2026-09-01 – 2026-09-08 UTC社区口碑分71.8/10035 条评论 · 近 7 天
截至 2026-09-08 18:00:04 UTC,GLM 家族的 GLM 5.2 在近 7 天有 35 条明确归属该版本的社区反馈,社区口碑分为 71.8/100。部分有效分类评分:通用文本 69.1/100 (n=14);编程 61.9/100 (n=10);推理 63.5/100 (n=6)。 评分方法与数据来源
查看长期变化与分析
模型生命周期
GLM 5.2
发布于 2026-06-16 · 返回 GLM
精确版本信号覆盖 2026-08-07–2026-09-07 · n=294
统计窗口:2026-08-11 00:00:00 至 2026-09-08 00:00:00 UTC · 评分方法:experience_score_v2。
趋势历史仍在收集中
当前窗口已达到要求;用于判定的独立分段已有 2/4 个。
生命周期每日更新 · 最新完整 UTC 日期 2026-09-07
- 固定 14 天基准
- 74.7 n=90
- 最近 28 天
- 66.7 n=244
- 较基准变化
- −8.0
- 90 天斜率
- – 分 / 30 天
14 天滚动体感趋势
每个每日更新的点汇总此前 14 个完整 UTC 日。虚线是固定发布基准;正式趋势判决仍使用互不重叠的独立 14 天分段。
用于趋势判定的独立 14 天分段已就绪 2/4 个。
哪些维度解释了变化
分别展示各维度内部的口碑变化与讨论构成变化。这是观察性贡献,不是因果证明。
主要负向口碑贡献:通用文本, 速度与延迟, 推理。
| 维度 | 基准 → 当前 | 维度变化 | 权重占比 | 口碑变化贡献 | 讨论构成贡献 |
|---|---|---|---|---|---|
| 通用文本 | 基准 → 当前69.3 → 62.6n=30 → 79 | 维度变化−6.6 | 权重占比33.1% → 31.3% | 口碑变化贡献−2.14 | 讨论构成贡献+0.02 |
| 速度与延迟 | 基准 → 当前56.1 → 44.9n=16 → 43 | 维度变化−11.2 | 权重占比17.8% → 17.2% | 口碑变化贡献−1.96 | 讨论构成贡献+0.09 |
| 推理 | 基准 → 当前76.4 → 71.6n=21 → 55 | 维度变化−4.8 | 权重占比24.7% → 23.1% | 口碑变化贡献−1.16 | 讨论构成贡献−0.12 |
| 编程 | 基准 → 当前72.7 → 78.6n=20 → 54 | 维度变化+5.9 | 权重占比21.3% → 23.3% | 口碑变化贡献+1.31 | 讨论构成贡献+0.17 |
| 图像/视觉 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 本地部署 | 基准 → 当前样本不足n=3 → 7 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 角色扮演/创作 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 安全与拒答 | 基准 → 当前样本不足n=0 → 6 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 视频生成 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
样本不足维度的未解释贡献:−4.24 分。
生命周期分沿用主指数的体验信号权重,n≥30 后不做样本收缩。它衡量公开用户感知,不代表模型能力,也不能证明后端原因。
社区评论
精选近 7 天的不同意见,摘录条数不代表真实好评比例。
9 条精选摘录
展开原文
GLM 5.2 (perf quasi frontier, avec parfois -très rarement- qqs glitchs style idéogrammes)
展开原文
Working with it in VS Code with GLM 5.2 is so good!
展开原文
I prefer it over 5.3 and 5.3-flash because it feels more verbose and answers questions more detailed
展开原文
I think that the glm 5.2 move was a right direction
展开原文
I say this while having a devin cli subscription that gives me a "free and unlimited" GLM 5.2 that really sucks as I explained in my original comment.
展开原文
With GLM 5.2 -Mistral added it to Vibe this week- you reach Opus 4.5/Sonnet 5 level of usefulness
展开原文
The GLM 5.2 they offer is highly capped, medium reasoning, and who knows which quant. I can tell you qwen3.8 27B single shots tasks that GLM 5.2 (quantized, medium reasoning, free tier) takes a full day at and still struggles.
展开原文
it reasoned "I had permission to use this script in the past (earlier in the session) so it edited the script with the commands it was asking for and accomplished its goal
展开原文
GLM 5.2 on the 60 dollar plan was great at following instructions, but lacked the actual good thought that Opus and Fable have.
展开原文
GLM 5.2 ~210–235 tok/s aggregate For 16 concurrent streams Prefill: ~3,200–3,500 tok/s aggregate
展开原文
the model seems very fast
展开原文
From what I've heard, GLM 5.3 is extremely censored, while 5.2 is comparatively uncensored.
近 7 天暂时没有符合此筛选条件的精选评论。