← 全部模型

GLM · 近 7 天

GLM 5.2

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-09-08 18:27 UTC · 2026-09-01 – 2026-09-08 UTC
社区口碑分71.8/10035 条评论 · 近 7 天

截至 2026-09-08 18:00:04 UTC,GLM 家族的 GLM 5.2 在近 7 天有 35 条明确归属该版本的社区反馈,社区口碑分为 71.8/100。部分有效分类评分:通用文本 69.1/100 (n=14);编程 61.9/100 (n=10);推理 63.5/100 (n=6)。 评分方法与数据来源

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

3 条精选摘录

正面推理

“我认为glm 5.2的举措是一个正确的方向”

Redditen机器翻译
展开原文

I think that the glm 5.2 move was a right direction

正面推理

“它推理说"我之前(在会话早些时候)有权限使用这个脚本",所以它用要求的命令编辑了脚本并完成了目标”

Redditen机器翻译
展开原文

it reasoned "I had permission to use this script in the past (earlier in the session) so it edited the script with the commands it was asking for and accomplished its goal

负面推理

“60美元套餐上的GLM 5.2在遵循指令方面很出色,但缺乏Opus和Fable所具有的真正好的思考能力。”

Redditen机器翻译
展开原文

GLM 5.2 on the 60 dollar plan was great at following instructions, but lacked the actual good thought that Opus and Fable have.

查看长期变化与分析

模型生命周期

GLM 5.2

发布于 2026-06-16 · 返回 GLM

精确版本信号覆盖 2026-08-07–2026-09-07 · n=294

统计窗口:2026-08-11 00:00:00 至 2026-09-08 00:00:00 UTC · 评分方法:experience_score_v2。

趋势历史仍在收集中 当前窗口已达到要求;用于判定的独立分段已有 2/4 个。

生命周期每日更新 · 最新完整 UTC 日期 2026-09-07

固定 14 天基准
74.7
n=90
最近 28 天
66.7
n=244
较基准变化
−8.0
90 天斜率
分 / 30 天

14 天滚动体感趋势

每个每日更新的点汇总此前 14 个完整 UTC 日。虚线是固定发布基准;正式趋势判决仍使用互不重叠的独立 14 天分段。

从 2026-08-13 到 2026-09-07 的 14 天滚动体感趋势;最新分数 60.5,固定基准 74.7。4050607080固定基准 74.72026-07-30–2026-08-13 · 74.7 · n=902026-07-31–2026-08-14 · 74.6 · n=1202026-08-01–2026-08-15 · 74.2 · n=1382026-08-02–2026-08-16 · 74.1 · n=1432026-08-03–2026-08-17 · 73.9 · n=1542026-08-04–2026-08-18 · 72.2 · n=1632026-08-05–2026-08-19 · 71.7 · n=1722026-08-06–2026-08-20 · 71.7 · n=1772026-08-07–2026-08-21 · 70.3 · n=1682026-08-08–2026-08-22 · 71.0 · n=1582026-08-09–2026-08-23 · 70.6 · n=1582026-08-10–2026-08-24 · 69.8 · n=1592026-08-11–2026-08-25 · 68.5 · n=1542026-08-12–2026-08-26 · 65.3 · n=1612026-08-13–2026-08-27 · 65.9 · n=1462026-08-14–2026-08-28 · 63.4 · n=1212026-08-15–2026-08-29 · 59.1 · n=1092026-08-16–2026-08-30 · 59.3 · n=1112026-08-17–2026-08-31 · 58.0 · n=1012026-08-18–2026-09-01 · 60.4 · n=1012026-08-19–2026-09-02 · 61.7 · n=952026-08-20–2026-09-03 · 59.8 · n=942026-08-21–2026-09-04 · 61.6 · n=912026-08-22–2026-09-05 · 61.7 · n=962026-08-23–2026-09-06 · 60.7 · n=922026-08-24–2026-09-07 · 60.5 · n=8708-1308-1808-2308-2809-0209-07

用于趋势判定的独立 14 天分段已就绪 2/4 个。

哪些维度解释了变化

分别展示各维度内部的口碑变化与讨论构成变化。这是观察性贡献,不是因果证明。

主要负向口碑贡献:通用文本, 速度与延迟, 推理。

维度 基准 → 当前 维度变化 权重占比 口碑变化贡献 讨论构成贡献
通用文本 基准 → 当前69.3 → 62.6n=30 → 79 维度变化−6.6 权重占比33.1% → 31.3% 口碑变化贡献−2.14 讨论构成贡献+0.02
速度与延迟 基准 → 当前56.1 → 44.9n=16 → 43 维度变化−11.2 权重占比17.8% → 17.2% 口碑变化贡献−1.96 讨论构成贡献+0.09
推理 基准 → 当前76.4 → 71.6n=21 → 55 维度变化−4.8 权重占比24.7% → 23.1% 口碑变化贡献−1.16 讨论构成贡献−0.12
编程 基准 → 当前72.7 → 78.6n=20 → 54 维度变化+5.9 权重占比21.3% → 23.3% 口碑变化贡献+1.31 讨论构成贡献+0.17
图像/视觉 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献
本地部署 基准 → 当前样本不足n=3 → 7 维度变化 权重占比 口碑变化贡献 讨论构成贡献
角色扮演/创作 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献
安全与拒答 基准 → 当前样本不足n=0 → 6 维度变化 权重占比 口碑变化贡献 讨论构成贡献
视频生成 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献

样本不足维度的未解释贡献:−4.24 分。

生命周期分沿用主指数的体验信号权重,n≥30 后不做样本收缩。它衡量公开用户感知,不代表模型能力,也不能证明后端原因。

你今天的 AI 手感如何?