← 全部模型

GLM · 近 7 天

GLM 5.2

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-09-08 18:27 UTC · 2026-09-01 – 2026-09-08 UTC
社区口碑分71.8/10035 条评论 · 近 7 天

截至 2026-09-08 18:00:04 UTC,GLM 家族的 GLM 5.2 在近 7 天有 35 条明确归属该版本的社区反馈,社区口碑分为 71.8/100。部分有效分类评分:通用文本 69.1/100 (n=14);编程 61.9/100 (n=10);推理 63.5/100 (n=6)。 评分方法与数据来源

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

9 条精选摘录

正面通用文本

“GLM 5.2(性能接近前沿,偶尔——非常罕见——会出现一些类似表意文字的故障)”

Redditen机器翻译
展开原文

GLM 5.2 (perf quasi frontier, avec parfois -très rarement- qqs glitchs style idéogrammes)

正面编程

“在 VS Code 中配合 GLM 5.2 使用真的太棒了!”

Redditen机器翻译
展开原文

Working with it in VS Code with GLM 5.2 is so good!

正面通用文本

“GLM5.2在workbuddy的回答如下:(摘录)重点: 全链路ID追踪的锚点: 识别出来或者暂存的作为原料,证据册根据证据清单排序,页码不会乱,不会漂移。 逐点回答你的五个层次”

正面通用文本

“比起5.3和5.3-flash我更喜欢它,因为它感觉更详尽,回答问题更详细”

Hacker Newsen机器翻译
展开原文

I prefer it over 5.3 and 5.3-flash because it feels more verbose and answers questions more detailed

正面推理

“我认为glm 5.2的举措是一个正确的方向”

Redditen机器翻译
展开原文

I think that the glm 5.2 move was a right direction

正面编程

“使用GLM 5.2 -Mistral本周将其添加到Vibe- 你可以达到Opus 4.5/Sonnet 5级别的实用性”

Redditen机器翻译
展开原文

With GLM 5.2 -Mistral added it to Vibe this week- you reach Opus 4.5/Sonnet 5 level of usefulness

正面推理

“它推理说"我之前(在会话早些时候)有权限使用这个脚本",所以它用要求的命令编辑了脚本并完成了目标”

Redditen机器翻译
展开原文

it reasoned "I had permission to use this script in the past (earlier in the session) so it edited the script with the commands it was asking for and accomplished its goal

正面速度与延迟

“这个模型似乎非常快”

Hacker Newsen机器翻译
展开原文

the model seems very fast

正面安全与拒答

“据我所知,GLM 5.3受到严格审查,而5.2相对而言审查较少。”

Redditen机器翻译
展开原文

From what I've heard, GLM 5.3 is extremely censored, while 5.2 is comparatively uncensored.

查看长期变化与分析

模型生命周期

GLM 5.2

发布于 2026-06-16 · 返回 GLM

精确版本信号覆盖 2026-08-07–2026-09-07 · n=294

统计窗口:2026-08-11 00:00:00 至 2026-09-08 00:00:00 UTC · 评分方法:experience_score_v2。

趋势历史仍在收集中 当前窗口已达到要求;用于判定的独立分段已有 2/4 个。

生命周期每日更新 · 最新完整 UTC 日期 2026-09-07

固定 14 天基准
74.7
n=90
最近 28 天
66.7
n=244
较基准变化
−8.0
90 天斜率
分 / 30 天

14 天滚动体感趋势

每个每日更新的点汇总此前 14 个完整 UTC 日。虚线是固定发布基准;正式趋势判决仍使用互不重叠的独立 14 天分段。

从 2026-08-13 到 2026-09-07 的 14 天滚动体感趋势;最新分数 60.5,固定基准 74.7。4050607080固定基准 74.72026-07-30–2026-08-13 · 74.7 · n=902026-07-31–2026-08-14 · 74.6 · n=1202026-08-01–2026-08-15 · 74.2 · n=1382026-08-02–2026-08-16 · 74.1 · n=1432026-08-03–2026-08-17 · 73.9 · n=1542026-08-04–2026-08-18 · 72.2 · n=1632026-08-05–2026-08-19 · 71.7 · n=1722026-08-06–2026-08-20 · 71.7 · n=1772026-08-07–2026-08-21 · 70.3 · n=1682026-08-08–2026-08-22 · 71.0 · n=1582026-08-09–2026-08-23 · 70.6 · n=1582026-08-10–2026-08-24 · 69.8 · n=1592026-08-11–2026-08-25 · 68.5 · n=1542026-08-12–2026-08-26 · 65.3 · n=1612026-08-13–2026-08-27 · 65.9 · n=1462026-08-14–2026-08-28 · 63.4 · n=1212026-08-15–2026-08-29 · 59.1 · n=1092026-08-16–2026-08-30 · 59.3 · n=1112026-08-17–2026-08-31 · 58.0 · n=1012026-08-18–2026-09-01 · 60.4 · n=1012026-08-19–2026-09-02 · 61.7 · n=952026-08-20–2026-09-03 · 59.8 · n=942026-08-21–2026-09-04 · 61.6 · n=912026-08-22–2026-09-05 · 61.7 · n=962026-08-23–2026-09-06 · 60.7 · n=922026-08-24–2026-09-07 · 60.5 · n=8708-1308-1808-2308-2809-0209-07

用于趋势判定的独立 14 天分段已就绪 2/4 个。

哪些维度解释了变化

分别展示各维度内部的口碑变化与讨论构成变化。这是观察性贡献,不是因果证明。

主要负向口碑贡献:通用文本, 速度与延迟, 推理。

维度 基准 → 当前 维度变化 权重占比 口碑变化贡献 讨论构成贡献
通用文本 基准 → 当前69.3 → 62.6n=30 → 79 维度变化−6.6 权重占比33.1% → 31.3% 口碑变化贡献−2.14 讨论构成贡献+0.02
速度与延迟 基准 → 当前56.1 → 44.9n=16 → 43 维度变化−11.2 权重占比17.8% → 17.2% 口碑变化贡献−1.96 讨论构成贡献+0.09
推理 基准 → 当前76.4 → 71.6n=21 → 55 维度变化−4.8 权重占比24.7% → 23.1% 口碑变化贡献−1.16 讨论构成贡献−0.12
编程 基准 → 当前72.7 → 78.6n=20 → 54 维度变化+5.9 权重占比21.3% → 23.3% 口碑变化贡献+1.31 讨论构成贡献+0.17
图像/视觉 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献
本地部署 基准 → 当前样本不足n=3 → 7 维度变化 权重占比 口碑变化贡献 讨论构成贡献
角色扮演/创作 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献
安全与拒答 基准 → 当前样本不足n=0 → 6 维度变化 权重占比 口碑变化贡献 讨论构成贡献
视频生成 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献

样本不足维度的未解释贡献:−4.24 分。

生命周期分沿用主指数的体验信号权重,n≥30 后不做样本收缩。它衡量公开用户感知,不代表模型能力,也不能证明后端原因。

你今天的 AI 手感如何?