← 全部模型

GLM · 近 7 天

GLM 5.2

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-09-08 18:27 UTC · 2026-09-01 – 2026-09-08 UTC
社区口碑分71.8/10035 条评论 · 近 7 天

截至 2026-09-08 18:00:04 UTC,GLM 家族的 GLM 5.2 在近 7 天有 35 条明确归属该版本的社区反馈,社区口碑分为 71.8/100。部分有效分类评分:通用文本 69.1/100 (n=14);编程 61.9/100 (n=10);推理 63.5/100 (n=6)。 评分方法与数据来源

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

3 条精选摘录

正面编程

“在 VS Code 中配合 GLM 5.2 使用真的太棒了!”

Redditen机器翻译
展开原文

Working with it in VS Code with GLM 5.2 is so good!

正面编程

“使用GLM 5.2 -Mistral本周将其添加到Vibe- 你可以达到Opus 4.5/Sonnet 5级别的实用性”

Redditen机器翻译
展开原文

With GLM 5.2 -Mistral added it to Vibe this week- you reach Opus 4.5/Sonnet 5 level of usefulness

负面编程

“他们提供的 GLM 5.2 限制很多,推理设置为 medium,谁知道用的是哪种量化版本。我可以告诉你,有些任务 qwen3.8 27B 一次就能完成,GLM 5.2(量化版、medium 推理设置、免费档)却要花上一整天,而且仍然很吃力。”

Redditen机器翻译
展开原文

The GLM 5.2 they offer is highly capped, medium reasoning, and who knows which quant. I can tell you qwen3.8 27B single shots tasks that GLM 5.2 (quantized, medium reasoning, free tier) takes a full day at and still struggles.

查看长期变化与分析

模型生命周期

GLM 5.2

发布于 2026-06-16 · 返回 GLM

精确版本信号覆盖 2026-08-07–2026-09-07 · n=294

统计窗口:2026-08-11 00:00:00 至 2026-09-08 00:00:00 UTC · 评分方法:experience_score_v2。

趋势历史仍在收集中 当前窗口已达到要求;用于判定的独立分段已有 2/4 个。

生命周期每日更新 · 最新完整 UTC 日期 2026-09-07

固定 14 天基准
74.7
n=90
最近 28 天
66.7
n=244
较基准变化
−8.0
90 天斜率
分 / 30 天

14 天滚动体感趋势

每个每日更新的点汇总此前 14 个完整 UTC 日。虚线是固定发布基准;正式趋势判决仍使用互不重叠的独立 14 天分段。

从 2026-08-13 到 2026-09-07 的 14 天滚动体感趋势;最新分数 60.5,固定基准 74.7。4050607080固定基准 74.72026-07-30–2026-08-13 · 74.7 · n=902026-07-31–2026-08-14 · 74.6 · n=1202026-08-01–2026-08-15 · 74.2 · n=1382026-08-02–2026-08-16 · 74.1 · n=1432026-08-03–2026-08-17 · 73.9 · n=1542026-08-04–2026-08-18 · 72.2 · n=1632026-08-05–2026-08-19 · 71.7 · n=1722026-08-06–2026-08-20 · 71.7 · n=1772026-08-07–2026-08-21 · 70.3 · n=1682026-08-08–2026-08-22 · 71.0 · n=1582026-08-09–2026-08-23 · 70.6 · n=1582026-08-10–2026-08-24 · 69.8 · n=1592026-08-11–2026-08-25 · 68.5 · n=1542026-08-12–2026-08-26 · 65.3 · n=1612026-08-13–2026-08-27 · 65.9 · n=1462026-08-14–2026-08-28 · 63.4 · n=1212026-08-15–2026-08-29 · 59.1 · n=1092026-08-16–2026-08-30 · 59.3 · n=1112026-08-17–2026-08-31 · 58.0 · n=1012026-08-18–2026-09-01 · 60.4 · n=1012026-08-19–2026-09-02 · 61.7 · n=952026-08-20–2026-09-03 · 59.8 · n=942026-08-21–2026-09-04 · 61.6 · n=912026-08-22–2026-09-05 · 61.7 · n=962026-08-23–2026-09-06 · 60.7 · n=922026-08-24–2026-09-07 · 60.5 · n=8708-1308-1808-2308-2809-0209-07

用于趋势判定的独立 14 天分段已就绪 2/4 个。

哪些维度解释了变化

分别展示各维度内部的口碑变化与讨论构成变化。这是观察性贡献,不是因果证明。

主要负向口碑贡献:通用文本, 速度与延迟, 推理。

维度 基准 → 当前 维度变化 权重占比 口碑变化贡献 讨论构成贡献
通用文本 基准 → 当前69.3 → 62.6n=30 → 79 维度变化−6.6 权重占比33.1% → 31.3% 口碑变化贡献−2.14 讨论构成贡献+0.02
速度与延迟 基准 → 当前56.1 → 44.9n=16 → 43 维度变化−11.2 权重占比17.8% → 17.2% 口碑变化贡献−1.96 讨论构成贡献+0.09
推理 基准 → 当前76.4 → 71.6n=21 → 55 维度变化−4.8 权重占比24.7% → 23.1% 口碑变化贡献−1.16 讨论构成贡献−0.12
编程 基准 → 当前72.7 → 78.6n=20 → 54 维度变化+5.9 权重占比21.3% → 23.3% 口碑变化贡献+1.31 讨论构成贡献+0.17
图像/视觉 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献
本地部署 基准 → 当前样本不足n=3 → 7 维度变化 权重占比 口碑变化贡献 讨论构成贡献
角色扮演/创作 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献
安全与拒答 基准 → 当前样本不足n=0 → 6 维度变化 权重占比 口碑变化贡献 讨论构成贡献
视频生成 基准 → 当前样本不足n=0 → 0 维度变化 权重占比 口碑变化贡献 讨论构成贡献

样本不足维度的未解释贡献:−4.24 分。

生命周期分沿用主指数的体验信号权重,n≥30 后不做样本收缩。它衡量公开用户感知,不代表模型能力,也不能证明后端原因。

你今天的 AI 手感如何?