← 全部模型

GLM · 近 7 天

GLM 5.3

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-09-05 14:21 UTC · 2026-08-29 – 2026-09-05 UTC
社区口碑分67.5/100136 条评论 · 近 7 天

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

9 条精选摘录

负面安全与拒答

“与其他AI相比,在这次更新和GLM-5.3推出后,它的安全协议非常激进。无论我让她做什么或创建什么,她都会给出一个完全扭曲的回应,说这很危险,可能会造成风险”

Redditen机器翻译
展开原文

Compared to other AIs, after this update and the arrival of GLM-5.3, it has a very aggressive security protocol. Anything I ask her to do or create, she gives off a completely distorted view, saying that it's dangerous and could cause risk

负面通用文本

“比如 GLM-5.3 的真实泛化能力与海外顶尖梯队仍有差距,但 AA 榜总分却紧咬 GPT-6(只差一分)”

负面推理

“五分钟前它轻松彻底破解了一个复杂的GLM 5.3诊断题,GLM不得不承认失败 lol”

Redditen机器翻译
展开原文

it had no problem completely busting a comprehensive GLM 5.3 diagnosis for me 5 minutes ago to which GLM had to admit defeat lol

负面本地部署

“用GLM 5.3,你的配置会比基准测试显示的效果更差,因为你必须运行比基准测试使用的更低量化版本。”

Redditen机器翻译
展开原文

With GLM 5.3, your setup would do worse than what you see in benchmarks, since you'd have to run a lower quant than what the benchmarks use.

负面本地部署

“你只能容纳Q4量化的GLM 5.3,所以我不认为把它换成DeepSeek的全精度有什么意义。”

Redditen机器翻译
展开原文

You can only fit GLM 5.3 in Q4, so I doubt it makes sense to trade that for full precision on DeepSeek.

负面推理

“知识丰富:我让它默写了一首茉莉花的音乐,做出来八九不离十。同样的任务交给 GLM-5.3,只会重复第一句,后面都想不起来了。”

负面编程

“几何和多边形很弱”

Redditen机器翻译
展开原文

geometry and polygons were weak

负面通用文本

“两者的楼梯都有客观上很糟糕的问题。”

Redditen机器翻译
展开原文

Both have objectively terrible staircases.

负面编程

“5.3 Flash很棒,实际上比更大的5.3感觉更像下一代产品。”

Redditen机器翻译
展开原文

5.3 Flash is awesome, actually feels like the next generation compared to the bigger 5.3.