GPT · 近 7 天
GPT-5.6 Luna
0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。
更新于 2026-10-03 15:32 UTC · 2026-09-26 – 2026-10-03 UTC讨论概览
主要讨论什么
全部平台 · 近7天 29 条合格评论,包含额度反馈;按来源与评论去重。
- 通用文本 · 11 条:正面 7 / 负面 4 / 褒贬或中性 0
- 使用额度 · 7 条:正面 3 / 负面 2 / 褒贬或中性 2
- 编程 · 5 条:正面 4 / 负面 1 / 褒贬或中性 0
- 推理 · 5 条:正面 3 / 负面 2 / 褒贬或中性 0
同一评论可涉及多个维度,各项不可相加;方向计数不等于加权评分。链接展示该维度的精选原文。
近期变化
近7天滚动体感分较7天前 +14.0 分。讨论构成也会影响分数,这不是原因诊断。
样本分布与讨论集中度
Hacker News 3 · Reddit 21 · 知乎 5
可识别 20 个讨论,覆盖 26/29 条评论;最大单帖 3 条。其余讨论归属未知,不推算独立用户数。
个体观点选摘
有用户建议在小型编程任务上测试 GPT-5.6 Luna,并配有清晰测试。 有用户反馈GPT-5.6 Luna非常笨拙、无法使用工具调用,在聊天中表现极差。
样本与评分说明
截至 2026-10-03 15:32:04 UTC,GPT 家族的 GPT-5.6 Luna 在近 7 天有 29 条明确归属该版本的社区反馈,社区口碑分为 62.7/100。部分有效分类评分:通用文本 58.1/100 (n=11);编程 60.8/100 (n=5);推理 53.9/100 (n=5)。 评分方法与数据来源
近期走势
口碑在如何变化
近 30 天,每点代表截至该日采样时刻的近 7 天滚动体感分。纵轴随数据调整;缺失或样本不足处断开,今天仍在更新。
点按或用 ← → 查看日期、分数与样本量;空白日期暂无足够数据。
查看每日读数与样本量
| 日期 | 体感分 | n | 评分窗口(UTC) |
|---|---|---|---|
| 2026-10-03 | 55.0 | 5 | 2026-09-26T15:32:04+00:00 – 2026-10-03T15:32:04+00:00 |
| 2026-10-02 | 50.7 | 9 | 2026-09-25T23:57:03+00:00 – 2026-10-02T23:57:03+00:00 |
| 2026-10-01 | 46.0 | 11 | 2026-09-24T23:57:02+00:00 – 2026-10-01T23:57:02+00:00 |
| 2026-09-30 | 47.0 | 15 | 2026-09-23T23:57:03+00:00 – 2026-09-30T23:57:03+00:00 |
| 2026-09-29 | 44.6 | 18 | 2026-09-22T23:57:03+00:00 – 2026-09-29T23:57:03+00:00 |
| 2026-09-28 | 44.6 | 18 | 2026-09-21T23:57:03+00:00 – 2026-09-28T23:57:03+00:00 |
| 2026-09-27 | 46.2 | 19 | 2026-09-20T23:57:03+00:00 – 2026-09-27T23:57:03+00:00 |
| 2026-09-26 | 49.1 | 12 | 2026-09-19T23:57:03+00:00 – 2026-09-26T23:57:03+00:00 |
| 2026-09-25 | 49.1 | 12 | 2026-09-18T23:57:03+00:00 – 2026-09-25T23:57:03+00:00 |
| 2026-09-24 | 48.1 | 8 | 2026-09-17T23:57:03+00:00 – 2026-09-24T23:57:03+00:00 |
| 2026-09-23 | 52.5 | 5 | 2026-09-16T23:57:03+00:00 – 2026-09-23T23:57:03+00:00 |
| 2026-09-22 | — | 2 | 2026-09-15T23:57:03+00:00 – 2026-09-22T23:57:03+00:00 |
| 2026-09-21 | — | 2 | 2026-09-14T23:57:03+00:00 – 2026-09-21T23:57:03+00:00 |
| 2026-09-20 | — | 1 | 2026-09-13T23:57:03+00:00 – 2026-09-20T23:57:03+00:00 |
| 2026-09-19 | — | 1 | 2026-09-12T23:57:03+00:00 – 2026-09-19T23:57:03+00:00 |
| 2026-09-18 | — | 1 | 2026-09-11T23:57:02+00:00 – 2026-09-18T23:57:02+00:00 |
| 2026-09-17 | — | 2 | 2026-09-10T23:57:03+00:00 – 2026-09-17T23:57:03+00:00 |
| 2026-09-16 | — | 3 | 2026-09-09T23:57:03+00:00 – 2026-09-16T23:57:03+00:00 |
| 2026-09-15 | — | 2 | 2026-09-08T23:57:03+00:00 – 2026-09-15T23:57:03+00:00 |
| 2026-09-14 | — | 3 | 2026-09-07T23:57:03+00:00 – 2026-09-14T23:57:03+00:00 |
| 2026-09-13 | — | 4 | 2026-09-06T23:57:03+00:00 – 2026-09-13T23:57:03+00:00 |
| 2026-09-12 | 54.6 | 5 | 2026-09-05T23:57:03+00:00 – 2026-09-12T23:57:03+00:00 |
| 2026-09-11 | 56.6 | 5 | 2026-09-04T23:00:04+00:00 – 2026-09-11T23:00:04+00:00 |
| 2026-09-10 | 56.6 | 5 | 2026-09-03T23:00:05+00:00 – 2026-09-10T23:00:05+00:00 |
| 2026-09-09 | 51.3 | 5 | 2026-09-02T23:00:04+00:00 – 2026-09-09T23:00:04+00:00 |
| 2026-09-08 | 58.6 | 7 | 2026-09-01T23:00:03+00:00 – 2026-09-08T23:00:03+00:00 |
| 2026-09-07 | 57.8 | 7 | 2026-08-31T23:00:03+00:00 – 2026-09-07T23:00:03+00:00 |
| 2026-09-06 | 55.2 | 5 | 2026-08-30T23:00:02+00:00 – 2026-09-06T23:00:02+00:00 |
| 2026-09-05 | 55.2 | 5 | 2026-08-29T23:00:03+00:00 – 2026-09-05T23:00:03+00:00 |
| 2026-09-04 | — | 4 | 2026-08-28T23:00:03+00:00 – 2026-09-04T23:00:03+00:00 |
知乎 · 55.0 · 5 条评分评论 · 查看该平台评价 →
不同社区,同一模型
各平台怎么看
各平台独立计算,样本量和讨论人群不同。平台分数不取简单平均;评分评论不包含仅讨论额度的评论。
分数范围 0–100。点击平台查看趋势及对应评价。最新评论时间不代表爬虫运行状态。
查看长期变化与分析
模型生命周期
GPT-5.6 Luna
发布于 2026-07-10 · 返回 GPT
精确版本信号覆盖 2026-09-23–2026-10-02 · n=70
统计窗口:2026-09-05 00:00:00 至 2026-10-03 00:00:00 UTC · 评分方法:experience_score_v3。
生命周期每日更新 · 最新完整 UTC 日期 2026-10-02
当前分类口径在原基线窗口内的评价不足。原时间窗保留,暂不判断长期改善或下降;旧口径分数不参与比较。
- 固定 14 天基准
- – n=0
- 最近 28 天
- 58.4 n=58
- 较基准变化
- –
- 90 天斜率
- – 分 / 30 天
14 天滚动体感趋势
每个每日更新的点汇总此前 14 个完整 UTC 日。虚线是固定发布基准;正式趋势判决仍使用互不重叠的独立 14 天分段。
用于趋势判定的独立 14 天分段已就绪 0/4 个。
哪些维度解释了变化
分别展示各维度内部的口碑变化与讨论构成变化。这是观察性贡献,不是因果证明。
暂无维度在基准与当前窗口同时达到样本门槛。
| 维度 | 基准 → 当前 | 维度变化 | 权重占比 | 口碑变化贡献 | 讨论构成贡献 |
|---|---|---|---|---|---|
| 编程 | 基准 → 当前样本不足n=0 → 9 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 图像生成 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 图像理解 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 本地部署 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 推理 | 基准 → 当前样本不足n=0 → 11 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 角色扮演/创作 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 安全与拒答 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 速度与延迟 | 基准 → 当前样本不足n=0 → 5 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 通用文本 | 基准 → 当前样本不足n=0 → 34 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
| 视频生成 | 基准 → 当前样本不足n=0 → 0 | 维度变化– | 权重占比– | 口碑变化贡献– | 讨论构成贡献– |
生命周期分沿用主指数的体验信号权重,n≥30 后不做样本收缩。它衡量公开用户感知,不代表模型能力,也不能证明后端原因。
社区评论
精选近 7 天的不同意见,摘录条数不代表真实好评比例。
1 条精选摘录
额度评价来自社区体验,不能据此推算官方实际配额。
展开原文
Luna is worth testing on a small coding task with clear tests.
展开原文
GPT Plus has an excellent, low-cost programming model (GPT Luna)
展开原文
It takes too long to load and then the app crashes
展开原文
no practical reason to use Gemini 3.8 Flash vs GPT 5.6 Luna
展开原文
Too good for its price
展开原文
GPT-5.6 Luna on max thinking was even more accurate than Jev in classification tests
展开原文
It was as dumb as rocks and couldn't use tool calls at all. It was shockingly poor in chat tbh.
展开原文
couldn't use tool calls at all
展开原文
I still prefer 5.6 Luna xhigh and max for implementation and debug work
展开原文
prior models because their performance has significantly degraded
展开原文
the old model doing backup duty is kind of clever
查看评论上下文
所以备用模型实际上就是之前的模型(gpt-5.6-Luna),拥有自己 100% 的配额——让旧模型承担备份职责还挺聪明的。
机器翻译展开原文
So the reserve is literally the previous model (gpt-5.6-Luna) with its own 100% quota — the old model doing backup duty is kind of clever.
展开原文
we run 5.6 luna on fast mode 24/7 and use 3% the entire week
展开原文
we run 5.6 luna on fast mode 24/7
展开原文
from experience sol 6 is much better than 5.6 luna in terms of intelligence
展开原文
x2 more expensive than 6 luna but hella intelligent
近 7 天暂时没有符合此筛选条件的精选评论。