← 全部模型

GPT · 近 7 天

GPT-6 Luna

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-10-01 11:07 UTC · 2026-09-24 – 2026-10-01 UTC
体感分35.1/100112 条评论 · 近 7 天

大家怎么看

有用户表示,在 DeepSWE v1.1 软件工程测试中,GPT-6 Luna 得 66.6%,接近 Opus 5/Fable 5 的 medium effort,单任务成本低约 93% 和 96%。有用户让GPT-6 Luna用computer use功能解决问题,反复提醒后它始终不敢执行

样本与评分说明

截至 2026-10-01 11:27:03 UTC,GPT 家族的 GPT-6 Luna 在近 7 天有 112 条明确归属该版本的社区反馈,社区口碑分为 35.1/100。部分有效分类评分:通用文本 37.4/100 (n=51);编程 34.9/100 (n=14);推理 36.6/100 (n=15)。 评分方法与数据来源

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

2 条精选摘录

额度评价来自社区体验,不能据此推算官方实际配额。

正面编程

“GPT-6 Luna 得分为 66.6%,接近 Opus 5 和 Fable 5 的 medium effort,单任务成本则低约 93% 和 96%”

查看评论上下文
评论者补充 ↗

软件工程测试更能说明问题。在 DeepSWE v1.1 中,GPT-6 Sol 的 max effort 得分为 68.8%,距离 Claude Fable 5 的最高成绩 69.9% 只差 1.1 个百分点,但单任务成本低约 80%。GPT-6 Luna 得分为 66.6%,接近 Opus 5 和 Fable 5 的 medium effort,单任务成本则低约 93% 和 96%。

正面编程

“特别推荐GPT6 luna,量大管饱,性能跟sol差距不大”

你今天的 AI 手感如何?