GPT · 近 7 天
GPT-6 Luna
0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。
更新于 2026-10-01 11:32 UTC · 2026-09-24 – 2026-10-01 UTC体感分35.6/100111 条评论 · 近 7 天
大家怎么看
有用户表示,在 DeepSWE v1.1 软件工程测试中,GPT-6 Luna 得 66.6%,接近 Opus 5/Fable 5 的 medium effort,单任务成本低约 93% 和 96%。有用户让GPT-6 Luna用computer use功能解决问题,反复提醒后它始终不敢执行
样本与评分说明
截至 2026-10-01 13:07:02 UTC,GPT 家族的 GPT-6 Luna 在近 7 天有 111 条明确归属该版本的社区反馈,社区口碑分为 35.6/100。部分有效分类评分:通用文本 37.4/100 (n=51);编程 34.9/100 (n=14);推理 39.2/100 (n=14)。 评分方法与数据来源
社区评论
精选近 7 天的不同意见,摘录条数不代表真实好评比例。
2 条精选摘录
额度评价来自社区体验,不能据此推算官方实际配额。
查看评论上下文
软件工程测试更能说明问题。在 DeepSWE v1.1 中,GPT-6 Sol 的 max effort 得分为 68.8%,距离 Claude Fable 5 的最高成绩 69.9% 只差 1.1 个百分点,但单任务成本低约 80%。GPT-6 Luna 得分为 66.6%,接近 Opus 5 和 Fable 5 的 medium effort,单任务成本则低约 93% 和 96%。
展开原文
in pro x5 its been used for goal 1 week straight heavily and only used 3-5%
展开原文
Luna the worst (compared to API pricing)
展开原文
just a "done!" where you then have to clean everything up afterwards
查看评论上下文
我用 gpt 6 luna 的体验不太好,但 5.6 luna 在比如 React 上表现得非常好,你可以来回交流,它就像队友一样工作,而不是只丢给你一句“完成了!”,然后你还得自己收拾残局
机器翻译展开原文
I've had bad experiences with gpt 6 luna, but 5.6 luna worked real nicely with e.g React, you can do a back n forth and it'll work like a teammate vs just a "done!" where you then have to clean everything up afterwards
展开原文
Luna is basically unlimited
查看评论上下文
我最近没怎么用,6 luna跟5.6luna比难道是退步的么?我之前是设置了子代理强制用6luna max,需要改回5.6 luna max么[笑哭]
展开原文
API answers are way better because I use Luna kind of like an LLM director in a game
查看评论上下文
6luna和5.6luna有什么实质性提升吗?我看没什么区别啊
展开原文
Now with Luna 6 I measured after full spending of my weekly, 44 dolars. This 50% price reduction is sounding like a total scam.
近 7 天暂时没有符合此筛选条件的精选评论。