← 全部模型

GPT · 近 7 天

GPT-6 Luna

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-10-01 09:57 UTC · 2026-09-24 – 2026-10-01 UTC
体感分34.6/100113 条评论 · 近 7 天

大家怎么看

有用户表示,在 DeepSWE v1.1 软件工程测试中,GPT-6 Luna 得 66.6%,接近 Opus 5/Fable 5 的 medium effort,单任务成本低约 93% 和 96%。有用户让GPT-6 Luna用computer use功能解决问题,反复提醒后它始终不敢执行

样本与评分说明

截至 2026-10-01 10:42:02 UTC,GPT 家族的 GPT-6 Luna 在近 7 天有 113 条明确归属该版本的社区反馈,社区口碑分为 34.6/100。部分有效分类评分:通用文本 36.6/100 (n=52);编程 34.9/100 (n=14);推理 36.6/100 (n=15)。 评分方法与数据来源

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

8 条精选摘录

额度评价来自社区体验,不能据此推算官方实际配额。

负面安全与拒答

“叫它用computeruse帮我解决问题,提醒半天死活不敢”

负面速度与延迟

“6luna是个又蠢又慢的模型”

负面使用额度

“Luna 最差(与 API 定价相比)”

机器翻译
展开原文

Luna the worst (compared to API pricing)

负面编程

“只是一个“完成了!”,然后你还得事后把所有东西清理干净”

机器翻译
展开原文

just a "done!" where you then have to clean everything up afterwards

查看评论上下文
评论者补充 ↗

我用 gpt 6 luna 的体验不太好,但 5.6 luna 在比如 React 上表现得非常好,你可以来回交流,它就像队友一样工作,而不是只丢给你一句“完成了!”,然后你还得自己收拾残局

机器翻译
展开原文

I've had bad experiences with gpt 6 luna, but 5.6 luna worked real nicely with e.g React, you can do a back n forth and it'll work like a teammate vs just a "done!" where you then have to clean everything up afterwards

负面速度与延迟

“要开最高档,反复沟通两三轮才能出一点东西”

负面推理

“稍差一点,但是我觉得当子智能体的话不耽误啊,改一下主智能体的提示词,让它把复杂任务拆细就是了。”

查看评论上下文
回复的评论 ↗

我最近没怎么用,6 luna跟5.6luna比难道是退步的么?我之前是设置了子代理强制用6luna max,需要改回5.6 luna max么[笑哭]

负面角色扮演/创作

“我看没什么区别啊”

查看评论上下文
评论者补充 ↗

6luna和5.6luna有什么实质性提升吗?我看没什么区别啊

负面使用额度

“现在用 Luna 6,我算了一下,每周额度全部用完花了 44 美元。这 50% 的降价听起来完全就是个骗局。”

机器翻译
展开原文

Now with Luna 6 I measured after full spending of my weekly, 44 dolars. This 50% price reduction is sounding like a total scam.

你今天的 AI 手感如何?