← 全部模型

Claude · 近 7 天

Claude Sonnet 5.5

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-10-01 09:57 UTC · 2026-09-24 – 2026-10-01 UTC
体感分65.4/100113 条评论 · 近 7 天

大家怎么看

有用户建议在编码工作流中用 Claude Sonnet 5.5 high 作为执行者,由 Opus 5.5 做监督者。用户表示不会信任 Sonnet 提供任何架构或设计建议。

样本与评分说明

截至 2026-10-01 10:42:02 UTC,Claude 家族的 Claude Sonnet 5.5 在近 7 天有 113 条明确归属该版本的社区反馈,社区口碑分为 65.4/100。部分有效分类评分:通用文本 67.2/100 (n=55);编程 75.0/100 (n=8);推理 63.6/100 (n=23)。 评分方法与数据来源

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

5 条精选摘录

额度评价来自社区体验,不能据此推算官方实际配额。

负面推理

“我不会信任 sonnet 给我任何架构/设计建议。”

机器翻译
展开原文

I wouldn't trust sonnet to do give me any architecture/design advices.

正面推理

“一个Sonnet 5.5 high实施者”

机器翻译
展开原文

a Sonnet 5.5 high implementer

查看评论上下文
评论者补充 ↗

所以我不知道你的流程是什么,但建议从模型角度直接用Opus 5.5 high或medium作为编排器来监督Sonnet 5.5 high实施者,然后用6.1 sol xhigh(或者如果你发现xhigh对你来说不可持续就用medium)作为评审。

机器翻译
展开原文

So I don't know what's your process but I would suggest models wise to just use Opus 5.5 high or medium as the orchestrator to supervise a Sonnet 5.5 high implementer and use 6.1 sol xhigh (or medium if you notice xhigh is not sustainable for you) as a reviewer.

负面推理

“依靠无限制拉长思考来换取所谓的更高智商,感觉可能不是正确方向”

负面推理

“追问,发现有幻觉”

查看评论上下文
评论者补充 ↗

我拿一个跟JEV相关的问题讨论了一下,发现A家的模型现在有个特点。

中性推理

“楼主说的情况在 Fable 5.1、Opus 5.5、Sonnet 5.5 上也会发生。”

机器翻译
展开原文

What the OP stated happens with Fable 5.1, Opus 5.5, Sonnet 5.5 too.

查看评论上下文
原帖 ↗

如果 Astra 那么厉害,为什么它的代码会引入这么多 bug? 给 Astra 在 Ultra 上一个复杂任务,然后之后输入提示词"review"——你会得到大约 5 个问题。

机器翻译
展开原文

If Astra is that great, how come its code introduces so many bugs? Give Astra a complicated task on Ultra, and then after give the prompt "review" - you will get about 5 problems.

你今天的 AI 手感如何?