← 全部模型

Claude · 近 7 天

Claude Sonnet 5.5

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-10-01 09:27 UTC · 2026-09-24 – 2026-10-01 UTC
体感分65.4/100113 条评论 · 近 7 天

大家怎么看

有用户建议在编码工作流中用 Claude Sonnet 5.5 high 作为执行者,由 Opus 5.5 做监督者。用户表示不会信任 Sonnet 提供任何架构或设计建议。

样本与评分说明

截至 2026-10-01 09:52:04 UTC,Claude 家族的 Claude Sonnet 5.5 在近 7 天有 113 条明确归属该版本的社区反馈,社区口碑分为 65.4/100。部分有效分类评分:通用文本 67.2/100 (n=55);编程 75.0/100 (n=8);推理 63.6/100 (n=23)。 评分方法与数据来源

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

26 条精选摘录

额度评价来自社区体验,不能据此推算官方实际配额。

负面推理

“我不会信任 sonnet 给我任何架构/设计建议。”

机器翻译
展开原文

I wouldn't trust sonnet to do give me any architecture/design advices.

负面通用文本

“这玩意儿哪里都不如Opus 5.5,也是给A畜学到国产小参数做题家模型雷霆大思考刷分的精髓了”

正面推理

“一个Sonnet 5.5 high实施者”

机器翻译
展开原文

a Sonnet 5.5 high implementer

查看评论上下文
评论者补充 ↗

所以我不知道你的流程是什么,但建议从模型角度直接用Opus 5.5 high或medium作为编排器来监督Sonnet 5.5 high实施者,然后用6.1 sol xhigh(或者如果你发现xhigh对你来说不可持续就用medium)作为评审。

机器翻译
展开原文

So I don't know what's your process but I would suggest models wise to just use Opus 5.5 high or medium as the orchestrator to supervise a Sonnet 5.5 high implementer and use 6.1 sol xhigh (or medium if you notice xhigh is not sustainable for you) as a reviewer.

负面通用文本

“如果你是用API,那就是路边一条,思考等级定低了就是傻狗,定高了成本就朝Opus那边去了”

正面通用文本

“通常要么是 sonnet 5.5 高级”

机器翻译
展开原文

often either sonnet 5.5 high

查看评论上下文
评论者补充 ↗

真的取决于任务,但它通常要么是 sonnet 5.5 高级要么是 opus 5.5 中等。

机器翻译
展开原文

It really depends on the task, but it's often either sonnet 5.5 high or opus 5.5 med.

正面速度与延迟

“丫抠字儿太快了 找她吹牛逼容易跟不上思路”

负面推理

“依靠无限制拉长思考来换取所谓的更高智商,感觉可能不是正确方向”

正面速度与延迟

“opus 5.5 和 sonnet 5.5 也都快多了”

机器翻译
展开原文

opus 5.5 and sonnet 5.5 are much faster too

正面通用文本

“sonnet5.5审美确实一眼高级”

正面通用文本

“Sonnet 5.5很棒。”

机器翻译
展开原文

Sonnet 5.5 is great.

负面推理

“追问,发现有幻觉”

查看评论上下文
评论者补充 ↗

我拿一个跟JEV相关的问题讨论了一下,发现A家的模型现在有个特点。

正面编程

“在智能体命令行编程测试 Terminal-Bench 4.0 中,它以 70.6% 的高分拿下 全球第一 ,相比 Sonnet 5 的 10.3% 属于跨越式暴涨”

正面速度与延迟

“输出速度快了30%”

查看评论上下文
评论者补充 ↗

价格方面与上一代sonnet5一样,比opus5.5便宜了50%,输出速度快了30%,每项任务的成本比上一代最多便宜30%,我做一个表格就能更明显看出来了。

负面使用额度

“A社的账号"娇贵"啊,隔三岔五给你大陆ip全干挺了”

正面使用额度

“才发现Sonnet5.5还挺耐用啊”

负面速度与延迟

“思考用更多token导致更慢”

正面使用额度

“免费用户也能用几下sonnet5.5,反观隔壁免费用户只能用luna”

负面速度与延迟

“同思考档位的sonnet 5.5 比 opus 消耗token更多,效率更低”

负面安全与拒答

“误报防护栏阻止。”

机器翻译
展开原文

false positive guardrail blocks

正面使用额度

“单价只有Opus一半,额度还给得更多,还学会了O社时不时发重置次数”

负面安全与拒答

“我让它写《奇异博士》里的 Gemini,它不肯。”

机器翻译
展开原文

I asked it to write gemini on doctor strange. It wouldnt.

查看评论上下文
回复的评论 ↗

我一次都没遇到过安全机制拒绝。不知道你们在搞什么

机器翻译
展开原文

I've never once hit a safeguard refusal. Dunno what you guys are doing

正面编程

“sonnet 5.5 看起来是帮助代码维护的完美工具”

机器翻译
展开原文

sonnet 5.5 looks like the perfect tool to help with code maintenance

正面安全与拒答

“我一次都没遇到过安全机制拒绝”

机器翻译
展开原文

I've never once hit a safeguard refusal

正面安全与拒答

“它可能很惊人”

机器翻译
展开原文

it can be amazing

中性推理

“楼主说的情况在 Fable 5.1、Opus 5.5、Sonnet 5.5 上也会发生。”

机器翻译
展开原文

What the OP stated happens with Fable 5.1, Opus 5.5, Sonnet 5.5 too.

查看评论上下文
原帖 ↗

如果 Astra 那么厉害,为什么它的代码会引入这么多 bug? 给 Astra 在 Ultra 上一个复杂任务,然后之后输入提示词"review"——你会得到大约 5 个问题。

机器翻译
展开原文

If Astra is that great, how come its code introduces so many bugs? Give Astra a complicated task on Ultra, and then after give the prompt "review" - you will get about 5 problems.

中性速度与延迟

“Sonnet 5.5...:382,000($463)(94.6%)”

机器翻译
展开原文

Sonnet 5.5...: 382,000 ($463) (94.6%)

查看评论上下文
评论者补充 ↗

Tokens | 服务/运行相同代理任务的成本 | 多个基准测试中的性能

机器翻译
展开原文

Tokens | cost to serve/run the same agentic task | performance across multiple benchmarks

你今天的 AI 手感如何?