Claude · 近 7 天

Claude Sonnet 5.5

0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。

更新于 2026-10-03 08:42 UTC · 2026-09-26 – 2026-10-03 UTC
全部平台体感分66.7/100129 条评论 · 近 7 天

讨论概览

主要讨论什么

全部平台 · 近7天 129 条合格评论,包含额度反馈;按来源与评论去重。

  • 通用文本 · 62 条:正面 43 / 负面 18 / 褒贬或中性 1
  • 推理 · 29 条:正面 20 / 负面 7 / 褒贬或中性 2
  • 速度与延迟 · 25 条:正面 18 / 负面 6 / 褒贬或中性 1
  • 使用额度 · 11 条:正面 3 / 负面 6 / 褒贬或中性 2

同一评论可涉及多个维度,各项不可相加;方向计数不等于加权评分。链接展示该维度的精选原文。

近期变化

近期变化:历史不足,暂不判断改善或下降。

样本分布与讨论集中度

Hacker News 4 · Reddit 66 · 知乎 59

可识别 44 个讨论,覆盖 125/129 条评论;最大单帖 51 条。其余讨论归属未知,不推算独立用户数。

个体观点选摘

有用户建议在购买100美元套餐前应更充分地使用Sonnet 5.5,大多数人过早切到Opus 了。 有用户稍看了下Claude Sonnet 5.5生成的汤姆逊问题证明后,嘲讽地说能从这种证明中获得灵感的人不如直接去当计算机。

样本与评分说明

截至 2026-10-03 08:42:04 UTC,Claude 家族的 Claude Sonnet 5.5 在近 7 天有 129 条明确归属该版本的社区反馈,社区口碑分为 66.7/100。部分有效分类评分:通用文本 66.0/100 (n=62);编程 76.4/100 (n=9);推理 68.0/100 (n=29)。 评分方法与数据来源

近期走势

口碑在如何变化

历史不足较 7 天前 · 分

近 30 天,每点代表截至该日采样时刻的近 7 天滚动体感分。纵轴随数据调整;缺失或样本不足处断开,今天仍在更新。

点按或用 ← → 查看日期、分数与样本量;空白日期暂无足够数据。

Claude Sonnet 5.5 · Reddit · 近30天,每点为近7天滚动体感分 40506070 有效日均值: 66.6 2026-09-29 · 63.8 · n=41 · 2026-09-22T23:57:03+00:00 – 2026-09-29T23:57:03+00:002026-09-30 · 66.9 · n=48 · 2026-09-23T23:57:03+00:00 – 2026-09-30T23:57:03+00:002026-10-01 · 66.3 · n=57 · 2026-09-24T23:57:02+00:00 – 2026-10-01T23:57:02+00:002026-10-02 · 67.7 · n=60 · 2026-09-25T23:57:03+00:00 – 2026-10-02T23:57:03+00:002026-10-03 · 68.3 · n=61 · 2026-09-26T08:42:04+00:00 – 2026-10-03T08:42:04+00:00 68.3 09-0409-1209-1909-2610-03 Claude Sonnet 5.5 · Reddit · 近30天,每点为近7天滚动体感分 40506070 有效日均值: 66.6 2026-09-29 · 63.8 · n=41 · 2026-09-22T23:57:03+00:00 – 2026-09-29T23:57:03+00:002026-09-30 · 66.9 · n=48 · 2026-09-23T23:57:03+00:00 – 2026-09-30T23:57:03+00:002026-10-01 · 66.3 · n=57 · 2026-09-24T23:57:02+00:00 – 2026-10-01T23:57:02+00:002026-10-02 · 67.7 · n=60 · 2026-09-25T23:57:03+00:00 – 2026-10-02T23:57:03+00:002026-10-03 · 68.3 · n=61 · 2026-09-26T08:42:04+00:00 – 2026-10-03T08:42:04+00:00 68.3 09-0409-1209-1909-2610-03
查看每日读数与样本量
日期体感分n评分窗口(UTC)
2026-10-0368.3612026-09-26T08:42:04+00:00 – 2026-10-03T08:42:04+00:00
2026-10-0267.7602026-09-25T23:57:03+00:00 – 2026-10-02T23:57:03+00:00
2026-10-0166.3572026-09-24T23:57:02+00:00 – 2026-10-01T23:57:02+00:00
2026-09-3066.9482026-09-23T23:57:03+00:00 – 2026-09-30T23:57:03+00:00
2026-09-2963.8412026-09-22T23:57:03+00:00 – 2026-09-29T23:57:03+00:00

Reddit · 68.3 · 61 条评分评论 · 查看该平台评价 →

不同社区,同一模型

各平台怎么看

近 7 天

各平台独立计算,样本量和讨论人群不同。平台分数不取简单平均;评分评论不包含仅讨论额度的评论。

分数范围 0–100。点击平台查看趋势及对应评价。最新评论时间不代表爬虫运行状态。

社区评论

精选近 7 天的不同意见,摘录条数不代表真实好评比例。

14 条精选摘录

额度评价来自社区体验,不能据此推算官方实际配额。

褒贬兼有使用额度

“使用率优于 Opus 5.5”

机器翻译
展开原文

the usage rate is superior to Opus 5.5

正面通用文本

“在花100美元之前,我会更用力地压榨sonnet”

机器翻译
展开原文

i'd push sonnet harder before paying for 100$

正面编程

“其实现在有了 sonnet 5.5,Claude 的 20 美元套餐也相当不错了”

机器翻译
展开原文

Actually now with sonnet 5.5 Claude's $20 plan would be pretty fantastic too

负面通用文本

“和5.0相比,它的说话方式很奇怪,表述也不清楚”

机器翻译
展开原文

the way it talks is so weird and unclear compared to 5.0

负面使用额度

“sonnet 5.5 感觉对大多数人来说贵多了”

机器翻译
展开原文

sonnet 5.5 feels a lot more expensive for people

查看评论上下文
评论者补充 ↗

我通过测试了解到,sonnet 5.5有时会生成opus 5.5子代理。这可能是人们觉得sonnet 5.5贵很多的主要原因之一。

机器翻译
展开原文

I learned through my testing that sonnet 5.5 sometimes spawns opus 5.5 subagents. Might be one of the main reasons why sonnet 5.5 feels a lot more expensive for people.

原帖 ↗

而且,这不是关于API价格的问题,而是订阅的每周使用百分比。

机器翻译
展开原文

And, this is not about the API price, but the percentage weekly usage of the subscription.

正面编程

“提高了首次通过实现质量”

机器翻译
展开原文

improved first-pass implementation quality

查看评论上下文
评论者补充 ↗

我这周实际上在它前面加了一个迷你路由器,更难的切片会被分派给sonnet 5.5,到目前为止相当有效,它提高了首次实现的代码质量。

机器翻译
展开原文

I actually added a mini router in front of it this week, and the harder slices get dispatched to sonnet 5.5 instead, pretty effective so far, it improved first-pass implementation quality.

负面推理

“我不会信任 sonnet 给我任何架构/设计建议。”

机器翻译
展开原文

I wouldn't trust sonnet to do give me any architecture/design advices.

正面通用文本

“通常要么是 sonnet 5.5 高级”

机器翻译
展开原文

often either sonnet 5.5 high

查看评论上下文
评论者补充 ↗

真的取决于任务,但它通常要么是 sonnet 5.5 高级要么是 opus 5.5 中等。

机器翻译
展开原文

It really depends on the task, but it's often either sonnet 5.5 high or opus 5.5 med.

负面安全与拒答

“误报防护栏阻止。”

机器翻译
展开原文

false positive guardrail blocks

负面安全与拒答

“我让它写《奇异博士》里的 Gemini,它不肯。”

机器翻译
展开原文

I asked it to write gemini on doctor strange. It wouldnt.

查看评论上下文
回复的评论 ↗

我一次都没遇到过安全机制拒绝。不知道你们在搞什么

机器翻译
展开原文

I've never once hit a safeguard refusal. Dunno what you guys are doing

正面安全与拒答

“我一次都没遇到过安全机制拒绝”

机器翻译
展开原文

I've never once hit a safeguard refusal

正面安全与拒答

“它可能很惊人”

机器翻译
展开原文

it can be amazing

中性推理

“楼主说的情况在 Fable 5.1、Opus 5.5、Sonnet 5.5 上也会发生。”

机器翻译
展开原文

What the OP stated happens with Fable 5.1, Opus 5.5, Sonnet 5.5 too.

查看评论上下文
原帖 ↗

如果 Astra 那么厉害,为什么它的代码会引入这么多 bug? 给 Astra 在 Ultra 上一个复杂任务,然后之后输入提示词"review"——你会得到大约 5 个问题。

机器翻译
展开原文

If Astra is that great, how come its code introduces so many bugs? Give Astra a complicated task on Ultra, and then after give the prompt "review" - you will get about 5 problems.

中性速度与延迟

“Sonnet 5.5...:382,000($463)(94.6%)”

机器翻译
展开原文

Sonnet 5.5...: 382,000 ($463) (94.6%)

查看评论上下文
评论者补充 ↗

Tokens | 服务/运行相同代理任务的成本 | 多个基准测试中的性能

机器翻译
展开原文

Tokens | cost to serve/run the same agentic task | performance across multiple benchmarks

查看长期变化与分析

此版本尚未纳入发布后长期追踪;上方为近7天口碑。

你今天的 AI 手感如何?