← 全部模型 Claude · 近 7 天Claude 3.5 Sonnet0–100 分,越高代表社区使用体验越正面,不代表能力测试成绩。更新于 2026-09-05 14:21 UTC · 2026-08-29 – 2026-09-05 UTC社区口碑分评价积累中2 条评论 · 近 7 天 社区评论精选近 7 天的不同意见,摘录条数不代表真实好评比例。全部摘录正面负面2 条精选摘录 负面安全与拒答2026-09-04 “你真的不应该再期望前沿模型(如 GPT-4o、Claude 3.5 Sonnet 等)能成为本地化、垂直领域实现的可靠架构设计了。前沿模型正在被调优以适应安全性、简洁性和一般用户意图的对齐...” Redditen机器翻译 展开原文You really shouldn't expect frontier models (GPT-4o, Claude 3.5 Sonnet, etc.) to be reliable architects for local, niche implementations anymore. Frontier models are being tuned for safety, brevity, and alignment with general user intent...正面编程2026-08-31 “Claude 3.5 Sonnet在程序员圈子里口碑爆棚,不光是因为HumanEval等基准测试分数高,更因为系统级架构上对“工具调用”和“长上下文代码库理解”做了专门优化。比如Artifacts功能,模型不仅能写代码,还能直接在对话里渲染出UI界面和可运行应用。” 知乎zh 近 7 天暂时没有符合此筛选条件的精选评论。查看更多摘录
负面安全与拒答2026-09-04 “你真的不应该再期望前沿模型(如 GPT-4o、Claude 3.5 Sonnet 等)能成为本地化、垂直领域实现的可靠架构设计了。前沿模型正在被调优以适应安全性、简洁性和一般用户意图的对齐...” Redditen机器翻译 展开原文You really shouldn't expect frontier models (GPT-4o, Claude 3.5 Sonnet, etc.) to be reliable architects for local, niche implementations anymore. Frontier models are being tuned for safety, brevity, and alignment with general user intent...
正面编程2026-08-31 “Claude 3.5 Sonnet在程序员圈子里口碑爆棚,不光是因为HumanEval等基准测试分数高,更因为系统级架构上对“工具调用”和“长上下文代码库理解”做了专门优化。比如Artifacts功能,模型不仅能写代码,还能直接在对话里渲染出UI界面和可运行应用。” 知乎zh
社区评论
精选近 7 天的不同意见,摘录条数不代表真实好评比例。
2 条精选摘录
展开原文
You really shouldn't expect frontier models (GPT-4o, Claude 3.5 Sonnet, etc.) to be reliable architects for local, niche implementations anymore. Frontier models are being tuned for safety, brevity, and alignment with general user intent...
近 7 天暂时没有符合此筛选条件的精选评论。