Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,为 5.5 家族继 Opus 5.5 之后的第二款模型,官方定位为更快、更低成本的补充型号,已在 Claude 平台与三大云上线。
Claude Sonnet 5.5 发布:5.5 家族第二款模型
这次发布的是什么
Anthropic 于 2026 年 9 月 28 日发布 Claude Sonnet 5.5,这是 Claude 5.5 家族的第二款模型。上一款 Claude Opus 5.5 发布于 2026 年 9 月 22 日,官方对 Sonnet 5.5 的定位是「Opus 5.5 之外更快、成本更低的补充型号」;面向高并发与成本敏感场景的 Claude Haiku 5.5 官方称将在未来几周加入同一家族。
开发者在 Claude Platform 通过模型名 claude-sonnet-5-5 接入。官方对这一代的描述集中在边界清晰的日常任务上:修 bug,产出文档、幻灯片与表格,以及在长周期任务与图像理解上的表现。编码被官方单独点名为提升最明显的一项。
可用性与限制
- 上线范围:官方称已在所有平台上线,包含 Amazon Web Services、Google Cloud 与 Microsoft Azure 三家云。
- 调用入口:Claude Platform API、官方应用与 Claude Code 均可使用,API 模型名为 claude-sonnet-5-5。
- 默认思考档位:官方应用与 Claude Code 中默认档位为 Medium,Claude Platform 默认为 High,两侧不一致,迁移时要留意。
- 安全回退:官方说明更高风险的网络安全任务会回退到 Sonnet 5 处理,生物学相关保障沿用 Sonnet 5 同一套。
- 数据保留:与 Opus 5.5、Sonnet 5 一样提供零数据保留选项,对数据不出境有要求的团队值得单独确认这一项。
- 迁移前置条件:此前使用 Sonnet 且关闭了 thinking 的,需先切换到新的 between_tools 设置再迁移,否则行为会变。
- 计费方式:按每百万 token 计价,具体金额以官网为准,本稿不抄录数字。
主要功能
- 修复代码缺陷并定位问题根因
- 生成文档、幻灯片与表格成品
- 快速理解陌生代码库的结构
- 批量合并工具调用以减少步骤
- 处理长周期知识工作与图表识别
- 在界面操作与写作协作上保持完成度
技术原理
官方公告没有披露架构与训练细节,能确认的是两条工程侧的改动与一组评测口径。
第一条是 thinking 机制的调整。官方引入了 between_tools 设置,用来替代原来「关闭前置 thinking」的用法;同时扩展了 preserved thinking,使生成的思考过程不能与创建它的账户分离。官方提示:跨账户移动对话(包括在 Claude Code 会话中途切换账户)时会碰到这个变化,具体处理方式以官方 preserved thinking 文档为准。
第二条是推理过程中的工具调用行为。官方称 Sonnet 5.5 在对比运行中比 Sonnet 5 更倾向于把工具调用批量合并,从而减少步骤数、降低单任务开销,并且每任务消耗的 token 更少。这是「为什么更快也更便宜」的官方解释,属于可观察的行为差异,不是架构说明。
评测口径方面,官方列出了代理编码评测 Terminal-Bench 4.0、覆盖多行业真实职业任务的 GDPval-AA,以及计算机使用与图表识别等项,并给出了与 Opus 5.5、Sonnet 5、GPT-6 Sol 的对比结论。这些分数由官方在自己的 harness 下测得,本站未独立复跑,具体数值以官方页面为准。
实际体验
本稿不做跑分,也不写未经执行的实测感受。下面是可以自己复现的验证路径,跑一遍就能判断它是否适合你的负载。
第一步,挑一段你自己的真实任务,优先选同一份仓库里的一条已知 bug,任务描述保持原样不改。第二步,分别在 Claude Code 与 Claude Platform 上用各自的默认档位跑一遍,注意两边默认档位并不相同,这一步很容易被忽略。第三步,记录三件事:完成任务消耗的总步骤数、是否需要人工返工、以及输出是否需要二次排版。第四步,拿同一条任务在 Sonnet 5 上重跑一次做对照,差异通常在这一步才看得清楚。
需要留意的是,官方公布的分数来自官方 harness,与你本地的工具链、权限配置和网络环境都可能不同。把官方数字当参考区间,把自己跑出来的三步结果当结论,这个顺序不容易出错。
项目地址与获取方式
Claude Sonnet 5.5 通过 Anthropic 官方渠道提供:Claude Platform(API 模型名 claude-sonnet-5-5)、官方 Claude 应用、Claude Code,以及 AWS、Google Cloud、Microsoft Azure 上的托管入口。官方另有 Sonnet 5.5 的模型卡与迁移指南,迁移前建议先看迁移指南里关于 between_tools 的那一节。
请通过官方渠道获取与调用,避免经由第三方中转或来路不明的镜像,以免密钥与数据外泄。定价、额度与区域可用性以官网当前页面为准。
适合谁用
- 日常有明确边界的编码与改 bug 任务的开发者,尤其是需要模型先读懂一个陌生仓库的场景。
- 需要产出文档、幻灯片、表格成品的职场用户,官方把这一项列为该型号的主要方向。
- 已经在用 Claude Code,希望在步骤数与成本上比 Sonnet 5 更省一点的团队。
- 对数据保留有要求、需要零数据保留选项的组织,可以先确认该选项在当前套餐下是否可用。
- 不必急着换的情况:当前负载跑在 Opus 5.5 上且结果稳定,或者主要任务是高风险网络安全类工作——后者按官方说明会回退到 Sonnet 5,换型号未必带来变化。
常见问题
Claude Sonnet 5.5 和 Opus 5.5 该怎么选?
官方给的分工是:Opus 5.5 面向需要谨慎判断的复杂工作,Sonnet 5.5 面向边界清晰的日常任务、修 bug 与产出文档表格。判断方法很直接——把你的任务写成一句话,如果说得清边界和验收标准,用 Sonnet 5.5 通常更划算;如果任务本身要靠模型自己判断该往哪走,留在 Opus 5.5。
从 Sonnet 5 迁移需要改代码吗?
视配置而定。如果此前运行时关闭了 thinking,官方要求先切换到新的 between_tools 设置再迁移,否则行为会与预期不符。其余情况下改模型名即可,但建议保留回退开关:官方说明更高风险的网络安全任务会自动回退到 Sonnet 5,也就是说 Sonnet 5 在短期内仍会被调用。
现在的价格是多少?
本稿不抄录价格。官方按每百万 token 计价,输入、输出与缓存读取分别计费,且会随区域与套餐变化。请以官网定价页当前显示为准,尤其是做成本测算时,自己按真实 token 量跑一遍比抄数字可靠。
官方公布的基准分数能直接用来选型吗?
建议当作参考而不是结论。官方分数来自官方 harness,对比项中也包含其他厂商自行公布的数字,harness 与 effort 档位并不统一。选型时用它缩小候选范围,再用自己业务里的真实任务跑一轮,这两步的顺序不要颠倒。
Claude Haiku 5.5 什么时候发布?
官方只说将在未来几周加入 Claude 5.5 家族,未给出具体日期。面向高并发与成本敏感场景的团队可以关注,但在此之前不宜把排期建立在它没有承诺的时间点上。
相关工具与内容
想看 Claude 系列在站内的完整资料,可以看 Claude 与 Claude Code 详情页,以及评测 Claude 评测。同类的对话与编程工具,ChatGPT、Cursor 与 GitHub Copilot 也在站内收录,AI编程 分类下有更多同类。如果你关心的是插件与目录这类生态入口,可以看 Claude 插件目录提交;AI对话 与 AI智能体 两个分类也一并列出供对照。
相关内容
华为 openPangu-2.0 训练与 RL 代码开源
华为于 2026 年 9 月 28 日宣布开源 openPangu-2.0 的预训练、SFT 代码与后训练 RL 代码,训练框架与昇腾原生强化学习框架同步上线 Ascend Tribe 开源社区。
Holo4 开源:能操作桌面与网页的通用智能体模型
H Company 于 2026 年 9 月 28 日发布 Holo4 系列智能体模型,含 27B 稠密与 35B-A3B 混合专家两个尺寸,权重开放下载并提供托管 API,面向桌面、网页与移动端软件操作。
Claude 长文写得最稳,但打不开就是打不开
Claude 在本站五维评测口径下总分 3.5:核心能力 4.40、输出质量 3.90 都不低,但可用性仅 2.00 是本批最低。本文逐项给出打分依据,并说明它的长文档精读到底强在哪、以及长文引用错位的风险该怎么防。