模型

Claude 3.7 Sonnet:混合推理模型的发布与退役复盘

Anthropic 于 2025 年发布、现已从自营 API 退役的混合推理模型,适合作为模型迁移与评测样本。

Claude 3.7 Sonnet foundation-model reasoning coding Anthropic 于 2025 年发布、现已从自营 API 退役的混合推理模型,适合作为模型迁移与评测样本。

Frontmatter

结构化元信息

实体类型
模型
主分类
模型
产品状态
已停更
开放状态
闭源
信息截至
2026-08-07

1. 项目定位

Claude 3.7 Sonnet 是 Anthropic 于 2025 年 2 月 24 日发布的闭源模型。官方把它称为首个混合推理模型:同一模型既可快速回答,也可进入延长思考模式。[S1] 这篇调研记录其产品意义与退役事实,不把它写成当前可新接入的推荐模型。

2. 能力与交互方式

发布时,API 用户可控制思考预算,在速度、成本与回答质量之间做取舍;官方重点强调编码、前端开发、数学、物理和指令遵循等任务。[S1] 其工作流仍是云端模型调用或 Claude 产品交互,并没有公开可下载权重。延长思考会计入输出消耗,不能当作免费的后台计算。

3. 发布时的分发范围

Anthropic 当时宣布模型进入 Claude 各类计划、Claude Developer Platform、Amazon Bedrock 和 Google Cloud Vertex AI,免费 Claude 层不提供延长思考。[S1] 这些是发布时状态,不代表 2026 年仍可在所有渠道创建新部署;伙伴平台的生命周期也可能与 Anthropic 自营平台不同。

4. 当前生命周期

Anthropic 的现行弃用文档把 claude-3-7-sonnet-20250219 标记为 Retired:2025 年 10 月 28 日进入弃用流程,并于 2026 年 2 月 19 日从 Anthropic 运营的平台退役,文档给出的替代型号为 claude-sonnet-4-6。[S2] 已退役端点的请求会失败。

5. 适用的历史评估价值

该模型仍适合做离线复盘:研究混合推理交互如何影响任务拆分,比较思考预算对延迟与成本的作用,或验证旧系统迁移前后的行为差异。但新项目不应围绕已退役 API 建设;即使某个伙伴渠道暂时还能调用,也要单独确认其退役时间与迁移承诺。

6. 主要风险

最大风险不是模型能力,而是生命周期。继续保留旧模型 ID 会造成请求失败、应急切换和回归遗漏。第二类风险来自思考预算:更长计算不保证事实正确,仍需工具结果、引用与业务规则验证。闭源模型无法由使用方自行维持服务,迁移计划必须早于官方截止日。

7. 迁移路径

先从调用日志列出全部模型 ID、区域和平台,再建立固定评测集,覆盖正确性、工具调用、结构化输出、延迟、成本与安全拒答。把推荐替代模型接入影子流量,比较失败样本后逐步切换。对 Bedrock 或 Vertex AI 部署,应查对应云平台日程,不能直接套用 Anthropic 自营日期。[S2]

8. 信息缺口

发布文章提供官方能力描述与当时价格,但这些是厂商口径,不等于所有业务上的稳定优势。[S1] 本次两条来源也不足以证明训练数据、完整架构或各伙伴平台的当前可用区。涉及审计和合规时,应补充合同、区域数据处理条款与实际账户控制台证据。

9. 验收建议

若任务是旧系统下线,成功标准应是生产日志不再出现 3.7 模型 ID,替代模型在关键用例上的结果达到预设阈值,限流和成本告警正常,回滚路径经过演练。若任务是历史研究,应保存提示词、参数、平台、日期和原始输出,避免把不同端点结果混成同一基线。

10. 来源与更新时间

调研截至 2026 年 8 月 7 日。模型生命周期会继续变化,迁移时以对应平台最新文档为准。

  • [S1] Anthropic|Claude 3.7 Sonnet and Claude Code|链接
  • [S2] Claude Platform Docs|Model deprecations|链接