2026 年 6 月,Anthropic 连续发布两个带「5」的模型,容易让人以为「全线升到第五代」——其实并非如此:
- 6 月 9 日 · Claude Fable 5(
claude-fable-5):新代际旗舰,官方称「第五代智能」,面向数小时乃至数天的长时自主 Agent;API $10 / $50。6 月 12 日曾短暂停服,7 月 1 日全球恢复。 - 6 月 30 日 · Claude Sonnet 5(
claude-sonnet-5):Sonnet 产品线升到第五代,替换 Sonnet 4.6,成为 Free / Pro / Claude Code 默认模型;API 标准价 $3 / $15(促销 $2 / $10 至 8 月底)。 - 仍在售的 Opus 4.8:上一代旗舰档($5 / $25),没有被 Sonnet 5 取代;与 Fable 5 形成「旧旗舰 vs 新旗舰」并存。
- Claude Mythos 5:与 Fable 5 同架构,仅 Project Glasswing 受信伙伴可用,公众请用 Fable 5。
一句话:Fable 5 是新的天花板,Sonnet 5 是新的默认档——二者都叫 5,但定位完全不同。下文先画清 2026 全系地图,再展开 Sonnet 5 相对 4.6 的迁移细节。
官方参考:Fable 5 发布公告、Sonnet 5 发布公告、Models overview。Fable 5 深度拆解见本站 Fable 5 vs Opus 4.8 文。
一、2026 Claude 产品线:Fable 5 与 Sonnet 5 不是一回事
Anthropic 当前的主力四代档(官方 Models overview,2026 年 7 月):
| 档位 | 模型 | API ID | 定位 | 标价 in/out |
|---|---|---|---|---|
| 新旗舰 | Claude Fable 5 | claude-fable-5 |
公开发布最强;长时、异步、跨天 Agent | $10 / $50 |
| 上一代旗舰 | Claude Opus 4.8 | claude-opus-4-8 |
复杂 Agent 编码与企业工作流 | $5 / $25 |
| 默认甜区 | Claude Sonnet 5 | claude-sonnet-5 |
速度+智能平衡;Free/Pro 默认 | $3 / $15† |
| 上一代甜区 | Claude Sonnet 4.6 | claude-sonnet-4-6 |
遗留;Priority Tier 用户可暂留 | $3 / $15 |
| 轻量 | Claude Haiku 4.5 | claude-haiku-4-5 |
最快、最便宜;近前沿智能 | $1 / $5 |
† Sonnet 5 促销价 $2 / $10 至 2026.08.31。
「都出到 Sonnet 5 了?」——准确说法是:Sonnet 这条线到了第五代(3.5 → 3.7 → 4.x → 5),同时 Anthropic 又开了新的旗舰产品线 Fable(也带 5,但是 Mythos 级架构的公众版)。并没有「Opus 5」或「全线统一叫 5」;Opus 仍停在 4.8,顶端由 Fable 5 接棒。
二、Sonnet 5 速览:相对 4.6 改了什么
Anthropic 把 Sonnet 5 定位为速度与智能的最佳组合,直接替换 Sonnet 4.6 成为 Free / Pro / Claude Code 默认模型。相对上一代,变化集中在三块:
- 能力:编码与 Agent 任务大幅跃升,官方称在部分评测上可匹配 Opus 4.8 的 medium/high effort;
- 价格:标准 API 标价与 4.6 相同($3/$15),但促销期 $2/$10 至 8 月底;新 tokenizer 让同等文本 token 数 +30% 左右;
- API 行为:自适应思考默认开、采样参数与
budget_tokens硬拒——详见后文迁移章节。
API 模型 ID:claude-sonnet-5。若你只关心「升不升」,先看下面两张对比表。
三、历代价格对比:标价 vs 真实成本
2.1 API 标价一览(每百万 token,USD)
下表汇总 2026 年 7 月开发者最常对照的 Claude 型号——务必把 Fable 5 与 Sonnet 5 分开看:
| 模型 | API ID | Input | 缓存 Input | Output | 状态 / 备注 |
|---|---|---|---|---|---|
| Claude Fable 5 | claude-fable-5 |
$10 | $1 | $50 | 新旗舰;7/1 全球恢复;长时 Agent |
| Claude Opus 4.8 | claude-opus-4-8 |
$5 | $0.50 | $25 | 上一代旗舰;仍在售 |
| Claude Sonnet 5(促销) | claude-sonnet-5 |
$2 | — | $10 | 至 2026.08.31;新 tokenizer |
| Claude Sonnet 5(标准) | claude-sonnet-5 |
$3 | — | $15 | 2026.09.01 起;标价与 4.6 相同 |
| Claude Sonnet 4.6 | claude-sonnet-4-6 |
$3 | $0.30 | $15 | 上一代 Sonnet 默认;thinking 默认关 |
| Claude Haiku 4.5 | claude-haiku-4-5 |
$1 | $0.10 | $5 | 轻量档;非 Agent 长任务首选 |
订阅侧(Claude / Claude Code):Sonnet 5 成为 Free、Pro 默认;Fable 5 面向 Pro / Max / Team / Enterprise(按量或额度,曾限时含在订阅内)。Max 用户可在 Sonnet 5 / Opus 4.8 / Fable 5 间切换——默认免费升的是 Sonnet,不是 Fable。
2.2 tokenizer 后的等效账单
标价相同 ≠ 花一样多。Sonnet 5 使用与 Opus 4.7 同源的新 tokenizer,官方称相同文本映射为约 1.0–1.35× token(常见按 +30% 估算)。因此:
| 对比项 | Sonnet 4.6 | Sonnet 5(标准价) | Sonnet 5(促销价) | Opus 4.8 | Fable 5 |
|---|---|---|---|---|---|
| 百万 token 标价(in/out) | $3 / $15 | $3 / $15 | $2 / $10 | $5 / $25 | $10 / $50 |
| 相对 Sonnet 4.6 标价倍率 | 1.0× | 1.0× | 0.67× / 0.67× | 1.67× / 1.67× | 3.33× / 3.33× |
| 相同英文代码 10 万词等价 token | 基准 1.0× | 约 1.3× | 约 1.3× | 新 tokenizer | 新 tokenizer |
| 等效每「4.6 词袋」成本倍率 | 1.0× | 约 1.3× | 约 0.87× | 约 2.2×(标价×tokenizer) | 约 4.3×(标价×tokenizer) |
| 相对 Opus 的标价倍率 | 60% / 60% | 60% / 60% | 40% / 40% | 100% / 100% | 200% / 200% |
| 默认 thinking | 关 | 开(占 output 预算) | 同左 | adaptive | 始终开 |
结论很直白:9 月后若不改调用习惯,Sonnet 5 比 4.6 贵约三成;促销窗口内切换,官方意图是「能力大涨、账单大致中性」。自适应思考默认开启会再叠加 output token——简单任务请显式 thinking: disabled。
2.3 三个典型场景算账(示意)
假设单次请求:20k input + 4k output(中等代码审查,无额外 thinking 块)。按 1.3× tokenizer 将 input 折算为 26k token:
| 模型 / 价位 | Input 费用 | Output 费用 | 合计 | 相对 Sonnet 4.6 |
|---|---|---|---|---|
| Sonnet 4.6(20k in) | $0.060 | $0.060 | $0.120 | 基准 |
| Sonnet 5 促销(26k in) | $0.052 | $0.040 | $0.092 | 约 −23% |
| Sonnet 5 标准(26k in) | $0.078 | $0.060 | $0.138 | 约 +15% |
| Opus 4.8(26k in,新 tokenizer) | $0.130 | $0.100 | $0.230 | 约 +92% |
| Fable 5(26k in,新 tokenizer) | $0.260 | $0.200 | $0.460 | 约 +283% |
若开启 adaptive thinking 再产出 2k thinking token,Sonnet 5 标准价该次约 $0.168,仍远低于 Fable 5 的 $0.520 量级——默认用 Sonnet 5,跨天硬任务再切 Fable 5,比「事事 Opus」更符合 2026 年的分层策略。
四、功能与 API 差异对照表
| 维度 | Fable 5 | Opus 4.8 | Sonnet 4.6 | Sonnet 5 |
|---|---|---|---|---|
| 产品线 / 代际 | 新旗舰(5 代智能) | 上一代 Opus 旗舰 | 上一代 Sonnet | Sonnet 第五代 |
| 上下文 | 1M | 1M | 1M | 1M |
| 最大输出 | 128k | 128k | 128k | 128k |
| Adaptive thinking | 始终开启 | 支持 | 可选,默认关 | 默认开启 |
budget_tokens |
不适用‡ | 400 拒收 | 废弃(仍可用) | 400 拒收 |
| 非默认 temperature 等 | 不适用‡ | 400 拒收 | 支持 | 400 拒收 |
| Priority Tier | — | 支持 | 支持 | 不支持 |
| 长时异步 Agent | 核心场景 | 强 | 中等 | 强(接近 Opus) |
| Claude Code 默认 | 否(手动 /model fable) |
否 | 曾是 | 是(Free/Pro) |
‡ Fable 5 / Mythos 5 使用与 Opus/Sonnet 不同的 API 行为子集,详见 Introducing Fable 5 and Mythos 5。
五、能力对比:Fable 5 · Sonnet 4.6/5 · Opus 4.8
三档模型的能力梯度(综合 Anthropic 系统卡与站内 Fable 5 实测文):
| 评测 / 场景 | Sonnet 4.6 | Sonnet 5 | Opus 4.8 | Fable 5 | 解读 |
|---|---|---|---|---|---|
| SWE-Bench Pro | 更低 | 显著提升 | 约 69% | 约 80% | 仓库级硬任务:Fable > Opus > Sonnet 5 |
| SWE-bench / Terminal-Bench | 基线 | 显著提升 | 略高或持平 | 领先 | 日常改 bug:Sonnet 5 往往够用 |
| BrowseComp(Agent 检索) | 明显低于 Opus | medium effort 性价比最佳 | 高 effort 上限高 | 长链路最优 | 多步搜索:5 可替代多数 4.6+Opus |
| OSWorld-Verified | 约 78.5%* | 严格优于 4.6 | 更高 | 更高 | GUI / 电脑操作 Agent |
| 长时异步(数小时+) | 易中途停 | 明显改善 | 强 | 核心设计目标 | 跨天 PR:Fable 5 主场 |
| 网络安全 exploit | 低 | 仍低 | 更高 | 部分场景回退 Opus | 红队选 Opus / Mythos 5 |
* OSWorld-Verified 的 Sonnet 4.6 分数经 Anthropic 修订评测方法后更新为 78.5%,与首发博文不同。
选型一句话
- Sonnet 5(默认):Free/Pro 已自动升级;日常编码、中等 Agent、促销期 API 最划算;
- Opus 4.8:单次会话复杂推理、Dynamic Workflows、不愿付 Fable 2× 价时的旗舰备选;
- Fable 5:跨天仓库任务、SWE-Bench Pro 级硬骨头、需要模型「过夜自验」时手动切换;
- 暂留 Sonnet 4.6:依赖 Priority Tier,或 SDK 尚未去掉 temperature / budget_tokens。
六、能力跃升详解:Sonnet 5 相对 4.6 改了什么
根据 Anthropic 系统卡与 Transparency Hub,Sonnet 5 相对 Sonnet 4.6 的最大增益在编码与 Agent 任务,而非单纯知识问答:
- SWE-bench / Terminal-Bench:仓库级 issue 修复、shell 流水线操作明显提升;
- CursorBench / FrontierCode / ProgramBench:IDE 内多轮编辑、跨文件一致性更好;
- BrowseComp 等 Agent 检索任务:能完成多步搜索、抓取、综合——旧版 Sonnet 常中途放弃或只完成局部。
早期内测案例里,Sonnet 5 能自主跑完需要数十次工具调用的工作流(例如:读 spec → 改代码 → 跑测试 → 根据失败日志再改)。这正是 Claude Code、Cursor Agent、自建 LangGraph 流水线最需要的「耐力」。
和 Fable 5、Opus 4.8 怎么比?
Sonnet 5 的定位是把上一代「只有 Opus 才跑得动的 Agent」下放到默认档——官方称部分任务可对齐 Opus 4.8 的 medium/high effort,但 Fable 5 仍是公开发布的最强模型(SWE-Bench Pro 约 80% vs Opus 69%)。推荐分层:Sonnet 5 跑 80% 日常 → Opus 4.8 跑复杂单会话 → Fable 5 跑跨天硬任务。详见 Fable 5 vs Opus 4.8 与 Claude Code 降本复盘。
七、Sonnet 5 三项 API 行为变更(会直接导致 400)
Sonnet 5 号称 Sonnet 4.6 的「drop-in 升级」,但有三处不改就会炸。官方迁移指南把它们列为必查项。
1. 自适应思考(Adaptive thinking)默认开启
在 Sonnet 4.6 上,请求里不写 thinking 字段 = 不思考。在 Sonnet 5 上,同样请求 = 开启 adaptive thinking。
影响:
- 响应会包含
thinking内容块,占用max_tokens预算; - 延迟与输出 token 数都会上升——复杂任务质量更好,简单任务可能「过度思考」;
- 若你按 Sonnet 4.6 的「无思考」场景设置了偏紧的
max_tokens,升级后可能被截断。
若要恢复旧行为(最低延迟、最少 thinking token):
thinking = {"type": "disabled"}
若要显式控制推理深度,推荐:
thinking = {"type": "adaptive"}
# 配合 output_config 或 effort 参数(见 Adaptive thinking 文档)
2. 采样参数(temperature / top_p / top_k)被拒收
把 temperature、top_p 或 top_k 设为非默认值会返回 HTTP 400。这与 Opus 4.7+ 的约束一致,但首次落到 Sonnet 档。
迁移动作:
- 从请求体中删除这些字段,或仅保留默认值;
- 用系统提示控制风格(更简洁、更保守、更创造性),而非调采样;
- 检查 SDK 封装与 LangChain/LlamaIndex 模板是否隐式传入
temperature=0.7之类默认值。
3. 手动 extended thinking(budget_tokens)移除
以下写法在 Sonnet 5 上直接 400(与 Opus 4.7/4.8 相同):
# ❌ 不再支持
thinking = {"type": "enabled", "budget_tokens": 32000}
替换为:
# ✅ 推荐
thinking = {"type": "adaptive"}
用 effort 参数(low / medium / high 等)替代手动 token 预算,让模型按任务复杂度动态分配思考量。详见 Adaptive thinking 文档。
八、新 tokenizer:看不见的账单陷阱
Sonnet 5 采用与 Opus 4.7 同源的新 tokenizer。相同文本在 Sonnet 5 上会比 Sonnet 4.6 多出约 30% token。这不是 API 结构变更——请求/响应/流式事件形状不变——但会深刻影响:
- 账单:单价不变(标准价 $3/$15),同等请求可能更贵;
- 上下文容量:窗口仍是 1M token,但每 token 承载的平均文本更少;
- max_tokens 预算:为 4.6 调好的输出上限,在 5 上可能不够;
- Prompt Caching 命中计量:缓存块按 token 计,基数变大。
迁移前请用官方 Token counting 对核心 prompt(系统提示 + 工具定义 + 典型用户消息)重新计数,不要复用 4.6 时代的估算表。
促销价能抵消吗?
2026 年 8 月 31 日前,Sonnet 5 促销价为 $2 / $10 每百万 input/output token——低于 Sonnet 4.6 标准价。若你的用量以输出与 thinking 为主,促销期仍可能划算;但 9 月后回到 $3/$15,tokenizer 膨胀会完全暴露。建议现在就用日志把「每任务 token」按模型分开统计。
九、Sonnet 5 定价细则与 Priority Tier
第二节已对比历代标价与等效成本,此处补充费率结构与限制:
| 阶段 | Input | Output | 备注 |
|---|---|---|---|
| 促销期(至 2026.08.31) | $2 / M tokens | $10 / M tokens | 新客与迁移窗口,适合压测与灰度 |
| 标准价(2026.09.01 起) | $3 / M tokens | $15 / M tokens | 与 Sonnet 4.6 标价相同 |
另需注意:Priority Tier 在 Sonnet 5 上不可用。若你依赖优先队列做低延迟生产流量,需留在 Sonnet 4.6、改 Opus 档,或接受标准队列。Batch API 与 Prompt Caching 费率结构不变,但 token 基数变大后绝对金额仍会上升。
十、网络安全护栏与 stop_reason: refusal
Sonnet 5 是首个在 Sonnet 档默认启用实时网络安全护栏的模型。涉及禁止或高风险网络安全主题的请求,可能收到成功 HTTP 200,但 stop_reason 为 "refusal"——不是 4xx 错误。
对开发者意味着:
- 安全扫描、渗透测试辅助、漏洞利用类 prompt 需要单独做拒绝检测,不能仅靠 catch HTTP 异常;
- 日志与监控应记录
stop_reason分布,避免把 refusal 误记为「成功空响应」; - 企业内部工具链若在 CI 里跑「自动安全审计 Agent」,升级后需回归测试边界案例。
十一、哪里能用:API、Claude Code 与云厂商
发布当日可用范围(以官方为准):
- Claude API:全量客户;
- Claude / Claude Code:Free、Pro 默认模型;Max、Team、Enterprise 可选;
- AWS:Claude in Amazon Bedrock、Claude Platform on AWS(注意:legacy
InvokeModel/Converse路径无 Sonnet 5); - Google Cloud:Vertex AI;
- Microsoft Foundry:预览可用。
支持 ZDR(Zero Data Retention)协议的组织可继续使用。Claude Code 用户会自动感受到默认模型变强——长仓库任务完成率上升,但也请同步调整 /model 与 effort 习惯,避免一夜之间 token 翻倍。
十二、Sonnet 5 迁移清单(可直接打勾)
从 claude-sonnet-4-6 切到 claude-sonnet-5 时,建议按顺序执行:
- 改模型 ID:
model = "claude-sonnet-5" - 删除采样参数:检查 temperature / top_p / top_k
- 替换 thinking 配置:
budget_tokens→adaptive;不需要思考时显式disabled - 重算 token:对主 prompt 跑 token counting,更新上下文与缓存策略
- 调高 max_tokens:为 thinking 块预留 headroom(尤其未 disabled 时)
- 处理 refusal:业务代码检查
stop_reason == "refusal" - 验证 Priority Tier:若依赖则勿盲目升级
- 预发压测:对比延迟、成本、任务完成率一周后再全量
Assistant message prefilling 在 Sonnet 4.6 已不支持,Sonnet 5 维持不变(仍 400)。请继续用 structured outputs、output_config.format 或系统提示约束格式。
十三、Claude Code 与 Cloud Mac 实战建议
Sonnet 5 与 Claude Code 是「天作之合」:更强的终端与多文件能力,正好匹配 Claude Code 的 Agent 范式。但若执行环境拉胯,模型再强也会反复重跑,token 账单照样爆炸。
结合 Vuncloud 机房实践,我们建议:
- 默认 Sonnet 5 + 显式 Fable/Opus 切换:日常
/model sonnet;跨天硬任务/model fable;单会话架构评审/model opus; - 长任务用 tmux:在 Cloud Mac 或办公室 Mac mini 上跑 Claude Code,断 SSH 不杀会话——见 Mac 算力节点一文;
- effort 分档:改 typo 用 low;跨模块 refactor 用 medium/high,别对所有请求开满;
- 监控 thinking token:升级后第一周对比
usage日志,确认不是「变聪明了但贵三倍」; - iOS / macOS 构建链:Sonnet 5 跑规划与改代码,
xcodebuild仍在 Mac 上执行——Windows 主开发机可继续 Cloud Mac 分体式工作流。
模型升级 ≠ 执行环境升级
Anthropic 提高了 Agent 的「脑力」,但 codesign、Simulator、CocoaPods 缓存仍绑定 macOS 物理机。Sonnet 5 让同样预算下能跑更长的 Agent 链,稳定 Mac 节点才是把智力换成交付速度的前提。
FAQ
Fable 5 和 Sonnet 5 有什么区别?
Fable 5 是新旗舰($10/$50),Sonnet 5 是 Sonnet 线第五代默认档($3/$15)。Free/Pro 默认升的是 Sonnet 5,不是 Fable 5。
Sonnet 5 比 Sonnet 4.6 贵多少?
标价相同;标准价下因 tokenizer 约贵 30%。促销期 $2/$10 大致与 4.6 持平。见第二节等效成本表。
API 模型 ID 是什么?
claude-sonnet-5,替换 claude-sonnet-4-6 后务必完成上文迁移清单。
为什么升级后账单变高?
新 tokenizer(+~30% token)+ 默认 adaptive thinking。促销期单价低可部分对冲,9 月后需靠 effort 与 disabled 精细控制。
还能设 temperature 吗?
非默认值会 400。用系统提示代替。
如何关闭思考?
thinking: {"type": "disabled"}。省略字段在 Sonnet 5 上不等于关闭。
Claude Code 默认模型变了吗?
是,Free/Pro 默认 Sonnet 5。Max 等档也可选用。
何时用 Opus 4.8 或 Fable 5?
Opus:复杂单会话、企业工作流。Fable:跨天仓库级任务、最高编码基准。日常留在 Sonnet 5。
结语
2026 年 6 月的 Claude 更新是双线叙事:Fable 5 打开新旗舰天花板,Sonnet 5 把默认档推到接近旧 Opus 的水平——并不是「全线一个叫 5 的模型」。Opus 4.8 仍在,三者并存。
行动建议:默认跟着 Sonnet 5 走(已自动升级),API 用户在促销窗内完成迁移清单;硬任务再手动切 Fable 5;需要 Priority Tier 或旧 SDK 参数则暂留 Sonnet 4.6。无论哪档模型,长时 Agent 都建议配不掉线的 Cloud Mac 跑完构建闭环。
Sonnet 5 跑 Agent,Mac 节点跑 xcodebuild
Vuncloud Cloud Mac(M4 · SSH · tmux)为 Claude Code 与 iOS CI 提供稳定执行面。模型换 Sonnet 5 的同时,别让构建链断在笔记本睡眠上。
相关阅读
- 从 Opus 4.8 到 Fable 5:Anthropic 这次升级改在了哪里?
- 实战复盘:Claude Code 月账单从 $800 砍到 $150
- Claude Opus 4.8 与 AI 编码 Agent
- 卷模型已过,Mac 算力节点为何难求
- 2026 LLM 定价与性能选型指南
最后更新:2026 年 7 月 2 日。API 行为与定价以 Claude Platform 文档 与 Anthropic 公告为准。