Vuncloud 博客
← 返回机房手记专栏

Claude 最新模型怎么选?Sonnet 5、Fable 5、Opus 4.8 全面对比

Fable 5 · Sonnet 5 · 2026 产品线地图 · 标价与真实成本 · 全系对比 · Sonnet 5 迁移约 17 分钟阅读

开发团队在显示器前协作编写代码,象征 Claude Sonnet 5 面向 Agent 编程与工具链自动化的开发者场景

2026 年 6 月,Anthropic 连续发布两个带「5」的模型,容易让人以为「全线升到第五代」——其实并非如此:

  • 6 月 9 日 · Claude Fable 5claude-fable-5):新代际旗舰,官方称「第五代智能」,面向数小时乃至数天的长时自主 Agent;API $10 / $50。6 月 12 日曾短暂停服,7 月 1 日全球恢复
  • 6 月 30 日 · Claude Sonnet 5claude-sonnet-5):Sonnet 产品线升到第五代,替换 Sonnet 4.6,成为 Free / Pro / Claude Code 默认模型;API 标准价 $3 / $15(促销 $2 / $10 至 8 月底)。
  • 仍在售的 Opus 4.8:上一代旗舰档($5 / $25),没有被 Sonnet 5 取代;与 Fable 5 形成「旧旗舰 vs 新旗舰」并存。
  • Claude Mythos 5:与 Fable 5 同架构,仅 Project Glasswing 受信伙伴可用,公众请用 Fable 5。

一句话:Fable 5 是新的天花板,Sonnet 5 是新的默认档——二者都叫 5,但定位完全不同。下文先画清 2026 全系地图,再展开 Sonnet 5 相对 4.6 的迁移细节。

官方参考:Fable 5 发布公告Sonnet 5 发布公告Models overview。Fable 5 深度拆解见本站 Fable 5 vs Opus 4.8 文

Fable 5
6/9 发布 · 新代际旗舰 · 长时 Agent · $10/$50
Sonnet 5
6/30 发布 · Sonnet 线第五代 · 默认模型 · $3/$15
Opus 4.8
上一代旗舰仍在 · 复杂 Agent 编码 · $5/$25

一、2026 Claude 产品线:Fable 5 与 Sonnet 5 不是一回事

Anthropic 当前的主力四代档(官方 Models overview,2026 年 7 月):

档位 模型 API ID 定位 标价 in/out
新旗舰 Claude Fable 5 claude-fable-5 公开发布最强;长时、异步、跨天 Agent $10 / $50
上一代旗舰 Claude Opus 4.8 claude-opus-4-8 复杂 Agent 编码与企业工作流 $5 / $25
默认甜区 Claude Sonnet 5 claude-sonnet-5 速度+智能平衡;Free/Pro 默认 $3 / $15
上一代甜区 Claude Sonnet 4.6 claude-sonnet-4-6 遗留;Priority Tier 用户可暂留 $3 / $15
轻量 Claude Haiku 4.5 claude-haiku-4-5 最快、最便宜;近前沿智能 $1 / $5

Sonnet 5 促销价 $2 / $10 至 2026.08.31。

「都出到 Sonnet 5 了?」——准确说法是:Sonnet 这条线到了第五代(3.5 → 3.7 → 4.x → 5),同时 Anthropic 又开了新的旗舰产品线 Fable(也带 5,但是 Mythos 级架构的公众版)。并没有「Opus 5」或「全线统一叫 5」;Opus 仍停在 4.8,顶端由 Fable 5 接棒。

二、Sonnet 5 速览:相对 4.6 改了什么

Anthropic 把 Sonnet 5 定位为速度与智能的最佳组合,直接替换 Sonnet 4.6 成为 Free / Pro / Claude Code 默认模型。相对上一代,变化集中在三块:

  • 能力:编码与 Agent 任务大幅跃升,官方称在部分评测上可匹配 Opus 4.8 的 medium/high effort
  • 价格:标准 API 标价与 4.6 相同($3/$15),但促销期 $2/$10 至 8 月底;新 tokenizer 让同等文本 token 数 +30% 左右;
  • API 行为:自适应思考默认开、采样参数与 budget_tokens 硬拒——详见后文迁移章节。

API 模型 ID:claude-sonnet-5。若你只关心「升不升」,先看下面两张对比表。

三、历代价格对比:标价 vs 真实成本

2.1 API 标价一览(每百万 token,USD)

下表汇总 2026 年 7 月开发者最常对照的 Claude 型号——务必把 Fable 5 与 Sonnet 5 分开看

模型 API ID Input 缓存 Input Output 状态 / 备注
Claude Fable 5 claude-fable-5 $10 $1 $50 新旗舰;7/1 全球恢复;长时 Agent
Claude Opus 4.8 claude-opus-4-8 $5 $0.50 $25 上一代旗舰;仍在售
Claude Sonnet 5(促销) claude-sonnet-5 $2 $10 至 2026.08.31;新 tokenizer
Claude Sonnet 5(标准) claude-sonnet-5 $3 $15 2026.09.01 起;标价与 4.6 相同
Claude Sonnet 4.6 claude-sonnet-4-6 $3 $0.30 $15 上一代 Sonnet 默认;thinking 默认关
Claude Haiku 4.5 claude-haiku-4-5 $1 $0.10 $5 轻量档;非 Agent 长任务首选

订阅侧(Claude / Claude Code):Sonnet 5 成为 Free、Pro 默认;Fable 5 面向 Pro / Max / Team / Enterprise(按量或额度,曾限时含在订阅内)。Max 用户可在 Sonnet 5 / Opus 4.8 / Fable 5 间切换——默认免费升的是 Sonnet,不是 Fable

2.2 tokenizer 后的等效账单

标价相同 ≠ 花一样多。Sonnet 5 使用与 Opus 4.7 同源的新 tokenizer,官方称相同文本映射为约 1.0–1.35× token(常见按 +30% 估算)。因此:

对比项 Sonnet 4.6 Sonnet 5(标准价) Sonnet 5(促销价) Opus 4.8 Fable 5
百万 token 标价(in/out) $3 / $15 $3 / $15 $2 / $10 $5 / $25 $10 / $50
相对 Sonnet 4.6 标价倍率 1.0× 1.0× 0.67× / 0.67× 1.67× / 1.67× 3.33× / 3.33×
相同英文代码 10 万词等价 token 基准 1.0× 约 1.3× 约 1.3× 新 tokenizer 新 tokenizer
等效每「4.6 词袋」成本倍率 1.0× 约 1.3× 约 0.87× 约 2.2×(标价×tokenizer) 约 4.3×(标价×tokenizer)
相对 Opus 的标价倍率 60% / 60% 60% / 60% 40% / 40% 100% / 100% 200% / 200%
默认 thinking (占 output 预算) 同左 adaptive 始终开

结论很直白:9 月后若不改调用习惯,Sonnet 5 比 4.6 贵约三成;促销窗口内切换,官方意图是「能力大涨、账单大致中性」。自适应思考默认开启会再叠加 output token——简单任务请显式 thinking: disabled

2.3 三个典型场景算账(示意)

假设单次请求:20k input + 4k output(中等代码审查,无额外 thinking 块)。按 1.3× tokenizer 将 input 折算为 26k token:

模型 / 价位 Input 费用 Output 费用 合计 相对 Sonnet 4.6
Sonnet 4.6(20k in) $0.060 $0.060 $0.120 基准
Sonnet 5 促销(26k in) $0.052 $0.040 $0.092 约 −23%
Sonnet 5 标准(26k in) $0.078 $0.060 $0.138 约 +15%
Opus 4.8(26k in,新 tokenizer) $0.130 $0.100 $0.230 约 +92%
Fable 5(26k in,新 tokenizer) $0.260 $0.200 $0.460 约 +283%

若开启 adaptive thinking 再产出 2k thinking token,Sonnet 5 标准价该次约 $0.168,仍远低于 Fable 5 的 $0.520 量级——默认用 Sonnet 5,跨天硬任务再切 Fable 5,比「事事 Opus」更符合 2026 年的分层策略。

四、功能与 API 差异对照表

维度 Fable 5 Opus 4.8 Sonnet 4.6 Sonnet 5
产品线 / 代际 新旗舰(5 代智能) 上一代 Opus 旗舰 上一代 Sonnet Sonnet 第五代
上下文 1M 1M 1M 1M
最大输出 128k 128k 128k 128k
Adaptive thinking 始终开启 支持 可选,默认关 默认开启
budget_tokens 不适用 400 拒收 废弃(仍可用) 400 拒收
非默认 temperature 等 不适用 400 拒收 支持 400 拒收
Priority Tier 支持 支持 不支持
长时异步 Agent 核心场景 中等 强(接近 Opus)
Claude Code 默认 否(手动 /model fable 曾是 是(Free/Pro)

Fable 5 / Mythos 5 使用与 Opus/Sonnet 不同的 API 行为子集,详见 Introducing Fable 5 and Mythos 5

五、能力对比:Fable 5 · Sonnet 4.6/5 · Opus 4.8

三档模型的能力梯度(综合 Anthropic 系统卡与站内 Fable 5 实测文):

评测 / 场景 Sonnet 4.6 Sonnet 5 Opus 4.8 Fable 5 解读
SWE-Bench Pro 更低 显著提升 约 69% 约 80% 仓库级硬任务:Fable > Opus > Sonnet 5
SWE-bench / Terminal-Bench 基线 显著提升 略高或持平 领先 日常改 bug:Sonnet 5 往往够用
BrowseComp(Agent 检索) 明显低于 Opus medium effort 性价比最佳 高 effort 上限高 长链路最优 多步搜索:5 可替代多数 4.6+Opus
OSWorld-Verified 约 78.5%* 严格优于 4.6 更高 更高 GUI / 电脑操作 Agent
长时异步(数小时+) 易中途停 明显改善 核心设计目标 跨天 PR:Fable 5 主场
网络安全 exploit 仍低 更高 部分场景回退 Opus 红队选 Opus / Mythos 5

* OSWorld-Verified 的 Sonnet 4.6 分数经 Anthropic 修订评测方法后更新为 78.5%,与首发博文不同。

选型一句话

  • Sonnet 5(默认):Free/Pro 已自动升级;日常编码、中等 Agent、促销期 API 最划算;
  • Opus 4.8:单次会话复杂推理、Dynamic Workflows、不愿付 Fable 2× 价时的旗舰备选;
  • Fable 5:跨天仓库任务、SWE-Bench Pro 级硬骨头、需要模型「过夜自验」时手动切换;
  • 暂留 Sonnet 4.6:依赖 Priority Tier,或 SDK 尚未去掉 temperature / budget_tokens。

六、能力跃升详解:Sonnet 5 相对 4.6 改了什么

根据 Anthropic 系统卡与 Transparency Hub,Sonnet 5 相对 Sonnet 4.6 的最大增益在编码与 Agent 任务,而非单纯知识问答:

  • SWE-bench / Terminal-Bench:仓库级 issue 修复、shell 流水线操作明显提升;
  • CursorBench / FrontierCode / ProgramBench:IDE 内多轮编辑、跨文件一致性更好;
  • BrowseComp 等 Agent 检索任务:能完成多步搜索、抓取、综合——旧版 Sonnet 常中途放弃或只完成局部。

早期内测案例里,Sonnet 5 能自主跑完需要数十次工具调用的工作流(例如:读 spec → 改代码 → 跑测试 → 根据失败日志再改)。这正是 Claude Code、Cursor Agent、自建 LangGraph 流水线最需要的「耐力」。

和 Fable 5、Opus 4.8 怎么比?

Sonnet 5 的定位是把上一代「只有 Opus 才跑得动的 Agent」下放到默认档——官方称部分任务可对齐 Opus 4.8 的 medium/high effort,但 Fable 5 仍是公开发布的最强模型(SWE-Bench Pro 约 80% vs Opus 69%)。推荐分层:Sonnet 5 跑 80% 日常Opus 4.8 跑复杂单会话Fable 5 跑跨天硬任务。详见 Fable 5 vs Opus 4.8Claude Code 降本复盘

七、Sonnet 5 三项 API 行为变更(会直接导致 400)

Sonnet 5 号称 Sonnet 4.6 的「drop-in 升级」,但有三处不改就会炸。官方迁移指南把它们列为必查项。

1. 自适应思考(Adaptive thinking)默认开启

在 Sonnet 4.6 上,请求里不写 thinking 字段 = 不思考。在 Sonnet 5 上,同样请求 = 开启 adaptive thinking

影响:

  • 响应会包含 thinking 内容块,占用 max_tokens 预算;
  • 延迟与输出 token 数都会上升——复杂任务质量更好,简单任务可能「过度思考」;
  • 若你按 Sonnet 4.6 的「无思考」场景设置了偏紧的 max_tokens,升级后可能被截断。

若要恢复旧行为(最低延迟、最少 thinking token):

thinking = {"type": "disabled"}

若要显式控制推理深度,推荐:

thinking = {"type": "adaptive"}
# 配合 output_config 或 effort 参数(见 Adaptive thinking 文档)

2. 采样参数(temperature / top_p / top_k)被拒收

temperaturetop_ptop_k 设为非默认值会返回 HTTP 400。这与 Opus 4.7+ 的约束一致,但首次落到 Sonnet 档

迁移动作:

  • 从请求体中删除这些字段,或仅保留默认值;
  • 系统提示控制风格(更简洁、更保守、更创造性),而非调采样;
  • 检查 SDK 封装与 LangChain/LlamaIndex 模板是否隐式传入 temperature=0.7 之类默认值。

3. 手动 extended thinking(budget_tokens)移除

以下写法在 Sonnet 5 上直接 400(与 Opus 4.7/4.8 相同):

# ❌ 不再支持
thinking = {"type": "enabled", "budget_tokens": 32000}

替换为:

# ✅ 推荐
thinking = {"type": "adaptive"}

effort 参数(low / medium / high 等)替代手动 token 预算,让模型按任务复杂度动态分配思考量。详见 Adaptive thinking 文档

开发者在笔记本上调试 API 与 Agent 集成,象征 Claude Sonnet 5 迁移时需检查的请求参数与错误处理
升级 Sonnet 5 后,最先爆雷的往往是 SDK 里残留的 temperature 与 budget_tokens——建议在预发环境跑一遍集成测试。

八、新 tokenizer:看不见的账单陷阱

Sonnet 5 采用与 Opus 4.7 同源的新 tokenizer。相同文本在 Sonnet 5 上会比 Sonnet 4.6 多出约 30% token。这不是 API 结构变更——请求/响应/流式事件形状不变——但会深刻影响:

  • 账单:单价不变(标准价 $3/$15),同等请求可能更贵;
  • 上下文容量:窗口仍是 1M token,但每 token 承载的平均文本更少;
  • max_tokens 预算:为 4.6 调好的输出上限,在 5 上可能不够;
  • Prompt Caching 命中计量:缓存块按 token 计,基数变大。

迁移前请用官方 Token counting 对核心 prompt(系统提示 + 工具定义 + 典型用户消息)重新计数,不要复用 4.6 时代的估算表。

促销价能抵消吗?

2026 年 8 月 31 日前,Sonnet 5 促销价为 $2 / $10 每百万 input/output token——低于 Sonnet 4.6 标准价。若你的用量以输出与 thinking 为主,促销期仍可能划算;但 9 月后回到 $3/$15,tokenizer 膨胀会完全暴露。建议现在就用日志把「每任务 token」按模型分开统计。

九、Sonnet 5 定价细则与 Priority Tier

第二节已对比历代标价与等效成本,此处补充费率结构与限制

阶段 Input Output 备注
促销期(至 2026.08.31) $2 / M tokens $10 / M tokens 新客与迁移窗口,适合压测与灰度
标准价(2026.09.01 起) $3 / M tokens $15 / M tokens 与 Sonnet 4.6 标价相同

另需注意:Priority Tier 在 Sonnet 5 上不可用。若你依赖优先队列做低延迟生产流量,需留在 Sonnet 4.6、改 Opus 档,或接受标准队列。Batch API 与 Prompt Caching 费率结构不变,但 token 基数变大后绝对金额仍会上升。

十、网络安全护栏与 stop_reason: refusal

Sonnet 5 是首个在 Sonnet 档默认启用实时网络安全护栏的模型。涉及禁止或高风险网络安全主题的请求,可能收到成功 HTTP 200,但 stop_reason"refusal"——不是 4xx 错误

对开发者意味着:

  • 安全扫描、渗透测试辅助、漏洞利用类 prompt 需要单独做拒绝检测,不能仅靠 catch HTTP 异常;
  • 日志与监控应记录 stop_reason 分布,避免把 refusal 误记为「成功空响应」;
  • 企业内部工具链若在 CI 里跑「自动安全审计 Agent」,升级后需回归测试边界案例。

十一、哪里能用:API、Claude Code 与云厂商

发布当日可用范围(以官方为准):

  • Claude API:全量客户;
  • Claude / Claude Code:Free、Pro 默认模型;Max、Team、Enterprise 可选;
  • AWS:Claude in Amazon Bedrock、Claude Platform on AWS(注意:legacy InvokeModel / Converse 路径 Sonnet 5);
  • Google Cloud:Vertex AI;
  • Microsoft Foundry:预览可用。

支持 ZDR(Zero Data Retention)协议的组织可继续使用。Claude Code 用户会自动感受到默认模型变强——长仓库任务完成率上升,但也请同步调整 /model 与 effort 习惯,避免一夜之间 token 翻倍。

十二、Sonnet 5 迁移清单(可直接打勾)

claude-sonnet-4-6 切到 claude-sonnet-5 时,建议按顺序执行:

  1. 改模型 IDmodel = "claude-sonnet-5"
  2. 删除采样参数:检查 temperature / top_p / top_k
  3. 替换 thinking 配置budget_tokensadaptive;不需要思考时显式 disabled
  4. 重算 token:对主 prompt 跑 token counting,更新上下文与缓存策略
  5. 调高 max_tokens:为 thinking 块预留 headroom(尤其未 disabled 时)
  6. 处理 refusal:业务代码检查 stop_reason == "refusal"
  7. 验证 Priority Tier:若依赖则勿盲目升级
  8. 预发压测:对比延迟、成本、任务完成率一周后再全量

Assistant message prefilling 在 Sonnet 4.6 已不支持,Sonnet 5 维持不变(仍 400)。请继续用 structured outputs、output_config.format 或系统提示约束格式。

十三、Claude Code 与 Cloud Mac 实战建议

Sonnet 5 与 Claude Code 是「天作之合」:更强的终端与多文件能力,正好匹配 Claude Code 的 Agent 范式。但若执行环境拉胯,模型再强也会反复重跑,token 账单照样爆炸。

结合 Vuncloud 机房实践,我们建议:

  • 默认 Sonnet 5 + 显式 Fable/Opus 切换:日常 /model sonnet;跨天硬任务 /model fable;单会话架构评审 /model opus
  • 长任务用 tmux:在 Cloud Mac 或办公室 Mac mini 上跑 Claude Code,断 SSH 不杀会话——见 Mac 算力节点一文;
  • effort 分档:改 typo 用 low;跨模块 refactor 用 medium/high,别对所有请求开满;
  • 监控 thinking token:升级后第一周对比 usage 日志,确认不是「变聪明了但贵三倍」;
  • iOS / macOS 构建链:Sonnet 5 跑规划与改代码,xcodebuild 仍在 Mac 上执行——Windows 主开发机可继续 Cloud Mac 分体式工作流

模型升级 ≠ 执行环境升级

Anthropic 提高了 Agent 的「脑力」,但 codesign、Simulator、CocoaPods 缓存仍绑定 macOS 物理机。Sonnet 5 让同样预算下能跑更长的 Agent 链,稳定 Mac 节点才是把智力换成交付速度的前提。

FAQ

Fable 5 和 Sonnet 5 有什么区别?

Fable 5 是新旗舰($10/$50),Sonnet 5 是 Sonnet 线第五代默认档($3/$15)。Free/Pro 默认升的是 Sonnet 5,不是 Fable 5。

Sonnet 5 比 Sonnet 4.6 贵多少?

标价相同;标准价下因 tokenizer 约贵 30%。促销期 $2/$10 大致与 4.6 持平。见第二节等效成本表

API 模型 ID 是什么?

claude-sonnet-5,替换 claude-sonnet-4-6 后务必完成上文迁移清单。

为什么升级后账单变高?

新 tokenizer(+~30% token)+ 默认 adaptive thinking。促销期单价低可部分对冲,9 月后需靠 effort 与 disabled 精细控制。

还能设 temperature 吗?

非默认值会 400。用系统提示代替。

如何关闭思考?

thinking: {"type": "disabled"}。省略字段在 Sonnet 5 上不等于关闭。

Claude Code 默认模型变了吗?

是,Free/Pro 默认 Sonnet 5。Max 等档也可选用。

何时用 Opus 4.8 或 Fable 5?

Opus:复杂单会话、企业工作流。Fable:跨天仓库级任务、最高编码基准。日常留在 Sonnet 5。

结语

2026 年 6 月的 Claude 更新是双线叙事Fable 5 打开新旗舰天花板,Sonnet 5 把默认档推到接近旧 Opus 的水平——并不是「全线一个叫 5 的模型」。Opus 4.8 仍在,三者并存。

行动建议:默认跟着 Sonnet 5 走(已自动升级),API 用户在促销窗内完成迁移清单;硬任务再手动切 Fable 5;需要 Priority Tier 或旧 SDK 参数则暂留 Sonnet 4.6。无论哪档模型,长时 Agent 都建议配不掉线的 Cloud Mac 跑完构建闭环。

Sonnet 5 跑 Agent,Mac 节点跑 xcodebuild

Vuncloud Cloud Mac(M4 · SSH · tmux)为 Claude Code 与 iOS CI 提供稳定执行面。模型换 Sonnet 5 的同时,别让构建链断在笔记本睡眠上。

查看 Cloud Mac 套餐 · Claude Code 降本复盘

最后更新:2026 年 7 月 2 日。API 行为与定价以 Claude Platform 文档 与 Anthropic 公告为准。

机房手记 · AI 开发

Agent 大脑升级了,执行节点也要稳

Claude Sonnet 5 · Cloud Mac M4 · SSH · tmux

查看 Cloud Mac 套餐
限时优惠 点击查看套餐