Claude Opus 5.5 使用指南:16 步完整走一遍

Claude Opus 5.5 是 Anthropic 在 2026 年 9 月 22 日发布的旗舰模型,定位就是长时间运行的智能体编程和知识工作。它比 Opus 5 每 token 便宜 20%,完成同样任务消耗的 token 更少,Pro、Max、Team 订阅的额度还同步上调了 25%。这篇攻略跟着 Anthropic 官方的日常使用演示一步步走,所有数字都与官方公告和文档交叉核对过:从选模型、调 effort,到配子代理、改项目提示词。

来源与致谢

本教程的截图来自 Claude 的公开演示视频。每个步骤都链接到视频中的对应时间点,方便你对照学习。

Claude ↗

先搞清楚你为什么买单

  1. 1

    先读一遍官方公告

    动手之前先把 Anthropic 的公告过一遍。官方对 Opus 5.5 的定位是 Claude 5.5 家族的第一个模型:多数工作上达到 Claude Fable 5.1 的水准,运行成本却比 Opus 5 低 40%。记住这两个数字,接下来你在自己项目里实测时就有了一把对照的尺子。

    Anthropic 官网上的 Opus 5.5 发布公告,标题写明这是首个 Claude 5.5 家族模型、运行成本比 Opus 5 低 40%
    Anthropic 在 2026 年 9 月 22 日发布 Opus 5.5,Claude 5.5 家族的第一款模型。视频 0:46 处
  2. 2

    提问之前先看清价格

    Opus 5.5 的 API 定价是每百万 token 输入 4 美元、输出 20 美元,比 Opus 5 的 5 美元和 25 美元各降 20%。缓存读取降到每百万 token 0.20 美元;还有一档快速模式,输入 8 美元、输出 40 美元,换最多 2.5 倍的速度。直接调 API 按量计费,Pro、Max、Team 订阅用户则在套餐额度内直接使用。

    Anthropic 官方定价表,把 Opus 5.5 与上一代 Opus 5 的每百万 token 输入输出价格并排对比
    输入从每百万 token 5 美元降到 4 美元,输出从 25 美元降到 20 美元,两边都是 20% 的降幅。视频 1:58 处
  3. 3

    记住 100 万 token 的上下文窗口

    模型卡片上写着:100 万 token 上下文窗口、12.8 万最大输出、自适应思考常开。要走 API 就复制模型 ID claude-opus-5-5,在 Claude 应用里直接按名字选 Opus 5.5 即可。正是这个上下文预算,让长时间智能体会话不用反复总结也能跑下去。

    Claude 平台文档中的 Opus 5.5 模型详情页,标注 100 万 token 上下文窗口、12.8 万最大输出和 4、20 美元的定价
    文档给出三个关键数:100 万输入 token、12.8 万输出 token、每百万 token 输入 4 美元输出 20 美元。视频 3:42 处

在 Claude 里选模型、定思考强度

  1. 4

    把 Opus 5.5 和 Opus 5 放在一起跑

    在官方演示里,同一个退款舍入缺陷同时发给左右两栏:左边 Opus 5,右边 Opus 5.5,都是中等强度。两边都会读退款代码、找到折扣拆分的位置、跑测试,但 5.5 不到一分钟就交活,整体快了约 30%。换主力模型之前,照这个样子拿自己的真实任务对比一轮。

    Claude 应用的双栏对比界面,同一个退款缺陷提示词分别跑在 Opus 5 和 Opus 5.5 上,均为中等强度
    同一个项目、同一条提示词:左边 Opus 5,右边 Opus 5.5。视频 0:37 处
  2. 5

    起步阶段保持 Medium 思考强度

    Opus 5.5 默认就是中等强度,effort 本质上是模型动手前思考的深度。选择器上的提示写得很直白:更高的强度意味着更彻底的回答,但耗时更久、额度消耗更快。日常任务中等强度足够,官方演示里普通修复全程也没离开这一档。

    Claude 的 effort 选择器停在 Medium,悬停提示解释更高的强度会更慢且消耗更多额度
    悬停 effort 标签就能看到官方写的取舍:更彻底,但更慢、更费额度。视频 1:32 处
  3. 6

    盯住 5 小时额度:它掉得更慢了

    同一个修复跑完,Opus 5.5 只用了 5 小时 Max 额度的约 4%,Opus 5 用了 6%;上下文窗口这边是 31.4k token,Opus 5 那边是 44k。因为 5.5 完成任务消耗的 token 更少,Anthropic 估计单任务成本能省下四成左右。你的具体数字会不一样,但重复跑几次就能稳定看到这个差距。

    一次 Opus 5.5 任务后的用量面板:上下文窗口用了 16%,5 小时 Max 额度只用掉 4%
    同一个任务,Opus 5.5 花掉 5 小时额度的 4%,Opus 5 花掉 6%。视频 1:14 处
  4. 7

    一周后回看统计数据

    统计总览会把真实用量汇总起来:总 token 数、单任务平均 token、平均耗时,还有一张活动热力图,这个 Max 账号的常用模型显示为 Opus 5.5。用满一周后回来看一眼,确认中等强度确实把用量控制在预期内。如果某类任务的消耗持续偏高,那就是该为它单独调高强度值的信号。

    Claude 的统计总览面板,任务热力图上方标注常用模型为 Opus 5.5
    平均耗时、平均消耗加一张任务热力图,省没省钱这里见分晓。视频 2:32 处

在 Claude Code 里跑第一个智能体修复

  1. 8

    喂给它一个可验证的具体缺陷

    演示用的提示词就是一份好工单:修复 418 号问题——打折订单的退款金额会差几毛钱、逐项退款加起来对不上账,要求做到分毫不差。三句话说清了症状、约束和验收标准。Opus 5.5 最吃这种提示词结构:一个具体的缺陷,加一条可度量的完成定义。

    Claude 输入框里输入 penny-exact 退款缺陷修复提示词,底部模型标签显示 Opus 5.5 加 Medium
    三句话:418 号问题、症状是什么、验收标准是分毫不差。视频 0:32 处
  2. 9

    小范围修改交给中等强度

    像「把订单处理器里的 customerRef 改名为 accountRef」这种范围明确的请求,中等强度会搜索代码、改 handlers.ts、跑 API 测试,然后汇报全部 14 项测试通过,外加一段简短的改动说明。这就是日常主力用法:范围划清楚,强度用中等,让它自己跑。看完 diff、保住绿灯,继续下一件事。

    Opus 5.5 在中等强度下完成重命名后的结果面板,汇报 API 测试全部通过
    中等强度下的范围化重命名:只改一个文件,测试全绿,报告简短。视频 1:55 处
  3. 10

    知道中等强度会漏掉什么

    中等强度改完处理器里的字段就停手了,但移动端发送同一个值时用的是带下划线的 customer_ref,而且要经过 order_serializer.ts,搜索根本匹配不到那个文件。修复本身没错,只是不完整。把单轮结果理解为你字面点名范围之内的修改,一旦改动会波及多个边界,就升级到高强度。

    order_serializer.ts 的代码预览卡片,高亮出中等强度重命名漏掉的 customer_ref 字段
    customer_ref 藏在移动端序列化器里,中等强度那轮重命名完全没碰到这个文件。视频 2:00 处
  4. 11

    跨文件改动切到高强度

    当修复要横跨多个文件时,切到高强度并把话说全:把还在使用 customerRef 的地方全部改成 accountRef,包括发给 API 的那条链路。高强度下模型会顺着 payload 找到移动端客户端,把序列化器和 schema 里的字段一起改掉,还补了一个回归测试。大改动落地之后,记得切回中等强度。

    Claude 会话切到 High 强度,输入框里是要求把 accountRef 重命名改到位的追加指令
    高强度会追着 customer_ref 进移动端客户端和序列化器,跑完这轮再回到中等强度。视频 2:18 处

调提示词、配子代理、认清边界

  1. 12

    为 5.5 审一遍项目提示词

    就算你只用 Claude Code、从不直接调 API,也可以跑 /claude-api prompt-audit 命令。它会读你的 CLAUDE.md 和技能文件,把那些按老模型习惯写出来的指令改写成适配 Opus 5.5 的版本。演示里这条命令一轮就同时调整了 CLAUDE.md 和一个 SKILL.md。

    Claude 正在运行 claude-api prompt-audit 命令,读取并改写 CLAUDE.md 与 SKILL.md 以适配 Opus 5.5
    一条命令读完 CLAUDE.md 和技能文件,再把它们改写成适配 Opus 5.5 的版本。视频 3:12 处
  2. 13

    让只读子代理跑在 Sonnet 上

    只负责翻代码库的子代理用不上 Opus 级的推理。直接让 Claude 把 explore 子代理切到 Sonnet,并把项目里所有子代理的默认模型设为 Sonnet:它会在代理定义里写上 model 为 sonnet,再把 CLAUDE_CODE_SUBAGENT_MODEL 写进 .claude/settings.json,而主会话继续留在 Opus 5.5 上。便宜的只读探索用 Sonnet 就够,有时甚至 Haiku 也行。

    Claude 确认 explore 子代理已切到 Sonnet,并在项目设置里写入 CLAUDE_CODE_SUBAGENT_MODEL
    主会话留在 Opus 5.5,仓库里所有子代理的默认模型都换成 Sonnet。视频 2:42 处
  3. 14

    一处配置固定子代理模型

    想全仓库生效,就在 .claude/settings.json 的 env 块里加上 CLAUDE_CODE_SUBAGENT_MODEL,值设为 sonnet,和测试权限写在一起。之后每个子代理都自动继承这个更便宜的模型,不用逐个配置。把 Opus 5.5 留给主线程,那里的推理才真正值回票价。

    settings.json 的 diff 视图,在测试权限旁边新增 CLAUDE_CODE_SUBAGENT_MODEL 一项,值为 sonnet
    settings.json 里一行 env 配置,就把全仓库的子代理都指向了 Sonnet。视频 2:47 处
  4. 15

    按成本曲线选思考强度

    Anthropic 的 Terminal-Bench 4.0 图表把各强度档位的准确率对每次尝试的成本画在一张图上,Opus 5.5 高强度那一点是 64.2%、约 3.80 美元。在智能体编程上,中等强度用低得多的花费就能逼近高强度,这正是它被设为默认的原因。按任务价值选强度,别条件反射式地拉满。

    Terminal-Bench 4.0 的准确率对成本曲线图,比较 Opus 5.5、Fable 5.1、Opus 5、GPT-6 Astra 和 GPT-5.6 Sol
    各强度档位的准确率对成本曲线——对多数编程任务,中等强度就是性价比最高的一档。视频 2:08 处
  5. 16

    记住唯一红线:前沿大模型研发

    Opus 5.5 不是什么请求都能接。分类器会拦下一小撮与前沿大模型研发相关的能力,比如某些 ML 加速器的内核开发,然后 Claude 回退到能力较弱的模型,并在对话里给出提示。常规的机器学习开发、研究和普通编码不受影响。看到回退提示时,换个说法重新描述任务,比原样重试有用。

    Claude 支持中心关于 Opus 5.5 前沿大模型研发类请求回退到较弱模型的说明页面
    Claude 支持中心明确:前沿大模型研发类请求会透明地回退到较弱的模型。视频 3:10 处

常见问题

继续探索