Claude Sonnet 5.5 与 Opus 5.5:API 迁移与缓存成本

迁移 Claude 5.5 需要检查请求参数与会话状态,不能只替换模型名称。

发布 2026-10-03 · 更新 2026-10-03 · KeepRouter Editorial · 7 分钟阅读

按任务风险、上下文与模型验收检查整理的 Claude Code 工作负载路由表
只有在核验输出质量、工具行为、用量与回滚后,才路由边界明确的任务类别。

在 KeepRouter 接入 Claude Sonnet 5.5 与 Opus 5.5,建议先使用原生 Messages,再验证完整工具对话。 新型号改变了思考与采样行为。删除不支持的采样参数可能修复首个 400,但如果丢失思考块,下一轮工具请求仍可能失败。

Sonnet 5.5 与 Opus 5.5 页面提供 Anthropic 原始文档和实时客户价格。本文于 2026-10-03 核对接口行为,不宣称独立跑分结果。

从旧版 Claude 迁移时改变了什么?

两个型号的官方上下文均为一百万 token,输出最多 128,000 token。Sonnet 默认采用自适应思考,Opus 保持自适应思考开启,两者默认 effort 不同。非默认 temperature、top_p、top_k 不受支持。先移除旧配置中的采样覆盖,不要尝试寻找另一组温度来复现旧行为。

也需检查 tool choice。强制工具选择可能与自适应思考冲突。先使用自动选择和范围较小的 schema,再按准确型号文档测试更严格的策略。旧版 computer-use 工具也需单独迁移核对;Messages 兼容不代表全部旧 beta 工具都可用。

使用 Anthropic SDK 与 KeepRouter Key

import os
from anthropic import Anthropic
client = Anthropic(base_url="https://keeprouter.com",
                   api_key=os.environ["KEEPROUTER_KEY"], max_retries=0)
r = client.messages.create(
    model="claude-sonnet-5-5", max_tokens=1024,
    output_config={"effort": "low"},
    messages=[{"role": "user", "content": "说明一条安全的数据库回滚规则。"}])
print(r.content)
print(r.usage)

SDK 的 base URL 使用域名根地址,它会添加 /v1/messages。直接 HTTP 调用则使用 x-api-key、anthropic-version 和 JSON。快速开始 提供账号和 Key 设置步骤。目录也列出这两个型号的 OpenAI 兼容聊天接口;需要保留 Anthropic 思考与工具块时,原生 Messages 更容易核对。

在工具轮次间保留完整助手消息

以只读 get_invoice 查询发票金额为例。先把模型返回的完整 assistant content 放回历史,包括思考块及签名,再添加 tool-result 用户消息。工具 ID 必须一致。不要把助手轮次重建成普通文字摘要,也不要为了节省少量输入删除思考块。

失败测试可以让工具返回「发票不存在」,最终答案应承认缺失,不能编造余额。另一个测试返回小数金额与币种,答案应保留两者。以上是建议验收任务,不代表客户已上线案例。

理解固定客户输入价

Anthropic 区分普通输入、不同保留时间的缓存创建和缓存读取。KeepRouter 的 5.5 公开输入价为一个固定客户费率,覆盖普通输入与支持的一小时缓存写入;普通输入和五分钟写入也使用同一费率。因此,它高于厂商普通输入基础价,但不会再次收缓存写入附加费。

命中量按独立缓存输入价收费。将提示用量看作普通输入、缓存创建和缓存读取的分区,按响应字段与消费记录核对,不能把已经包含在总输入里的缓存子项再加一次。缓存审计指南 解释了前缀变化和重试如何影响实际节省。

重复仓库任务可分别测试首次无缓存、相同前缀后续调用、前缀发生变化的调用。每次都记录实际缓存量,不能把预计缓存比例当成已测节省。

用验收规则选择 Sonnet 或 Opus

选定同一组代码修复或文档判断任务。看答案前先定义通过标准:测试成功、引用证据、正确工具使用、未执行未经授权动作。固定工具 schema 与上下文,先用 low 作为起点,再对可能与推理有关的失败提高 effort。

比较每个合格结果的总消费,包括失败尝试和人工修复,并从自己的应用测量延迟。更大的型号名称不能证明任务可靠性更高;较低 token 单价也不能证明更便宜,因为工具轮次可能增加。

小规模迁移期间保留旧型号。如果合格结果率下降或工具历史失败,可回滚;鉴权错误应在 Key 层处理。创建 Key,先完成文字示例与发票工具往返,再切换生产代码 Agent。

本文核对的一手文档:Anthropic · Sonnet 5.5 · Anthropic · Opus 5.5.

常见问题

旧版温度参数能直接复制到 Claude 5.5 吗?

不支持非默认 temperature、top_p、top_k,应移除覆盖并核对准确型号指南。

为什么要保留思考块?

思考块属于模型会话状态。将工具历史改成普通文本可能丢失下一轮需要的信息。

模型支持缓存就一定节省吗?

不一定。应核对返回的缓存用量,按客户公开费率汇总所有尝试。

参考的一手资料

本文最近复核 2026-10-03

  1. [1] Anthropic · Sonnet 5.5
  2. [2] Anthropic · Opus 5.5

继续阅读

← 全部文章 · 模型与价格 · 获取 API Key