# Claude Sonnet 5.5 与 Opus 5.5：API 迁移与缓存成本

> 迁移 Claude 5.5 需要检查请求参数与会话状态，不能只替换模型名称。

_发布 2026-10-03 · 更新 2026-10-03 · [KeepRouter Editorial](https://keeprouter.com/editorial-policy#editorial-team) · 7 分钟阅读_

![按任务风险、上下文与模型验收检查整理的 Claude Code 工作负载路由表](https://keeprouter.com/editorial/blog/cut-claude-code-costs.png)

_只有在核验输出质量、工具行为、用量与回滚后，才路由边界明确的任务类别。_

**在 KeepRouter 接入 Claude Sonnet 5.5 与 Opus 5.5，建议先使用原生 Messages，再验证完整工具对话。** 新型号改变了思考与采样行为。删除不支持的采样参数可能修复首个 400，但如果丢失思考块，下一轮工具请求仍可能失败。

[Sonnet 5.5](/models/claude-sonnet-5-5) 与 [Opus 5.5](/models/claude-opus-5-5) 页面提供 Anthropic 原始文档和实时客户价格。本文于 2026-10-03 核对接口行为，不宣称独立跑分结果。

## 从旧版 Claude 迁移时改变了什么？

两个型号的官方上下文均为一百万 token，输出最多 128,000 token。Sonnet 默认采用自适应思考，Opus 保持自适应思考开启，两者默认 effort 不同。非默认 `temperature`、`top_p`、`top_k` 不受支持。先移除旧配置中的采样覆盖，不要尝试寻找另一组温度来复现旧行为。

也需检查 tool choice。强制工具选择可能与自适应思考冲突。先使用自动选择和范围较小的 schema，再按准确型号文档测试更严格的策略。旧版 computer-use 工具也需单独迁移核对；Messages 兼容不代表全部旧 beta 工具都可用。

## 使用 Anthropic SDK 与 KeepRouter Key

```python
import os
from anthropic import Anthropic
client = Anthropic(base_url="https://keeprouter.com",
                   api_key=os.environ["KEEPROUTER_KEY"], max_retries=0)
r = client.messages.create(
    model="claude-sonnet-5-5", max_tokens=1024,
    output_config={"effort": "low"},
    messages=[{"role": "user", "content": "说明一条安全的数据库回滚规则。"}])
print(r.content)
print(r.usage)
```

SDK 的 base URL 使用域名根地址，它会添加 `/v1/messages`。直接 HTTP 调用则使用 `x-api-key`、`anthropic-version` 和 JSON。[快速开始](/docs/quickstart) 提供账号和 Key 设置步骤。目录也列出这两个型号的 OpenAI 兼容聊天接口；需要保留 Anthropic 思考与工具块时，原生 Messages 更容易核对。

## 在工具轮次间保留完整助手消息

以只读 `get_invoice` 查询发票金额为例。先把模型返回的完整 assistant content 放回历史，包括思考块及签名，再添加 tool-result 用户消息。工具 ID 必须一致。不要把助手轮次重建成普通文字摘要，也不要为了节省少量输入删除思考块。

失败测试可以让工具返回「发票不存在」，最终答案应承认缺失，不能编造余额。另一个测试返回小数金额与币种，答案应保留两者。以上是建议验收任务，不代表客户已上线案例。

## 理解固定客户输入价

Anthropic 区分普通输入、不同保留时间的缓存创建和缓存读取。KeepRouter 的 5.5 公开输入价为一个固定客户费率，覆盖普通输入与支持的一小时缓存写入；普通输入和五分钟写入也使用同一费率。因此，它高于厂商普通输入基础价，但不会再次收缓存写入附加费。

命中量按独立缓存输入价收费。将提示用量看作普通输入、缓存创建和缓存读取的分区，按响应字段与消费记录核对，不能把已经包含在总输入里的缓存子项再加一次。[缓存审计指南](/zh/blog/llm-cache-pricing-audit) 解释了前缀变化和重试如何影响实际节省。

重复仓库任务可分别测试首次无缓存、相同前缀后续调用、前缀发生变化的调用。每次都记录实际缓存量，不能把预计缓存比例当成已测节省。

## 用验收规则选择 Sonnet 或 Opus

选定同一组代码修复或文档判断任务。看答案前先定义通过标准：测试成功、引用证据、正确工具使用、未执行未经授权动作。固定工具 schema 与上下文，先用 low 作为起点，再对可能与推理有关的失败提高 effort。

比较每个合格结果的总消费，包括失败尝试和人工修复，并从自己的应用测量延迟。更大的型号名称不能证明任务可靠性更高；较低 token 单价也不能证明更便宜，因为工具轮次可能增加。

小规模迁移期间保留旧型号。如果合格结果率下降或工具历史失败，可回滚；鉴权错误应在 Key 层处理。[创建 Key](/docs/quickstart)，先完成文字示例与发票工具往返，再切换生产代码 Agent。

本文核对的一手文档：[Anthropic · Sonnet 5.5](https://platform.claude.com/docs/en/models/sonnet-5-5/overview) · [Anthropic · Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/overview).

## 常见问题

### 旧版温度参数能直接复制到 Claude 5.5 吗？

不支持非默认 temperature、top_p、top_k，应移除覆盖并核对准确型号指南。

### 为什么要保留思考块？

思考块属于模型会话状态。将工具历史改成普通文本可能丢失下一轮需要的信息。

### 模型支持缓存就一定节省吗？

不一定。应核对返回的缓存用量，按客户公开费率汇总所有尝试。

## 参考的一手资料

_本文最近复核 2026-10-03_

1. [Anthropic · Sonnet 5.5](https://platform.claude.com/docs/en/models/sonnet-5-5/overview)
2. [Anthropic · Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/overview)

## 继续阅读

- [claude sonnet 5 5](https://keeprouter.com/models/claude-sonnet-5-5.md)
- [claude opus 5 5](https://keeprouter.com/models/claude-opus-5-5.md)
- [提示词缓存成本：算清读取、写入与实际节省](https://keeprouter.com/zh/blog/llm-cache-pricing-audit.md)
- [claude code](https://keeprouter.com/use-cases/claude-code.md)
- [GPT-6.1 Sol API：Responses、工具调用与可靠迁移](https://keeprouter.com/zh/blog/gpt-6-1-sol-api-tools-pricing.md)
- [MiMo V2.6 API：Flash、Pro、UltraSpeed 与 V2.5 迁移](https://keeprouter.com/zh/blog/mimo-v2-6-api-pricing-migration.md)

## 查看这个型号的价格与 API

查看本文型号的当前用户费率、支持端点与接入示例。

[查看型号与价格](https://keeprouter.com/models/claude-sonnet-5-5)

[创建 Key，测试免费模型](https://keeprouter.com/login?returnTo=%2Fconsole%2Fkeys%3Fmodel%3Dfree)

免费测试使用 free 模型；其他付费型号需要足够预付额度。

[全部文章](https://keeprouter.com/zh/blog.md) · [模型与价格](https://keeprouter.com/models.md)
