GPT-6.1 Sol API:Responses、工具调用与可靠迁移

GPT-6.1 Sol 函数调用使用 Responses。先验证完整工具往返及合格结果成本,再决定生产选型。

发布 2026-10-03 · 更新 2026-10-03 · KeepRouter Editorial · 7 分钟阅读

Responses API 与 Chat Completions 接入协议决策矩阵
按应用实际消费的契约选择;提示词相似不代表响应状态与事件可以互换。

在 KeepRouter 调用 GPT-6.1 Sol 的函数工具,请使用 POST /v1/responses。 此型号的 Chat Completions 不支持工具调用,思考也不能关闭。因此,文字回复成功不代表现有 Agent 可以直接迁移。先查看 gpt-6.1-sol 详情,设置有限输出预算,验证一个无副作用工具。

本文于 2026-10-03 核对 OpenAI 的确切型号文档。官方上限是文档事实;下方是可复现评估方法,不是已完成的跑分或吞吐承诺。

先选择接口,再选择型号

公开型号建议起点工具迁移限制
gpt-6.1-solResponses不要通过 Chat Completions 发送工具
gpt-6-solResponsesChat 工具需关闭思考
gpt-6-lunaResponsesChat 工具需关闭思考

三个型号分别计价。Sol 与 Luna 不是通过温度切换的同一模型。检查客户端发送的是 input 还是 messages、思考参数的位置,以及工具结果的返回方式。迁移检查工具 可辅助核对请求差异。

发出一个小规模 Responses 请求

Key 放在服务器环境变量。示例使用 OpenAI SDK,关闭自动重试以方便对账,并设置 low,而不是 6.1 Sol 不支持的无思考模式。

import os
from openai import OpenAI
client = OpenAI(base_url="https://keeprouter.com/v1",
                api_key=os.environ["KEEPROUTER_KEY"], max_retries=0)
r = client.responses.create(
    model="gpt-6.1-sol",
    input="用一句话解释数据库事务。",
    reasoning={"effort": "low"}, max_output_tokens=1024, store=False)
print(r.output_text)
print(r.usage)

输出上限包含思考和答案。如果结果未完成,先检查完成状态,再决定是否提高预算。不要对同一个放不下答案的请求持续重复重试。

验证完整工具往返

使用本地 lookup_order 函数,只接收一个字符串并返回固定测试数据。无需购买、发送邮件或修改账户。合格测试包括:模型发出函数调用;参数符合 schema;应用按匹配的 call ID 返回结果;模型基于该结果生成答案。

使用 store=False 时,由应用保留返回的 output 项,把工具结果作为 function_call_output 放回 Responses 对话。不要因为聊天界面不显示思考,就删除相关历史项。服务端会话存储是独立能力,不应假定网关会替应用保存状态。

记录 request ID、确切型号、状态、完成原因、总输入、缓存输入和输出用量。普通遥测中不要放 Key 或客户正文。最终答案包含正确订单值,比单独的 HTTP 200 更有意义。

计算合格改动的成本

使用详情页实时的 KeepRouter 客户价。目录采用覆盖所支持长上下文和缓存写入档位的固定上限价,与 OpenAI 短上下文基础价不同;普通输入也使用该公开固定费率,不另加缓存写入附加费。缓存命中按独立缓存输入价收费。

文字计费公式为:(输入-缓存输入)×输入价+缓存输入×缓存价+输出×输出价。报告的思考已包含在输出用量中,不能再加一次。汇总所有计费尝试,再除以通过测试的改动数。一次便宜请求如果需要三次修复,可能比一次合格结果更贵。

费用计算器 可调整提示长度、输出长度和缓存假设。保留无缓存方案作为对照。模型支持缓存,不代表此次调用已经命中。

在自己的工作量上比较 Sol 与 Luna

建议选择二十个代表任务:简单抽取、小型代码修复、需两个工具的仓库修改、要求引用原文的长文问答。这是建议评估规模,不是我们已经完成二十次实测的声明。固定工具 schema、数据和验收规则,记录合格数、重试、消费和应用延迟。

如果 Luna 满足简单任务,就显式把这些任务分配给它;Sol 只处理它能够证明改善的任务。鉴权失败不应自动切换到更贵型号:换模型无法修复无效 Key。生产环境还需消费上限,以及保留接口和对话状态的回退策略。

创建 KeepRouter Key,先完成有限请求和无副作用工具循环,再迁移客户流量。Responses 与 Chat Completions 指南 进一步解释两类请求。

本文核对的一手文档:OpenAI · GPT-6.1 Sol · OpenAI · GPT-6 Sol · OpenAI · GPT-6 Luna.

常见问题

GPT-6.1 Sol 能通过 Chat Completions 使用工具吗?

不能。函数调用使用 Responses;文字回复成功不代表工具已经验证。

输出用量包含思考吗?

报告的思考包含在 completion 用量中,只计算一次,不要把明细再次相加。

KeepRouter 价格等于厂商基础价吗?

不相同。这些目录型号采用覆盖所支持缓存写入与长上下文档位的固定费率,以实时详情价格为准。

参考的一手资料

本文最近复核 2026-10-03

  1. [1] OpenAI · GPT-6.1 Sol
  2. [2] OpenAI · GPT-6 Sol
  3. [3] OpenAI · GPT-6 Luna

继续阅读

← 全部文章 · 模型与价格 · 获取 API Key