多模态 API

文本、视觉、图像、向量、音频与语音——端点边界清晰

KeepRouter 在一个目录中呈现多种模型模态,同时保留每种操作所需的端点和价格单位。统一发现并不会把不同 payload 强行压成误导性的万能请求。

最后复核 2026-08-15 · 编辑复核: KeepRouter Editorial

一个目录,多种操作族

公共目录会标出每个模型的模态,并链接实际调用端点。配置允许时,聊天和视觉对话模型可使用 Chat Completions、Responses 或 Messages;向量模型接受 embedding 请求;图像模型使用图像生成路由;语音和转写模型使用音频专用操作。

为什么专用端点示例更安全

不同模态的必填字段、二进制或 URL 输入、输出形态、大小限制和计价单位都不同。在图像模型页放一个通用聊天示例看似简单,却会在生产失败。KeepRouter 只有在模态存在安全、受支持通用模式时才展示示例,否则会引导到 API 参考。

价格单位跟随工作类型

文本类模型通常按输入与输出 token 计量,并在上报时记录缓存输入;图像生成可能按张计价;音频操作也有自己的单位与 payload 约束。比较时要比较同类,并阅读价格标签,而不仅看数字。

建立模态感知的客户端层

把模型配置与路由、输入校验器、输出解析器、超时、最大 payload 和预期价格单位放在一起。不要让 UI 选择器在复用同一请求体时把聊天模型换成图像模型。类型化操作注册表可以避免这类故障。

验证内容处理边界

图像、音频和文档带来的数据处理问题不止 token。请检查所选模型厂商政策、涉及的路由中介、payload 保留、地区限制和自身同意要求。KeepRouter 的安全页描述网关日志与传输边界,但不会替代上游政策。

从模型页开始

按模态筛选目录,打开模型详情,确认端点与当前计价单位,再使用对应 API 文档。把模型 ID 与操作类型一起存入配置,避免后续目录变化变成运行时猜测。

常见问题

所有模态都使用 /v1/chat/completions 吗?

不是。专用模态使用各自端点,模型页会标出支持的操作。

所有模型都按 token 计费吗?

不是。计价单位随模态变化,例如部分图像模型按生成图片数量计价。

一个 Key 可以调用不同模态吗?

Key 可以调用策略允许的模型,但每个请求必须使用该模态正确的路由与 payload。

在哪里核验 payload 限制?

请同时查看 KeepRouter API 参考、模型页和所选模型厂商的官方文档。

参考的一手资料

  1. [1] KeepRouter API documentation
  2. [2] KeepRouter OpenAPI

继续阅读

先选择模态,再选择模型

打开目录,核验端点与计价单位,再围绕正确操作构建。

创建免费 Key · 查看实时模型与价格 · 阅读 Markdown 版本