# GLM 5.3、Flash 与 FlashX：输入、思考与 API 成本

> GLM 5.3 为纯文字模型；Flash 与 FlashX 提供多模态理解并分别计价。

_发布 2026-10-03 · 更新 2026-10-03 · [KeepRouter Editorial](https://keeprouter.com/editorial-policy#editorial-team) · 7 分钟阅读_

![从请求契约到回滚的 OpenAI 兼容 API 字段级迁移清单](https://keeprouter.com/editorial/blog/openai-compatible-api-migration-checklist.png)

_兼容性按操作逐项验收，包括流式、工具、错误、用量与回滚。_

**纯文字评估可选择 GLM 5.3；需要图像、视频或文件理解时，选择 GLM 5.3 Flash 或 FlashX。** 在 KeepRouter Chat Completions 中使用准确 ID。三个型号均保持思考开启，输出预算必须容纳思考和最终答案。面向编程的订阅不会自动包含全部 GLM 变体。

2026-10-03 核对的官方文档记录一百万 token 上下文；这不是独立实测的生产容量。先用小规模代表输入，再验证应用真正需要的最长请求。

## 根据输入选择型号

| 公开 ID | 官方输入类型 | 首个验收任务 |
|---|---|---|
| [glm-5.3](/models/glm-5.3) | 文字 | 从提供文字抽取准确数值 |
| [glm-5.3-flash](/models/glm-5.3-flash) | 文字、图像、视频、文件 | 读取图表并引用可见标签 |
| [glm-5.3-flashx](/models/glm-5.3-flashx) | 文字、图像、视频、文件 | 重复相同任务并比较消费 |

FlashX 不是 Flash 的拼写别名。评估记录应保留型号 ID，避免后续价格或配置变化把不同产品混为一谈。依赖图片内容的任务，不应选择基础 GLM 5.3。

## 首个文字请求

```python
import os
from openai import OpenAI
client = OpenAI(base_url="https://keeprouter.com/v1",
                api_key=os.environ["KEEPROUTER_KEY"], max_retries=0)
r = client.chat.completions.create(
    model="glm-5.3-flash", max_tokens=2048,
    messages=[{"role": "user", "content": "抽取币种与金额：invoice total USD 18.50。简短回答。"}])
print(r.choices[0].message.content)
print(r.usage)
```

这是文字示例，不代表文件编码或图片路径经过验证。视觉测试应使用有权发送的小图、文档规定的内容 schema，以及有明确可见答案的问题。除了简单图片，还要测试缺失值和矛盾值。先排查不支持的输入格式，再判断模型是否不可用。

## 思考会影响输出预算

请求可能在给出最终答案前就消耗输出 token。检查 finish reason 和思考明细。答案被截断时，先判断预算是否太小。completion 已包含思考时，不应将思考再作为额外总量相加。

基础 GLM 5.3 记录 low、high、max effort，但不能假定 Flash 变体使用完全相同的控制参数，也不能对保持思考开启的型号发送关闭思考标志。先使用支持的默认参数，再逐项变更。

工具测试可提供只读 `get_product` 函数，结果包含两个必填字段。确认参数、call ID、工具执行和最终答案。看起来像 JSON 的文字，不等于已经通过 schema 校验的结构化结果；需同时评估语法与数值。

## 区分按量价格和订阅权限

智谱文档说明 FlashX 尚未加入其 Coding Plan。这是该套餐的权限边界，不代表独立按量线路不能提供 FlashX。目录读取成功也不能证明账户具有推理调用权限。

KeepRouter 使用自己的 Key 与详情页实时客户价，不要把编程套餐积分余额换算成未经验证的美元成本。跨服务比较时，应同时标明币种、计费单位、准确 ID 和核对日期。缺失成本应保持未知，不能写成零。

## 比较每次合格抽取的成本

构造固定小数据集，包含正确金额、缺少币种、无效数字和冲突总额。预先定义通过条件：币种和小数正确，证据不足时返回 null 或明确未知。Flash 与 FlashX 使用相同数据和输出预算。

汇总所有尝试的消费，包括 schema 修复，再除以合格结果数。缓存使用实际报告的命中量；假设命中率应单独标为预测。[费用计算器](/tools/api-cost-calculator) 可比较无缓存起点和缓存方案，但不会生成实测成功率。

生产环境中应区分格式错误、鉴权失败、限流与上游服务器错误。重复坏请求或无效 Key 不是有效回退策略。备用型号需具有相同输入模态，工具契约也需独立验证。[创建 KeepRouter Key](/docs/quickstart)，先运行小请求，再按[结构化输出指南](/zh/blog/structured-outputs-json-mode) 制定明确验收条件。

本文核对的一手文档：[Zhipu · GLM 5.3](https://docs.z.ai/guides/llm/glm-5.3) · [Zhipu · GLM 5.3 Flash and FlashX](https://docs.z.ai/guides/vlm/glm-5.3-flash).

## 常见问题

### GLM 5.3 接受图片吗？

基础型号为纯文字。Flash 与 FlashX 的文档支持多模态输入。

### 思考可以关闭吗？

这些 GLM 5.3 变体保持思考开启，输出预算应容纳思考与答案。

### Coding Plan 权限包含 FlashX 吗？

厂商说明 FlashX 尚未加入该套餐。KeepRouter 使用独立配置的线路和客户价格。

## 参考的一手资料

_本文最近复核 2026-10-03_

1. [Zhipu · GLM 5.3](https://docs.z.ai/guides/llm/glm-5.3)
2. [Zhipu · GLM 5.3 Flash and FlashX](https://docs.z.ai/guides/vlm/glm-5.3-flash)

## 继续阅读

- [glm 5.3](https://keeprouter.com/models/glm-5.3.md)
- [glm 5.3 flash](https://keeprouter.com/models/glm-5.3-flash.md)
- [glm 5.3 flashx](https://keeprouter.com/models/glm-5.3-flashx.md)
- [api cost calculator](https://keeprouter.com/tools/api-cost-calculator)
- [MiMo V2.6 API：Flash、Pro、UltraSpeed 与 V2.5 迁移](https://keeprouter.com/zh/blog/mimo-v2-6-api-pricing-migration.md)
- [Grok 4.7、Qwen 3.8、Gemma 4 与 Doubao 2.1：按任务选型](https://keeprouter.com/zh/blog/grok-qwen-gemma-doubao-model-selection.md)

## 查看这个型号的价格与 API

查看本文型号的当前用户费率、支持端点与接入示例。

[查看型号与价格](https://keeprouter.com/models/glm-5.3-flash)

[创建 Key，测试免费模型](https://keeprouter.com/login?returnTo=%2Fconsole%2Fkeys%3Fmodel%3Dfree)

免费测试使用 free 模型；其他付费型号需要足够预付额度。

[全部文章](https://keeprouter.com/zh/blog.md) · [模型与价格](https://keeprouter.com/models.md)
