如何选择视频模型档位:每秒成本、分辨率与输入类型
目录中的视频档位在输入类型、分辨率与每秒价格上各不相同。本文给出不靠猜的选择方法:成本计算、最短时长限制,以及各系列的适用位置。
发布 2026-09-12 · 更新 2026-09-29 · KeepRouter Editorial · 6 分钟阅读

先给结论:目录里的每个已定价档位都是独立的模型 ID,因此选择其实取决于你在写代码前就已经知道的三个条件:你喂给模型什么、片段需要多长、以及分辨率对你值多少。这里没有排行榜可查,因为本站不发布 benchmark 分数。
先看输入类型,而不是价格
各系列接受的输入不同,这通常在你考虑成本之前就已经决定了选择。
| 你手上有什么 | 你需要什么 | 可选形态 |
|---|---|---|
| 一段文字描述 | 从零生成的片段 | wan2.7-t2v、happyhorse-1.0-t2v、veo-3.1-lite、veo-3.1-fast、veo-3.1,以及各 PixVerse 档位 |
| 一张静态图片 | 让这一帧动起来 | wan2.7-i2v 与 happyhorse-1.0-i2v |
| 一张或多张参考图 | 跟随参考的片段 | wan2.7-r2v 与 happyhorse-1.0-r2v |
| 一段已有视频 | 修改或换风格的片段 | wan2.7-videoedit 与 happyhorse-1.0-video-edit |
HappyHorse 的输入驱动 ID 通过 media 数组接收素材,而不是只靠提示词:图生视频用 [{"type":"first_frame","url":"https://..."}],参考生视频用 reference_image,视频编辑用 video(输入片段至少 3 秒)。该 URL 必须能被上游抓取,因此带你自身鉴权的链接不可用;type 传错也不花钱:模型会拒绝请求并列出它接受的取值,此时尚未产生任何渲染费用。
如果你有一张静态图想要运动,文生视频模型就是错的工具,哪怕它每秒更便宜,因为它不会保留你这一帧。先定系列,再在同一系列内部比较档位。
成本计算,用真实数字
视频按视频秒数计费,所以算法就是简单乘法:成本 = 秒数 × 该 ID 公布的每秒单价。每个 ID 的费率都在模型页与模型目录上。按已公布费率,一个 5 秒片段的成本是:
| ID | 档位 | 每秒单价 | 5 秒片段 |
|---|---|---|---|
pixverse-v6-360p | 360p | $0.025 | $0.125 |
pixverse-v5.6-360p | 360p | $0.035 | $0.175 |
pixverse-v3.5-360p、v4、v4.5、v5、v5.5 | 360p | $0.045 | $0.225 |
wan2.7-videoedit | 720p | $0.086012 | $0.430 |
minimax-h3-768p | 768P | $0.09 | $0.450 |
wan2.7-t2v、wan2.7-i2v、wan2.7-r2v | 720p | $0.10 | $0.500 |
veo-3.1-lite | 720p | $0.05 | $0.250 |
veo-3.1-lite-1080p | 1080p | $0.08 | $0.400 |
minimax-h3-1080p | 1080P | $0.13 | $0.650 |
happyhorse-1.0-t2v、happyhorse-1.0-i2v、happyhorse-1.0-r2v、happyhorse-1.0-video-edit | 720p | $0.14 | $0.700 |
wan2.7-t2v-1080p、wan2.7-i2v-1080p、wan2.7-r2v-1080p | 1080p | $0.15 | $0.750 |
wan2.7-videoedit-1080p | 1080p | $0.143353 | $0.717 |
happyhorse-1.0-t2v-1080p、happyhorse-1.0-i2v-1080p、happyhorse-1.0-r2v-1080p、happyhorse-1.0-video-edit-1080p | 1080p | $0.24 | $1.200 |
veo-3.1-fast | 720p | $0.10 | $0.500 |
veo-3.1-fast-1080p | 1080p | $0.12 | $0.600 |
veo-3.1-fast-4k | 4K | $0.30 | $1.500 |
veo-3.1、veo-3.1-1080p | 720p / 1080p | $0.40 | $2.000 |
veo-3.1-4k | 4K | $0.60 | $3.000 |
这张表有两点值得注意。第一,最便宜与最贵的 5 秒片段现在相差二十倍以上,所以随手选档位就是一笔真实的预算。第二,从基础档位升到高分辨率档位的倍数并不统一:Wan 2.7 文生视频这一对是 1.5 倍,HappyHorse 约 1.7 倍,MiniMax 约 1.4 倍,Veo 3.1 Lite 是 1.6 倍,Veo 3.1 Fast 是 1.2 倍,而旗舰 Veo 档位两个分辨率价格完全相同。到 4K 又是另一级台阶:Veo 3.1 Fast 的 4K 是 1080p 的 2.5 倍,旗舰款是 1.5 倍。不逐个核对成对价格就去比较「那个 1080p 的」,估算就会漂移。
把贵的部分放到最后。 先在最便宜的、能接受你输入的档位上做原型,把提示词与时长定下来,再按最终要上线的分辨率重跑正式素材。每次尝试 $0.125 的提示词迭代,与每次 $0.75 的迭代,是完全不同的工作方式。
时长是被计费的输入,而且各系列下限不同
duration 不是提示:它就是计费数量,而且网关会把计费的那个值发给上游,所以你拿到的片段与付费金额一致。省略它时会固定一个默认值并据此计费,而不是交给上游决定。
各系列的最短时长不同。MiniMax H3 会以参数错误拒绝 2 秒请求,而同样的请求在 6 秒时被接受,因此短时长应当逐个模型验证而不是假定。上游也会限制最长时长,超出某个模型允许范围的值会表现为任务失败而不是提交被拒,所以重试之前值得先读请求日志与任务自带的错误信息。
分辨率到底买到了什么
更高档位更贵,是因为上游每帧编码了更多像素,而不是模型换了。它是否重要取决于片段最终显示在哪里:桌面页面的整宽主视觉与页面内的小预览,要求完全不同;同一个 360p 文件在一处显得发虚,在另一处却足够。由于每个档位都是带独立公布费率的 ID,你可以在自己的素材上量出这个差别,用证据决定,而不是默认选最贵。
五秒算例不代表每个型号都接受五秒请求
表格用于说明费率乘法,不能证明每个型号都接受五秒请求。允许时长与输入类型应查看所选模型页。试用时,在不同可用档位生成同一个符合要求的画面,评估主体一致、运动、文字可读性和构图,把弃用结果算入每个可用片段成本。做预算前,用当前目录费率替换历史价格示例。
一个简短的选择顺序
- 按输入类型筛选。 先把不接受你输入的系列全部排除。
- 设一个时长预算。 用候选费率乘以你真正需要的片段长度,并把重试算进去。
- 选满足显示尺寸的最便宜档位。 在该档位与高一档各渲一个样本,拿到最终展示的地方比较。
- 完整验证一次真实请求。 确认任务到达
completed、视频能下载、且费用等于时长乘以该 ID 公布的费率。
模型目录给出当前费率,异步流程说明讲清了这些 ID 共用的提交与轮询机制。如果你还在判断自己的场景是否该走网关,多模态模型 API 说明解释了为什么每种模态保留自己的端点,而不是共用一个万能请求。
常见问题
价格更高就意味着视频更好吗?
不是。公布的费率跟随上游实际收费,而上游收费取决于分辨率、时长与模型系列,不是质量排名。本站不发布 benchmark 分数,因此请把价格当作成本输入,用你自己的素材评估输出。
同一个提示词在不同 ID 上为什么价格不同?
每个 ID 固定了一个具体档位。wan2.7-t2v 是 720p 档,wan2.7-t2v-1080p 是 1080p 档,因此相同提示词与时长会产生不同费用,这是设计如此。如果你传入该 ID 未定价的分辨率,请求会被拒绝,而不会按你没付费的档位渲染。
有 4K 或带音轨的档位吗?
4K 有:`veo-3.1-fast-4k` 与 `veo-3.1-4k` 已上架,分别为 $0.30 与 $0.60 每秒。音轨不是可单独选择的档位,默认渲染返回的就是带同步音频的结果,这些 ID 计费的正是该档费率。只有当某个档位的精确每秒成本完全无法从上游确认时,它才不会进入目录,而不是按猜测定价。
参考的一手资料
本文最近复核 2026-09-29
- [1] Google Gemini API video documentation (video generation parameters)
- [2] Google Gemini API pricing (duration-metered video models)
- [3] model page