
核心结论真实单位成本应该按“可发布成片”计算,而不是按一次成功返回计算。
单次调用不是最终成本
两个模型即使标价相同,业务成本也可能相差数倍。原因在于生成一次不等于得到可用成片。你还需要考虑重做次数、失败请求是否计费、超时后的重复提交、素材存储、内容审核和人工挑选。
一个实用公式是:每条可用视频成本 = 总生成费用 ÷ 可用视频数量。总生成费用应包含所有尝试,而不是只统计成功状态的任务。
记录六类变量
- 基础计费单位:按秒、按任务、按分辨率还是按额度。
- 可用率:无需完整重做即可进入下一流程的比例。
- 技术失败率:超时、限流、供应商错误和回调丢失。
- 创意重试率:请求成功但画面不符合目标的次数。
- 周边成本:存储、下载流量、审核、转码和编排。
- 等待成本:排队过长对编辑团队或用户体验造成的损失。
用预算策略约束长尾
平均成本往往掩盖长尾。少数难例可能触发连续重试,吃掉整批任务的预算。ModelRush 的路由思路是为每个工作流设置最大尝试次数、单任务预算和回退模型。当质量优先模型连续失败时,可以转向更稳定的方案,也可以停止并交给人工处理。
幂等键同样重要。网络重试不应创建新的计费任务;应用需要能够安全地查询原请求状态。
每周更新,而不是每季度估算
模型价格、免费额度、排队和输出质量变化很快。把成本表做成运营指标:按模型、任务类型、团队和路由策略查看可用成片成本。只有把质量和费用放在一张表里,才能知道降价是否真的带来节省。
下一步
从这篇文章直接进入模型详情、当前价格、API 文档和 Playground。查看 API 文档
把文章中的架构和可靠性原则对应到请求、任务状态与错误处理。继续阅读
围绕相邻决策继续构建你的多模型技术栈。


