返回 Blog
视频模型
发布于 2026年8月24日
更新于 2026年9月5日最后核验 2026年9月5日
12 分钟阅读

Uncensored AI 图生视频生成器:从单图到 Spicy 视频 API

比较 Wan 3、Pro、新增 Prime 与 Prime Pro 的速度定位、分辨率、首尾帧、参考输入和实时价格,选择适合的图生视频 API。
Uncensored AI 图生视频生成器:从单图到 Spicy 视频 API
核心结论图生视频的核心不是让图片动起来,而是让身份、构图与动作在时间轴上保持可用。

直接回答

这篇文章解决一个具体问题:把一张已获批的静态图变成可交付的短视频,并且身份、构图和动作在整个时间轴上保持可用。做法是先用首帧建立起点,需要可控结局时再加尾帧,用参考图、参考视频和参考音频约束风格与节奏,第一轮固定 5 秒和较低分辨率验证,通过后再提升分辨率或延长时长。Spicy 路线面向已完成年龄确认的账户,真实人物素材必须有权利与同意。

先回答搜索者真正关心的问题

一张看起来正确的图片进入视频模型后,最常见的问题是脸部和服装漂移、背景被重新设计、摄影机动作压过主体动作,或首帧与最终画面没有连续性。搜索 uncensored 图生视频的人还需要确认账户门槛与允许范围,但生产质量仍由参考图、动作说明、时长和重试策略决定。

按任务选择

五条 ModelRush 视频路线的真实差异。能力来自 Registry Operation 限制,价格见页面下方的实时价格表。
模型分辨率时长参考输入适合的阶段
Wan 3 Spicy480P / 720P / 1080P2–30 秒,或用 duration: -1 让模型决定首帧、尾帧、最多 10 张图 / 5 段视频 / 5 段音频低成本探索与大部分交付
Wan 3 Pro Spicy1080P / 2K / 4K与 Wan 3 相同的一体化工作流与 Wan 3 相同获批镜头的高分辨率最终交付
Wan 3 Prime Spicy480P / 720P / 1080P2–30 秒,或用 duration: -1 让模型决定首帧、尾帧、最多 10 张图 / 5 段视频 / 5 段音频更快迭代最高 1080P 的镜头
Wan 3 Prime Pro Spicy1080P / 2K / 4K2–30 秒,或用 duration: -1 让模型决定首帧、尾帧、最多 10 张图 / 5 段视频 / 5 段音频更快完成最高 4K 的高分辨率交付
Wan 2.7 R2V720P / 1080P2–10 秒参考素材数组(media),用参考对象而不是首帧驱动需要保留特定角色或物体,但不锁定构图

首帧和首尾帧的区别

只给首帧时,模型决定镜头去哪里。起点确定,终点由 Prompt 概率性地推断,重复运行会得到不同结局。适合探索、氛围镜头和不需要精确落点的素材。
同时给首帧和尾帧时,起点和终点都被锁定,模型只负责中间的过渡。适合需要落到指定构图的镜头:产品最终摆位、角色转向特定角度、需要接下一个镜头的连贯剪辑。代价是两张关键帧必须本身连贯——如果首尾帧的光线、服装或背景不一致,模型会在中间硬性补齐,反而更容易崩。
实践顺序是:先用首帧确认主体和动作方向能不能成立,再决定是否值得为终点补一张尾帧。先做首尾帧通常会把两个变量同时引入,很难判断问题出在哪一端。

参考图、参考视频和参考音频各自约束什么

Wan 3 的 Registry 契约允许最多 10 张参考图、5 段参考视频和 5 段参考音频,三者约束的维度不同:
  • 参考图约束外观:身份、服装、材质、色板。多给几张不同角度的图,比反复描述“同一个人”更有效。
  • 参考视频约束运动:节奏、镜头移动方式、动作幅度。当 Prompt 里的“缓慢推进”被理解成快速推轨时,一段参考视频比再改十次形容词更快。
  • 参考音频约束时间:Wan 3 支持原生音频,参考音频会影响节拍和口型对齐,而不只是配一条声轨。
三类参考都不是保证。参考越多,模型需要同时满足的约束越多,冲突的参考(例如一张白天参考图配一段夜景参考视频)会明显降低通过率。

时长、分辨率和实际成本

视频按秒计费,分辨率决定每秒单价,所以成本大致是“单价 × 时长 × 尝试次数”。真正决定预算的是第三项:如果 5 秒镜头要跑 4 次才通过,它比一次通过的 10 秒镜头更贵。
因此先用较低分辨率跑短镜头,只判断身份、构图和动作方向,再把获批的 Prompt 升到目标分辨率。Wan 3 Spicy 与 Wan 3 Prime Spicy 覆盖 480P、720P、1080P;Wan 3 Pro Spicy 与 Wan 3 Prime Pro Spicy 覆盖 1080P、2K、4K。先按交付需求选择分辨率,再决定是否为 Prime 的更快生成支付更高的每秒价格。比较相同分辨率、时长和尝试次数下的费用,并记录实际等待时间。当前各分辨率的生效价格见下方价格表。

怎么判断,而不是只看样片

  • 用人物近景、全身动作、产品旋转和复杂背景四类图分别测试。
  • 首轮固定 5 秒和较低分辨率,只判断身份、构图与动作方向。
  • 需要可控终点时使用首尾帧,不要只靠 Prompt 描述最后一帧。
  • 把每秒价格换算成每个获批镜头成本,包含无效输出和人工复核。

ModelRush 可以怎么接

  • Wan 3 Prime Spicy 适合需要更快迭代的 480P、720P 和 1080P 镜头;保留首尾帧、多模态参考、原生音频和 2–30 秒或智能时长。
  • Wan 3 Prime Pro Spicy 适合需要更快交付的 1080P、2K 和 4K 镜头,保留同样的首尾帧、参考输入、音频与时长控制。
  • Wan 3 Pro Spicy 是当前高质量图生视频路线,支持首尾帧、图像/视频/音频参考、原生音频,以及 1080P、2K 和 4K 输出。
  • Wan 3 Spicy 提供相同的一体化参考工作流和最长 30 秒时长,并以 480P、720P 或 1080P 降低探索成本。
  • 第一轮先用 Wan 3 Spicy 跑短镜头;身份、动作和构图通过后,再切到 Wan 3 Pro Spicy 完成高分辨率交付。

最小可运行请求

下面使用 modelrush/wan3-prime-spicy 生成 5 秒 720P 首尾帧视频。使用 Prime Pro 时,将 model 改为 modelrush/wan3-prime-pro-spicy,并将 resolution 设为 1080P2K4K;Prime Pro 不接受 720P。接口返回 202、generation ID 和可轮询地址;保存第一次响应,避免网络重试创建重复计费任务。
bash
curl https://api.modelrush.ai/v1/videos/generations \
-H "Authorization: Bearer $MODELRUSH_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "modelrush/wan3-prime-spicy",
"prompt": "The subject turns toward camera and the light warms, one slow push in",
"first_frame": "https://example.com/approved-still.png",
"last_frame": "https://example.com/approved-final-pose.png",
"duration": 5,
"resolution": "720P",
"ratio": "16:9",
"audio": true
}'

一条可复现的生产流程

先保存原图哈希、权利来源和人物同意,再生成 5 秒测试。Prompt 分成主体、动作、环境和摄影机四层,每次只改变一个变量。任务返回后保存 generation ID、模型、分辨率、时长、费用和审核结论。获批镜头才延长时长或提升分辨率,并通过 Webhook 或轮询同步状态。完整请求结构见 视频 API 文档

常见问题

什么时候选 Prime 或 Prime Pro?

需要更快迭代 480P、720P 或 1080P 视频时选 Wan 3 Prime Spicy;需要更快交付 1080P、2K 或 4K 时选 Wan 3 Prime Pro Spicy。两者都支持首尾帧、多模态参考、原生音频和最长 30 秒。Prime 档每秒价格高于对应的非 Prime 档,具体费用见实时价格表。

图生视频可以保持角色完全一致吗?

不能保证。参考图能提高保持率,但动作幅度、遮挡、镜头移动和时长都会增加漂移。

应该选 Wan 3 还是 Wan 3 Pro?

用 Wan 3 的 480P、720P 或 1080P 做低成本探索;需要 1080P、2K 或 4K 最终交付时使用 Wan 3 Pro。两者都支持首尾帧、多模态参考和原生音频。

Spicy 是否允许处理任何人物照片?

不允许。真实人物素材必须有明确权利与同意,未成年人和未经同意的亲密用途严格禁止。
从 5 秒测试开始,在 ModelRush 视频模型中比较真实可用率,用 Wan 3 Spicy 模型页 确认当前分辨率、时长与状态,用 图生视频 API 文档 确认异步状态与 Webhook,再决定最终分辨率和批量预算。

文中模型的当前价格

价格来自 ModelRush Registry,与实际计费使用同一个不可变价格版本。
模型能力执行 Region价格变体客户价格
Wan 2.7 R2V · modelrush/wan2.7-r2v视频生成cn-beijing1080P$0.157689 / 秒
Wan 2.7 R2V · modelrush/wan2.7-r2v视频生成cn-beijing720P$0.094614 / 秒
Wan 2.7 R2V · modelrush/wan2.7-r2v视频生成sg-singapore1080P$0.165 / 秒
Wan 2.7 R2V · modelrush/wan2.7-r2v视频生成sg-singapore720P$0.11 / 秒
Wan 3 Prime Pro Spicy · modelrush/wan3-prime-pro-spicy视频生成us-virginia1080P$0.2002 / 秒
Wan 3 Prime Pro Spicy · modelrush/wan3-prime-pro-spicy视频生成us-virginia2K$0.2156 / 秒
Wan 3 Prime Pro Spicy · modelrush/wan3-prime-pro-spicy视频生成us-virginia4K$0.2387 / 秒
Wan 3 Prime Spicy · modelrush/wan3-prime-spicy视频生成us-virginia1080P$0.2156 / 秒
Wan 3 Prime Spicy · modelrush/wan3-prime-spicy视频生成us-virginia480P$0.05236 / 秒
Wan 3 Prime Spicy · modelrush/wan3-prime-spicy视频生成us-virginia720P$0.1078 / 秒
Wan 3 Pro Spicy · modelrush/wan3-pro-spicy视频生成us-virginia1080P$0.1386 / 秒
Wan 3 Pro Spicy · modelrush/wan3-pro-spicy视频生成us-virginia2K$0.154 / 秒
Wan 3 Pro Spicy · modelrush/wan3-pro-spicy视频生成us-virginia4K$0.1771 / 秒
Wan 3 Spicy · modelrush/wan3-spicy视频生成us-virginia1080P$0.154 / 秒
Wan 3 Spicy · modelrush/wan3-spicy视频生成us-virginia480P$0.0385 / 秒
Wan 3 Spicy · modelrush/wan3-spicy视频生成us-virginia720P$0.077 / 秒
Registry 版本 · 2026-09-08.1

比较可调用模型

按能力、输入输出、价格与区域可用性把文章中的选型方法用于真实模型。

继续阅读

围绕相邻决策继续构建你的多模型技术栈。
ModelRush统一接入、智能路由、清晰计费。为开发者与 Agent 打造的模型基础设施。
© 2026 ModelRush所有系统正常