如果项目必须在 30 秒内讲完一段完整故事,先测 Seedance 2.5 或 Wan 3.0;如果硬要求是 4–15 秒、最高 2K、原生立体声,或要研究本地 Base 权重,MiniMax H3 更像第一候选。两条 30 秒路线也不是同一种工具:Seedance 2.5 把大量混合参考与时间段修改放在中心,Wan 3.0 则把文档、网页、图片、视频、音频统一放进一个创作入口。
这不是画质排行榜。三家公开的是不同产品合同和精选样片,没有统一输入、输出、次数与人工挑选规则。真正能回答“哪个更适合你”的,是一条最难交付镜头在相同预算下能否通过。
一眼决定先测谁
| 你的硬约束 | 更合理的首测模型 | 原因 | 先确认的风险 |
|---|---|---|---|
| 单次需要 16–30 秒,参考素材很多,还要按时间段修改 | Seedance 2.5 | 最长 30 秒,官方列出 30 图、10 视频、10 音频与时间戳编辑 | 当前入口、地区、API 路线和实际可用参数 |
| 4–15 秒短片要最高 2K、原生立体声,或要控制 Base 权重 | MiniMax H3 | 官方列出最高 2K、原生立体声,并已发布 Base 权重 | Community License、显存/算力,以及 2K regeneration 路线 |
| 30 秒项目需要把文档、网页或多类素材直接作为输入 | Wan 3.0 | 官方列出 30 秒、1080P、原生音画和 File/Link 等输入 | 阿里云区域、账号权限、preview/正式服务状态 |
| 只想知道谁的成片“最好看” | 三个都先别定胜负 | 厂商样片不能建立同条件质量排名 | 用自己的高风险镜头做小样 |
这里的“先测”不是最终采购建议。它只是把第一轮预算放到最有可能满足硬约束的路线,尽早淘汰不合适的合同。
三个模型真正不同的地方
Seedance 2.5:把复杂参考和后续修改当作主要工作
ByteDance Seed 的正式发布说明写明,Seedance 2.5 单次最长 30 秒,并支持多轮延长;一次可以输入最多 30 张图片、10 段视频和 10 段音频。它还强调按时间戳控制生成和对特定片段做定点修改。
因此,Seedance 2.5 的价值不只是“长”。当人物、道具、场地、动作参考和音乐节奏要一起进入同一镜头,而且客户很可能要求“只改第 12–16 秒的动作,不动前后”,这套合同更贴近后期沟通方式。
截至 2026 年 8 月 28 日,BytePlus 文档已经列出 dreamina-seedance-2-5-260628,支持 4–30 秒以及文字、图像、视频、音频输入。具体请求与计费仍应以当前 BytePlus 增强视频生成文档为准;有输入视频时,计费口径可能同时包含输入和输出时长。需要分清不同入口,可先看本站的 Seedance 2.5 入口与 API 状态。
MiniMax H3:短片、2K 与可控部署路线更突出
MiniMax 的官方 H3 发布页把上限写为 15 秒、最高 2K,并包含原生立体声音频。模型可理解文字、图片、视频和音频组成的上下文,适合短广告、产品画面、带对白或音效的紧凑镜头。
H3 还有另外两款没有的部署讨论空间。MiniMax 在 8 月 3 日发布了 H3 Base 权重,并给出多种推理框架以及与官方 2K regeneration/API 组合的示例。这意味着团队可以研究本地服务、定制与数据边界,但不意味着“下载后免费获得完整 2K 云端体验”。
更不能把厂商所说的 open source 理解为无限制商用。权重适用 MiniMax H3 Community License;正式上线前应核对地域、用途限制、下游条款、硬件成本和 2K 再生成依赖。
Wan 3.0:把更多业务素材直接变成视频输入
阿里云的 Wan 3.0 发布页面列出单次 30 秒、1080P、原生音画和统一创作入口。除了文字、图片、视频、音频,它还强调文档与网页输入:当需求从产品页、提案、表格或活动资料开始,而不是从一条整理好的 prompt 开始,这种输入面可能减少前置转写。
阿里云帮助中心把模型标识为 wan3.0-video,输出为 Video,支持 480P、720P 和 1080P。这个事实只属于阿里云百炼路线;第三方同名模型是否保留输入类型、画质、音频、限额和失败计费,需要逐家验证。
Wan 3.0 的 30 秒与 Seedance 2.5 的 30 秒也不能只看数字。前者更值得用“杂乱业务材料能否直接收敛成镜头”去试,后者更值得用“复杂参考和时间段修改是否减少返工”去试。
不要用“同一句 prompt”制造假公平
一模一样的文字 prompt 看起来公平,实际可能惩罚擅长不同输入的模型。更可靠的做法是先固定同一份创作 brief,再分两轮:

- 共同能力轮:只使用三者都接受的素材,固定目标时长、比例、输出档、是否音频和最多尝试次数。
- 差异能力轮:允许 Seedance 使用更大的参考集、H3 使用本地/Base 路线、Wan 使用文档或网页,但把额外准备时间和费用记入结果。
测试镜头应选真正会让项目失败的部分,例如多人同框换位、商品文字、人物说话、首尾构图、连续运镜或严格节拍,而不是最容易生成的风景镜头。
每次生成只记录会改变交付的结果:
- 人物、商品、文字和空间关系是否保持;
- 动作、口型、声音和镜头节奏是否满足 brief;
- 是否能局部修正,还是必须整段重做;
- 第几次得到可交付版本;
- 总生成费、等待时间和人工修正时间。
成本要算到“客户接受”为止
按秒价格不能单独决定性价比。一个便宜结果如果需要八次重抽,可能比一次命中的高价路线更贵;能生成 30 秒也不代表 30 秒都可用。
用这个口径更接近真实预算:
每条获批镜头成本 = 全部生成费用 + 人工准备/修正成本 + 失败等待成本

如果输入视频也参与计费,要把参考素材时长纳入。若使用本地 H3,则把 GPU 租用、模型下载、运维和 2K regeneration/API 调用分开记录。不要把云端标价与自托管硬件账单塞进同一列。
最稳妥的选择结论
- 需要长叙事、大量混合参考和按时间段返修:先测 Seedance 2.5。
- 需要短片 2K、原生立体声或研究可控 Base 权重:先测 MiniMax H3。
- 需要 30 秒原生音画,并希望把文档、网页和多类业务素材直接交给模型:先测 Wan 3.0。
- 质量是唯一关键,而你没有同条件样片:不要按文章结论采购,先做一条高风险镜头。
三款模型都足以进入候选池,但只有你的素材、交付标准和重试预算能决定最终 owner。先用最小测试暴露合同差异,再扩大产量,比追逐一个脱离场景的“最强模型”更便宜。



