硬核横评
硬核横评

30秒俱乐部开战:可灵4.0、Seedance 2.5谁值得等

四款视频模型横评(2026-10-03 口径,与本站 8 月五款闭源云端横评、Seedance 2.5 vs MiniMax H3 对垒篇分工互补不重测):以「单段 30 秒原生直出已成头部标配」为切入,按云端旗舰/现役标杆/云端性价比/开源自部署四象限选可灵 4.0(10 月上线,10-bit HDR、续拍 2 分钟、15 项参考,规格拉满未验证)、Seedance 2.5(已上线,30 秒直出 + 50 项参考 + 1 秒内局部编辑,徐工/小鹏/微分智飞生产落地)、Wan3.0(8 月 24 日上线,API 每秒 0.3 元起、五种办公文档直传变视频,无 Agent 能力需自做编排)、LTX-2.5(唯一开放权重,66GiB + 8 步蒸馏 + ltx-trainer,自定义社区许可收入门槛 1000 万美元)。无压测数据不做「谁第一」仲裁,按需求给结论:现成旗舰选 Seedance、规格派等可灵、性价比与批量选 Wan3.0、数据私有选 LTX-2.5。Sora 因信源矛盾不入场,Veo 未做一手核真不写。

发布于 2026年10月3日10 分钟阅读
<!-- video-model-open-vs-cloud-comparison-review | review | 30秒俱乐部开战:可灵4.0、Seedance 2.5谁值得等 -->

一、30 秒成了入场券:为什么是这四款

先交代分工:本站 8 月已有两篇视频模型对比,一篇是 AI 视频生成横评 2026-08,把 Sora 停服倒计时、Veo 3.1、可灵 3.0、即梦、Runway 五款闭源云端摆在一起;另一篇是 Seedance 2.5 vs MiniMax H3,拆的是 7 月 31 日同日双发的两条路线。本篇不重复那两篇的活,换一个切入点:到 2026 年 10 月,「单段 30 秒原生直出」已经从少数玩家的招牌变成头部模型的标配,选型的重心从「能不能一次生成一条完整成片」转向「哪一款的 30 秒更适合你的活」。

按「云端旗舰、现役标杆、云端性价比、开源自部署」四个象限,本篇选了四款代表当前格局的模型:可灵 4.0(快手,云端旗舰新王候补,尚未正式上线)、Seedance 2.5(字节跳动,已上线的现役标杆)、Wan3.0(阿里云,云端性价比,8 月 24 日正式上线)、LTX-2.5(Lightricks,四款里唯一可以自部署的开放权重路线)。时点统一为 2026-10-03。

边界先说清:本文所有对比基于官方公告、官方文档与媒体报道整理,非亲自压测。没有压测数据,本篇不做「谁是第一」的仲裁,只在各象限内说明射程,最后按需求给结论。涉及价格处均标注快照口径,以官方页面为准。另有两款常被问到的模型不在场:Sora 因各方信源不一不在本篇展开(本站 8 月横评已有既立口径),Veo 现行版本未做一手核真,同样不写。

二、规格对比表:四款横向看

维度可灵 4.0(快手)Seedance 2.5(字节)Wan3.0(阿里云)LTX-2.5(Lightricks)
上线状态10 月上线,以下为官方公布规格2026-07-31 已上线2026-08-24 正式上线权重已开放(自定义社区许可)
单段时长最长 30 秒,续拍可延至 2 分钟30 秒原生直出,多轮延长2 至 30 秒可指定管线决定,默认 24fps 输出
参考素材最多 15 项(10 图 + 5 视频 + 7 主体)最多 50 项(30 图 + 10 视频 + 10 音频)文档直传(doc/xls/ppt/pdf/md)关键帧、IC-LoRA 等条件管线
编辑能力视频精准编辑、多关键帧局部编辑,时间戳精度 1 秒内自然语言加时间戳分镜Retake 局部重生成、DubIt 配音
开源自部署否否否是,66GiB 权重可自部署
价格口径未公布以官方发布稿口径为准API 每秒 0.3 元起(8 月快照)权重免费,商用收入门槛 1000 万美元
适合谁等大场面与专业规格的团队现在就要长叙事成片的创作者预算敏感的批量生产有 GPU 且要数据私有的团队

表里最值得盯的一行是「上线状态」:四款里只有两款是当下就能完整使用的,另两款一个在倒计时、一个要自己动手。这决定了后面四个小节的读法——已上线的看表现,未上线的看规格,开放权重的看门槛。

三、云端旗舰候补:可灵 4.0,规格拉满但还没开门

可灵 4.0 是四款里唯一还没正式上线的。据可灵官方公告与媒体报道(上海证券报、财联社等 9 月底报道),可灵 4.0 于 9 月 28 日官宣,定档 10 月正式上线;同日轻量版可灵 4.0 Flash 向黑金年卡会员开放小范围体验。所以这一节的正确读法是:规格先摆出来,判断等上手之后再做。

先看官方公布的规格:支持 4K 与 1080p 的 10-bit HDR 格式输出;单次生成视频最长 30 秒;多次续拍最长可延展至 2 分钟;提示词输入上限提升至 8000 tokens。多模态参考最多 15 项,单次可组合 10 张图片、5 段视频、7 个主体。语言侧覆盖中英日韩西葡德法印地等多语种及方言口音,配套口型匹配、文字生成与多关键帧。创作页面同步升级:一体化输入框、宫格与列表双布局、时间线连续创作、全新画布 Agent 体验。

把这些规格和现役产品对位,可灵 4.0 押的是「专业级规格」:10-bit HDR 和 2 分钟续拍瞄准的是影视制作与广告投放链路,8000 tokens 的提示词上限则是给多镜头脚本一次性喂满留的空间。竞争背景媒体也写得直白:其直面 Seedance 2.5 七月上线后的竞争压力;花旗维持快手中性评级,关注点正是能否分流 Seedance 用户群与商用定价性价比。定价尚未公布,本篇不做猜测;上海证券报记者观察提到外界初步评价较为平淡,本篇同样不对未上线产品下判断。想跟进上线动态可读本站热点篇 可灵4.0官宣10月上线,届时上手路径可参考 可灵AI怎么用。

四、现役标杆:Seedance 2.5,长叙事成片的默认选项

如果只看「现在就能用」的长叙事能力,Seedance 2.5 是名单里最稳的一行。按官方发布稿口径:2026 年 7 月 31 日正式发布,同步上线豆包专业版与即梦,近期经火山引擎向企业用户开放。核心三项:单段 30 秒原生直出加多轮延长;最多 50 个多模态参考素材,单次可组合 30 张图、10 段视频、10 段音频,白模与绿幕参考也在支持范围;局部编辑覆盖背景、商品与人物,时间戳精度控制在 1 秒以内。语言侧支持 10 余种语言的口型与语速同步;即梦侧的超长生成模式最长可到 3 分钟,另有 Maya 与 Blender 插件接入专业工作流。

落地证据比参数更有说服力:徐工用它做工业培训 SOP 视频,小鹏把它接进设计平台,微分智飞拿它产具身智能训练数据。这些案例指向同一点:30 秒原生直出已经进入生产环境,不再是发布会演示。需要说明的是,Seedance 2.5 未开源,走闭源的 API 与产品交付;开源权重是另一条线的事,别把它和本篇的 LTX-2.5 或对垒篇里的 MiniMax H3 混淆。

五、云端性价比:Wan3.0,把 30 秒打到每秒 3 毛的报价单

Wan3.0 是四款里性价比叙事最清晰的一行,事实以站内既立口径与阿里云百炼官方文档为准:2026 年 8 月 24 日正式上线,单段最长 30 秒,可指定 2 到 30 秒整数时长。差异化入口在输入端:首次支持 doc、xls、ppt、pdf、md 五种办公文档直接上传生成,一份产品介绍 PPT 可以直接变成一条 30 秒宣传片,对企业用户是实打实的工作流简化。文生视频、图生视频(首帧与首尾帧)、参考生视频三条路都通,多镜头分镜可用自然语言加时间戳描述。

价格是它最锋利的部分(8 月下旬快照口径,以官方页面为准):阿里云百炼 API 按秒计费,480P 每秒 0.3 元、720P 每秒 0.6 元、1080P 每秒 1.2 元,一条 30 秒 720P 成片原价 18 元。首发期 7 折活动覆盖到 9 月 23 日,本篇截稿时已结束,按原价估算即可。边界也要写清:按阿里云开发者社区文档,它不支持 Function Calling、联网搜索与批量推理,调用需异步提交,定位是按秒计费的生成引擎而非 Agent,工作流编排要自己在上层完成。细节可读本站 Wan3.0 正式上线 一文。

六、开源自部署:LTX-2.5,唯一能拉到自己 GPU 上的选项

四款里只有 LTX-2.5 提供开放权重,这也是它在象限图上单独占一格的原因。能力按 GitHub 仓库 README 口径:LTX-2 是首个 DiT 架构的音视频一体基础模型,画面与同步音频一次生成;推荐版本 LTX-2.5 的蒸馏 transformer 为 22B(bf16 safetensors),配套定制版文本编码器、视频与音频 VAE、空间与时间上采样器,全套权重约 66GiB。推理效率是招牌:DistilledPipeline 仅 8 个预设 sigma,蒸馏版 8 步起步即可出片;默认输出 1024x1536 24fps,4K 档为 3840x2176。12 条管线覆盖生产链路:关键帧插值、IC-LoRA 视频条件生成、Retake 局部时间段重生成、DubIt 换词配音并保持口型与说话人身份、原生 EXR 与 HDR 等。想微调,官方 ltx-trainer 包支持 LoRA、全量微调与 IC-LoRA,ComfyUI 有官方插件。

门槛与许可必须如实写:它不是 OSI 认证开源,而是自定义的 LTX Community License。个人非商业用途免费,商业实体的测试评估也豁免;但年收入达到 1000 万美元的实体任何商用都须向 Lightricks 购买商用协议,衍生品(含微调权重与 LoRA 适配器)分发时必须随附同条款协议。自部署还意味着你得自备装得下 66GiB 权重的 GPU 资源。换来的是另外三款给不了的东西:数据不出内网、可离线推理、可按业务微调。开源细节可读本站 LTX-2 开源 一文。

七、按需求给结论

没有压测数据,本篇不做「谁是第一」的仲裁,把结论挂在需求上。

要现成的云端旗舰,选 Seedance 2.5。 它是四款里唯一已上线且把 30 秒长叙事、50 项参考、1 秒内局部编辑全部跑通的,落地案例在生产环境可查。要「今天就出片」,它是最短路径。

要追专业规格与大场面,等可灵 4.0 但别空等。 10-bit HDR、2 分钟续拍、8000 tokens 提示词确实瞄准影视与广告链路,但它尚未上线、定价未公布,官方口径之外的表现没有验证。建议排进观察名单,上线后再用真实项目验证。

要性价比与批量生产,选 Wan3.0。 每秒 0.3 元起的按秒计费加文档直传,是四款里对企业批量场景最友好的报价单,代价是没有 Agent 能力、需自己做工作流编排。

要数据私有可自部署,选 LTX-2.5。 唯一开放权重的选项,8 步蒸馏降低推理门槛、ltx-trainer 支持微调,适合有 GPU 资源且对数据合规有硬要求的团队。记住许可前提:个人非商业免费,年收入 1000 万美元以上的商用要买协议。

八、常见问题

**Q1:**可灵 4.0 现在能用吗? A:不能完整使用。据可灵官方公告与媒体报道,它定档 10 月正式上线,目前仅轻量版 4.0 Flash 向黑金年卡会员开放小范围体验。本文涉及可灵 4.0 的规格均为官方公布口径,实际表现以上线后为准。

**Q2:**四款里哪款真正开源? A:只有 LTX-2.5 提供开放权重,且注意它是自定义社区许可而非 OSI 认证开源:个人非商业免费,年收入 1000 万美元以上的实体商用须购买协议。可灵 4.0、Seedance 2.5、Wan3.0 均为闭源云端交付。

**Q3:**四款说的「30 秒」是同一个意思吗? A:不完全是。Seedance 2.5 与可灵 4.0 都是单段最长 30 秒,前者已可用、后者待上线;Wan3.0 是 2 到 30 秒可指定;LTX-2.5 的单段时长由管线与显存决定。另外可灵 4.0 有续拍延展至 2 分钟的路径,Seedance 2.5 在即梦侧有最长 3 分钟的超长生成模式,两者都不是「单段 30 秒」的直接对位。

**Q4:**预算有限的团队选哪款? A:批量生产场景优先看 Wan3.0,API 每秒 0.3 元起(480P,8 月快照口径),一条 30 秒 720P 原价 18 元。有 GPU 且愿意自己运维的团队可把 LTX-2.5 算进成本模型:权重免费,但显存、运维与许可门槛要折进去。

**Q5:**这些价格是最终价吗? A:不是。本文所有价格均为快照口径:Wan3.0 为 8 月下旬百炼页面快照,可灵 4.0 定价尚未公布,LTX-2.5 的门槛数字来自许可条款文本。签约前一律以官方页面为准。

互动

你在用 30 秒俱乐部里的哪一款?是等可灵 4.0 的 HDR 规格,还是已经用 Seedance 2.5 在交付、拿 Wan3.0 跑批量、或者已经把 LTX-2.5 拉到了自己的 GPU 上?评论区聊聊你的选型理由和使用中踩过的坑,高频问题会进后续更新。觉得有用的话,转给正在选型的同事。

本文由 AI 辅助生成,经人工审核编辑。最后更新:2026-10-03

常见问题

可灵 4.0 现在能用吗?
A:不能完整使用。据可灵官方公告与媒体报道,它定档 10 月正式上线,目前仅轻量版 4.0 Flash 向黑金年卡会员开放小范围体验。本文涉及可灵 4.0 的规格均为官方公布口径,实际表现以上线后为准。
四款里哪款真正开源?
A:只有 LTX-2.5 提供开放权重,且注意它是自定义社区许可而非 OSI 认证开源:个人非商业免费,年收入 1000 万美元以上的实体商用须购买协议。可灵 4.0、Seedance 2.5、Wan3.0 均为闭源云端交付。
四款说的「30 秒」是同一个意思吗?
A:不完全是。Seedance 2.5 与可灵 4.0 都是单段最长 30 秒,前者已可用、后者待上线;Wan3.0 是 2 到 30 秒可指定;LTX-2.5 的单段时长由管线与显存决定。另外可灵 4.0 有续拍延展至 2 分钟的路径,Seedance 2.5 在即梦侧有最长 3 分钟的超长生成模式,两者都不是「单段 30 秒」的直接对位。
预算有限的团队选哪款?
A:批量生产场景优先看 Wan3.0,API 每秒 0.3 元起(480P,8 月快照口径),一条 30 秒 720P 原价 18 元。有 GPU 且愿意自己运维的团队可把 LTX-2.5 算进成本模型:权重免费,但显存、运维与许可门槛要折进去。
这些价格是最终价吗?
A:不是。本文所有价格均为快照口径:Wan3.0 为 8 月下旬百炼页面快照,可灵 4.0 定价尚未公布,LTX-2.5 的门槛数字来自许可条款文本。签约前一律以官方页面为准。

相关文章

硬核横评

半价与两折:旗舰平替编程模型洗牌,谁最值?

旗舰平替性价比横评(2026 年 10 月时点):Claude Sonnet 5.5(官方口径经机器之心转述:速度提升 30% 以上、Terminal-Bench 4.0 从 10.3% 升至 70.6%、价格为 Opus 5.5 一半) vs GPT-6.1 Sol(官方口径经量子位转述:智能接近 GPT-6 Astra、API 价格仅 1/5、Ultrafast 付费提速档) vs Claude Opus 5.5(参照系,$4/$20 每百万 tokens) vs DeepSeek V4.1(开源参照系,权重开放)。口径纪律:各家 harness 不同不可横比,本文只做相对自家旗舰的相对值比较,不自行跑分;Sonnet 5.5 具体美元定价官方未公布,不自行换算。四条场景结论:预算敏感日常编程、要旗舰上限的复杂任务、要私有部署的合规场景各有所归。与站内 2026-08 综合横评、旗舰推理横评分工互补。

2026年10月1日10 分钟阅读
硬核横评

终端里养一支工程队:五款命令行编程 agent 横评

本篇只比"终端编码代理"这一形态,不比谁的模型更聪明:横向对比 MiniMax Code CLI、Claude Code、Codex CLI、Qwen Code 与 Gemini CLI 七个维度(安装、无头与 CI、模型自由度 BYOK、权限与沙箱、扩展面、开源许可、计费模式),仓库数字统一取 2026-09-20 GitHub API 快照。核心发现:模型自由度是最大分野,五款里只有 MiniMax 与 Qwen Code 支持 BYOK 到别家厂商;沙箱做得最实的是 Codex CLI 的 full-auto 断网加目录围栏;Claude Code 扩展面最成熟但闭源且只吃自家模型。文末给个人日常、无人值守 CI、企业合规、换模省钱四类场景的选型账,并点出上下文可读性、权限误判、模型锁定三项共性弱点。

2026年9月20日8 分钟阅读