什么是 Seedance 2.5?字节跳动多模态视频模型详解
Seedance 2.5 是字节跳动的新一代视频模型。它的设计目标是接受文本、图像、视频片段和音频文件的混合输入,并返回一段连贯的视频,声音在同一次生成中一并产生。
官方开发者 API 已上线。接入侧提供文生视频、图生视频、参考生视频三个 workflow ID;账号权限、通道价格、账单、区域与配额仍需线上验证。
产品方向与 API 边界
1. 更长的单镜头工作流。 当前文档列出 4–30 秒;生产前用实际 provider 通道核对枚举与账号行为。
2. 面向生产的视频输出。 当前文档列出 480p 与 720p;产品侧 4K 展示不等于第三方 API 合约。
3. 多模态参考。 参考生视频文档列出最多 30 张图、10 个视频和 10 个音频;素材格式与真实行为仍需实测。
音频与画面一同生成,而非事后添加
Seedance 2.5 的产品材料强调声画协同生成。公共 provider 路由是否提供原生音频、使用哪个控制字段、如何计费,都必须依据该路由的实时文档核实。
它的成本
本站尚无经过核实的公开费率或计费单位。 不要从其他路由推断免费音频、按秒计费、失败任务计费或过滤选项倍率。确定预算前,请在 provider 控制台核实实时价格和真实账单记录。定价页面跟踪证据状态,playground仅用于规划。
如何访问它
官方 API 已上线。开发者和 AI agent 可以通过 REST API、三个 workflow 模型 ID 与异步任务流程调用 Seedance 2.5。API 快速上手提供可运行代码,agent 指南涵盖自动化工作流。
官方 API 已上线,接入工作流已经明确
当前已公开三个 workflow ID 与 launch 限制;本站 /openapi.json 提供创建任务与轮询结果的集成参考。开发者仍应构建 provider-neutral 任务层,把 2.5 放在 feature flag 后,并保留 Seedance 2.0 回滚。
它在同类中的定位
Seedance 系列在公开的视频生成基准测试中一直颇具竞争力,而 2.5 预计将以更长的单镜头、原生音频和更大的多模态参考额度进一步扩展这一优势。相较于 Sora 2 和 Veo 3.1 这类模型,其实际的差异化优势预计在于多参考输入和单镜头的连贯性——但请记住,这些能力都处于 通道验证 阶段。关于与该模型配合良好的 prompt 结构,请参阅 prompt 库。
简短总结
Seedance 2.5 是可用文本和多模态参考来“执导”的视频模型。官方 API 已上线,当前接入提供三个 workflow 模型 ID、4–30 秒、480p/720p 与 R2V 参考上限。请在 playground组织请求,查看服务商实时价格,并从短时测试开始。