文字或图片
从镜头描述开始,或用已确认的视觉素材锁定主体与构图。
原生 30 秒多模态制作
一次生成最长 30 秒的连续单镜头视频,支持最多 50 个全模态参考、原生 4K 与区域级局部编辑——无需拼接、无需分段。
精确线路工作区
当前控制项与实际积分以实时生成器为准,提交前请确认。
PixMind 当前输入方式
从镜头描述开始,或用已确认的视觉素材锁定主体与构图。
定义两个端点,再只描述中间的物理运动与运镜路径。
把身份、场景、动作与声音分别分配给图片、视频和音频参考。
长片段多模态线路
Seedance 2.5 在 2.0 多模态架构上扩展:更长的原生时长、商业模型中最高的参考上限,以及保持整体一致性的区域级编辑。






线路对比
下表区分 PixMind 当前线路快照与 ByteDance 模型家族能力。积分和开放控制项应在生成器中重新确认。
| 版本 | 适合任务 | 输入 | 时长 | 分辨率 | 音频 | 积分快照 |
|---|---|---|---|---|---|---|
| Seedance 2.0 Pro | 复杂多模态参考与最终候选镜头 | 文字、图片、视频和音频参考 | 5、10 或 15 秒 | 480p、720p、1080p;4K 需在实时生成器复核 | 支持音频能力 | 以实时生成器为准 |
| Seedance 2.5当前 | 原生 30 秒单段视频,支持最多 50 个全模态参考 | 文字、图片、视频和音频参考(最多 50 个) | 单段最长 30 秒 | 480p、720p、1080p、原生 4K | 支持音频能力 | 以实时生成器为准 |
| Seedance 2.0 Fast | 分镜节拍、运镜 A/B 与社媒开场测试 | 文字、图片、视频和音频参考 | 5、10 或 15 秒 | 480p 或 720p | 支持音频能力 | 以实时生成器为准 |
| Seedance 2.0 Mini | 验证参考素材、构图方向与提示词冲突 | 文字、图片、视频和音频参考 | 5、10 或 15 秒 | 480p 或 720p | 支持音频能力 | 以实时生成器为准 |
| Seedance 1.5 Pro | 已有图生提示词与受控迁移测试 | 当前响应为文字或最多两张图片 | 接口字段存在冲突,以实时生成器为准 | 480p、720p 或 1080p | 支持音频能力 | 接口快照为 40 积分;以实时生成器确认 |
1.5 Pro 接口响应列出 40 积分,但时长字段存在冲突;已核验接口快照未为 Pro、Fast、Mini 提供稳定积分字段。
测试后重点观察
使用主体完整、边缘干净、层次清晰并为预期运动留出空间的图片。
分开描述主体动作与相机运动,避免在一个短镜头中堆叠多个大幅变化。
当镜头需要多模态参考、首尾帧或更明确的音频导演时再迁移到 2.0 Pro。
如何使用这个版本
给每个图、视频、文字或音频输入一个明确职责(身份、形状、动作、色彩或节奏)。
在加入复杂运动前,固定身份、服装、道具、视线方向与结尾构图。
每次只编辑一个区域,并在完整视频中复核身份、结构、光影与时序。
提交前在实时生成器查看所选时长与分辨率的当前积分。
版本专属提示词

提示词 01
利用完整原生时长做一次连续展示。
One continuous 30-second take. Use @Image 1 for exact product shape and @Image 2 for the studio palette. Slow controlled orbit around the product, one subtle environmental interaction at the midpoint, finish on the approved hero composition. Preserve shape, material, ports, and color. No generated text.

提示词 02
跨参考协调身份、动作与声音。
Keep the character from @Image 1 unchanged. Use @Video 1 only for the body motion and @Audio 1 for the ambient rhythm. The character walks through the station, pauses, and looks toward the exit. Preserve facial features, wardrobe, and left-to-right screen direction.

提示词 03
只改一个区域,不重新生成整段。
Keep the full clip motion, lighting, and identity fixed. Only replace the background product on the right shelf with the object in @Image 2, matching perspective, scale, and reflections. Do not alter the subject or camera path.
原生最长 30 秒单镜头视频、最多 50 个全模态参考(图、视频、文字、音频)、保持一致性的区域级编辑,以及原生 4K 输出。
2.0 生成 5–15 秒片段、最多 9 个参考;2.5 将单段时长延长到 30 秒、参考上限提升到 50,并新增区域级编辑。
在一次请求中传入最多 50 个图、视频、文字与音频输入,给每个一个明确职责,删除职责冲突的素材。
可以。区域级编辑可改变特定区域,其余画面保持动作、光影与身份。每次只编辑一个区域,并每次复核完整视频。
单段最长 30 秒,分辨率最高原生 4K。提交前请在实时生成器确认精确选项。
价格尚未公布。提交前在实时生成器查看所选时长与分辨率的当前积分。
会。统一音视频架构在所选模式支持时,于同一任务生成同步音频。发布前仍需复核语音、口型、声源匹配、失真与时序。
逐帧检查完整视频中的身份、脸部、手部、产品结构、文字、商标、连续性、对白与声音时序,并确认每个人物、品牌、声音、图片、视频和音频素材的使用权。
下一步制作决策
返回模型家族中心查看线路选择、当前参数说明与迁移指引。