Texte ou image
Commencez par un bref plan ou utilisez une ancre visuelle approuvée pour le sujet et la composition.
Native 30-second multimodal production
Generate continuous single-shot video up to 30 seconds in one pass, with up to 50 multimodal references, native 4K, and region-level editing — no stitching, no sequence breaks.
Espace de travail d'itinéraire exact
Les contrôles actuels et les crédits chargés proviennent du générateur en direct. Confirmez-les avant de les soumettre.
Entrées PixMind actuelles
Commencez par un bref plan ou utilisez une ancre visuelle approuvée pour le sujet et la composition.
Définissez les deux points de terminaison, puis décrivez uniquement le mouvement physique et le chemin de la caméra entre eux.
Attribuez une identité, un décor, un mouvement et un son pour séparer les références image, vidéo et audio.
Long-form multimodal route
Seedance 2.5 extends the 2.0 multimodal architecture: longer native duration, the highest reference limit among commercial models, and region-level editing that preserves overall consistency.
01
Direct a continuous 30-second take in one generation instead of stitching multiple 5–15s clips.

02
Combine up to 50 image, video, text, and audio inputs to control characters, scenes, style, and sound together.

03
Change a product, prop, or background area while the rest of the clip keeps its motion, lighting, and identity.

04
Output crisp 4K natively for large displays, product films, and high-DPI social.

05
Keep identity, eyelines, and lip-sync stable while directing a 30-second performance with linked room sound.

06
Test opening beats as controlled variants while preserving the same product, palette, and final packshot.

Comparaison d'itinéraire
Le tableau sépare l'instantané actuel de l'itinéraire PixMind des revendications au niveau de la famille ByteDance. Les crédits et les contrôles exposés doivent être revérifiés dans le générateur.
| Version | Idéal pour | Entrées | Durée | Résolution | Audio | Aperçu du crédit |
|---|---|---|---|---|---|---|
| Seedance 2.0 Pro | Références multimodales complexes et prises finales sélectionnées | Références texte, image, vidéo et audio | 5, 10 ou 15 secondes | 480p, 720p, 1080p ; 4K nécessite une vérification en direct | Itinéraire audio | Lire à partir du générateur en direct |
| Seedance 2.5Actuel | Native 30-second single-shot video with up to 50 multimodal references | Text, image, video, and audio references (up to 50) | Up to 30 seconds in a single shot | 480p, 720p, 1080p, native 4K | Itinéraire audio | Lire à partir du générateur en direct |
| Seedance 2.0 Fast | Rythmes du storyboard, tests A/B des caméras et accroches sociales | Références texte, image, vidéo et audio | 5, 10 ou 15 secondes | 480p ou 720p | Itinéraire audio | Lire à partir du générateur en direct |
| Seedance 2.0 Mini | Test de l'ajustement des références, de la composition et des conflits d'invites | Références texte, image, vidéo et audio | 5, 10 ou 15 secondes | 480p ou 720p | Itinéraire audio | Lire à partir du générateur en direct |
| Seedance 1.5 Pro | Invites basées sur des images existantes et tests de migration contrôlés | Texte ou jusqu'à deux images dans la réponse actuelle | Le générateur live est définitif ; Conflit de champs API | 480p, 720p ou 1080p | Itinéraire audio | Instantané d'API en 40 points ; confirmer en direct |
La réponse 1.5 Pro rapporte 40 points, mais ses champs de durée sont en conflit. Pro, Fast et Mini n’exposent pas de champ de points stables dans l’instantané du point de terminaison vérifié.
Que regarder après le test
Utilisez un sujet complet, des bords nets, une profondeur lisible et suffisamment d'espace pour le mouvement demandé.
Séparez l’action du sujet du mouvement de la caméra et évitez d’empiler plusieurs changements importants en un seul plan court.
Passez à 2.0 Pro lorsque la prise de vue nécessite des références multimodales, des première/dernière images ou une direction audio plus explicite.
Comment utiliser cette version
Give every image, video, text, or audio input a single explicit role (identity, shape, motion, palette, or rhythm).
Fix identity, wardrobe, props, screen direction, and the ending composition before adding complex motion.
Edit one region per pass and review identity, geometry, lighting, and timing in the full clip each time.
Read the live generator for the current credits at the chosen duration and resolution before submitting.
Invites spécifiques à la version

Invite 01
Use the full native duration for one continuous reveal.
One continuous 30-second take. Use @Image 1 for exact product shape and @Image 2 for the studio palette. Slow controlled orbit around the product, one subtle environmental interaction at the midpoint, finish on the approved hero composition. Preserve shape, material, ports, and color. No generated text.

Invite 02
Coordinate identity, motion, and sound across references.
Keep the character from @Image 1 unchanged. Use @Video 1 only for the body motion and @Audio 1 for the ambient rhythm. The character walks through the station, pauses, and looks toward the exit. Preserve facial features, wardrobe, and left-to-right screen direction.

Invite 03
Change one area without re-generating the shot.
Keep the full clip motion, lighting, and identity fixed. Only replace the background product on the right shelf with the object in @Image 2, matching perspective, scale, and reflections. Do not alter the subject or camera path.
Pro
Quality-first multimodal video with reference and audio control.
Voir la versionPro
Native 30-second single-shot video with up to 50 multimodal references, 4K output, and region-level editing.
Fast
La voie Seedance 2.0 plus rapide pour les workflows sociaux, de campagne et de prévisualisation à forte itération.
Voir la versionMini
Une option Seedance 2.0 plus légère pour tester des idées multimodales avant de s'engager dans un rendu axé sur la qualité.
Voir la versionPro
Une option image-vidéo éprouvée avec de larges formats d'image et un contrôle de résolution pour des prises de vue simples basées sur des références.
Voir la versionNative single-shot video up to 30 seconds, up to 50 multimodal references (image, video, text, audio), region-level editing that preserves consistency, and native 4K output.
2.0 generates 5–15s clips with up to 9 references; 2.5 extends single-shot duration to 30 seconds, raises the reference limit to 50, and adds region-level editing.
Pass up to 50 inputs across image, video, text, and audio in one request. Give each a single explicit role and remove assets that compete for the same property.
Yes. Region-level editing lets you change a specific area while the rest of the clip keeps its motion, lighting, and identity. Edit one region per pass and review the full clip each time.
Single-shot clips up to 30 seconds and resolutions up to native 4K. Confirm the exact options in the live generator before submitting.
Pricing is not yet published. Read the live generator for the current credits at your chosen duration and resolution before submitting.
Yes. The unified audio-video architecture generates synchronized audio in the same task when the selected mode supports it. Review speech, lip movement, source matching, distortion, and timing before publishing.
Review identity, faces, hands, product geometry, text, logos, continuity, dialogue, and audio timing frame by frame across the full clip. Confirm rights for every uploaded person, brand, voice, image, video, and audio asset.
Prochaine étape de production
Return to the family hub for route selection, current parameter notes, and migration guidance.