Vidéos continues de 30 secondes
Le double de Seedance 2.0. Une histoire complète en un seul rendu, sans segments collés ni ruptures de continuité.


Présenté à la conférence FORCE 2026 de Volcano Engine, Dreamina Seedance 2.5 génère des vidéos cinématographiques continues jusqu'à 30 secondes, accepte jusqu'à 50 références multimodales et monte ou prolonge des vidéos existantes avec du texte seul. Ce guide condense la documentation officielle — modes de création, syntaxe des prompts, limites techniques et tarifs sur DXBuilder.
Seedance 2.5 est un modèle de génération vidéo par IA axé sur la narration longue, la référence multimodale et le montage précis. En un seul appel, il génère une histoire complète de 30 secondes avec une physique réaliste, un rendu cinématographique et un son synchronisé — ou prend une de vos vidéos pour la transformer, la prolonger ou la réparer. C'est le moteur phare du studio Seedance 2.5 de DXBuilder. → Studio
Le double de Seedance 2.0. Une histoire complète en un seul rendu, sans segments collés ni ruptures de continuité.
Jusqu'à 30 images + 10 vidéos + 10 audios en une seule requête. Garde personnages, produits, logos et styles cohérents entre les scènes.
Remplacez le protagoniste, ajoutez ou supprimez des objets, réparez des zones de l'image ou changez la bande-son — avec du texte seul.
Prolongez n'importe quelle vidéo vers l'avant ou l'arrière, avec des transitions naturelles et une cohérence de lumière et de mouvement.
Voix avec lip-sync précis, effets sonores et musique générés en parallèle de l'image — sans post-production.
Prompts et dialogues parlés en français, anglais, portugais, espagnol, japonais, coréen, arabe et plus — avec synchronisation labiale.
| Capacité | Seedance 2.5 | Seedance 2.0 |
|---|---|---|
| Durée maximale par rendu | 30 secondes | 15 secondes |
| Références multimodales | 50 (30 img + 10 vidéo + 10 audio) | 15 (9 img + 3 vidéo + 3 audio) |
| Référence audio seule (sans image) | ✓ Pris en charge | ✗ Exige image/vidéo |
| Format de sortie | MP4 et MOV (chroma 4:4:4) | MP4 uniquement |
| Durée totale des réfs vidéo/audio | 30 secondes | 15 secondes |
| Planification pré-génération (white-model 3D) | ✓ | ✗ |
| Compréhension de l'intention cinématographique | Très supérieure (cadrage, langage de caméra) | Basique |
Le moteur classe chaque requête dans l'un des six types de tâche selon les références téléversées et les mots du prompt. Les modes de montage, extension et frames ont des contraintes obligatoires de format et de durée — les respecter évite les erreurs de génération.
Comment l'activer : Il ne faut qu'un prompt — aucun fichier.
Règles : Sans restrictions : choisissez librement le format (16:9 … 9:16) et la durée (4–30s).
"Un drone FPV plonge entre les gratte-ciel sous la pluie, néons reflétés sur l'asphalte. <pluie et moteurs> (synthwave)"
Comment l'activer : 1 image comme frame de départ + un prompt décrivant le mouvement.
Règles : Le format s'aligne automatiquement sur l'image (adaptive). Durée libre 4–30s.
"La personne de l'image prend vie : elle sourit et ses cheveux bougent dans la brise, caméra en orbite à 360°."
Comment l'activer : 2 images : la première et la dernière de la vidéo. Le moteur interpole la transition.
Règles : Format hérité du premier frame (adaptive). Durée libre 4–30s.
"Transition cinématographique du premier au dernier frame avec particules de lumière et physique réaliste."
Comment l'activer : Combinez jusqu'à 30 images (@Image1…), 10 vidéos (@Video1…) et 10 audios (@Audio1…).
Règles : Format et durée libres. ⚠ Évitez les mots comme « monter » ou « continuer » dans le prompt — le moteur peut reclasser la tâche et renvoyer une erreur.
"Reference @Image1 for the character. Le personnage traverse un marché nocturne, mouvement de caméra de @Video1."
Comment l'activer : Téléversez une vidéo et utilisez des mots déclencheurs : monter, ajouter, supprimer, remplacer, modifier.
Règles : Format : adaptive uniquement (garde celui de la vidéo). Durée : automatique (≈ identique à l'originale, tolérance 0,4s). La vidéo d'entrée doit durer 4–30s. La durée de la vidéo téléversée compte dans la facturation.
"Video edit: remove everyone in @Video1 except the protagonist."
Comment l'activer : Téléversez une vidéo et utilisez des mots déclencheurs : continuer, prolonger vers l'avant/l'arrière, continue the story.
Règles : Format : adaptive uniquement (garde celui de la vidéo). Durée configurable 4–30s ou automatique. La durée de la vidéo téléversée compte dans la facturation.
"Extend @Video1. After the window opens, move into the art gallery shown in @Video2."
PREMIER FRAME (1:1)
DERNIER FRAMEPrompt utilisé : « La fille de l'image dit “cheese” à la caméra, avec un plan orbital à 360 degrés ». La vidéo de sortie hérite automatiquement du format 1:1 du premier frame.
Sujet + action/événement + décor et ambiance + style visuel + mouvement de caméra / cuts + son
Vous pouvez omettre les parties inutiles, mais gardez cet ordre — c'est la structure que le modèle a été entraîné à suivre.
(musique épique orchestrale montante)
<tonnerre lointain> <vagues qui déferlent>
{Bienvenue dans le futur !} — précisez la langue avant si ce n'est pas évident
【DISPONIBLE MAINTENANT】
@Image1, @Video2, @Audio1 — dites ce que chaque asset fournit (apparence, mouvement, timbre)

Un seul rendu de 30s en style steampunk, structuré en trois fenêtres — [0-10s] horloge en laiton qui se déploie en engrenages, [10-20s] vol à travers un zootrope et un téléphérique en cuivre, [20-30s] navire mécanique, lune géante et retour à l'horloge, avec le logo de @Image1 apparaissant à la dernière seconde.
"A premium, highly cinematic 30-second 3D motion-graphics sequence in a refined steampunk style... [0-10s]: A macro close-up of an antique brass clock face unfolds into interlocking gear rings... [10-20s]: The camera glides into an ornate brass zoetrope... [20-30s]: ...In the final second, a logo appears, referring to @Image1."

Une publicité de biscuits où chaque référence a un rôle : @Image1 fournit le produit, @Video1 la composition d'ouverture, @Video2 le mouvement de caméra, @Video3 l'impact du slow-motion, @Video4-6 chorégraphie, typographie et final de marque. C'est ainsi qu'on garde la cohérence de marque sur toute une vidéo.
"...The strawberry flavor refers to @Image1. The opening builds visual focus on the fruit, referring to the composition of @Video1... one cookie snaps in half and enters slow motion, referring to the impact of @Video3..."

Un rap cinématographique sur une plage au coucher du soleil où le chanteur dit « bonjour » en 8 langues — anglais, chinois, japonais, coréen, portugais, thaï, espagnol et arabe — avec lip-sync précis, cuts secs sur le beat et 8 plans décrits un par un avec fenêtres de temps. Il démontre la prise en charge native de 11 langues de Seedance 2.5.
"...Lyrics (precise lip sync): English: 'Hello' / Portuguese: 'Olá' / Japanese: 'こんにちは'... Shot 5 [0:10-0:13] - A musician by the shore; fast lateral dolly... Lyric line 5 (Portuguese 'Olá'). Hard cut."
| Format | 480p | 720p |
|---|---|---|
| 16:9 | 854 × 480 | 1280 × 720 |
| 4:3 | 752 × 560 | 1112 × 834 |
| 1:1 | 640 × 640 | 960 × 960 |
| 3:4 | 560 × 752 | 834 × 1112 |
| 9:16 | 480 × 854 | 720 × 1280 |
| 21:9 | 992 × 432 | 1470 × 630 |
De 4 à 30 secondes, ou automatique — le moteur choisit la durée idéale pour le prompt. En montage vidéo, la durée de sortie est toujours ≈ égale à celle de la vidéo originale (différence maximale de 0,4s).
MP4 — compatibilité maximale, idéal pour publier sur les réseaux sociaux et le web. MOV Pro — H.264 + chroma yuv444p + audio PCM : fidélité des couleurs supérieure pour l'étalonnage, le keying et le compositing. Recommandé en entrée et sortie dans les flux de montage/extension.
Voix, effets sonores et musique générés nativement et synchronisés avec l'image, en 11 langues : français, anglais, portugais, espagnol, chinois, japonais, coréen, arabe, thaï, vietnamien, indonésien et malais.
• Sans vidéo téléversée : durée générée × tarif de base (45 cr/s en 720p · 21 cr/s en 480p)
• Avec vidéo téléversée (montage/extension) : (durée du téléversement + durée générée) × tarif réduit (27 cr/s en 720p · 13 cr/s en 480p)
La durée de la vidéo que vous téléversez s'ajoute toujours au temps facturé — coupez la vidéo avant de la téléverser si vous n'en avez besoin que d'une partie.
Sujet + action/événement + décor et ambiance + style visuel + mouvement de caméra/cuts + son. Omettez ce dont vous n'avez pas besoin — mais gardez l'ordre.
Pour les vidéos longues, structurez le prompt avec des marqueurs [0-10s], [10-20s], [20-30s]. Le moteur respecte le timing de chaque bloc et l'histoire coule.
Dites explicitement ce que chaque asset fournit : « @Image1 donne l'apparence du personnage ; @Video1 donne le mouvement de caméra ; @Audio1 donne le timbre de la voix ».
« Monter », « supprimer », « continuer » et « prolonger » changent le TYPE de tâche. Si vous ne voulez qu'une référence de style, évitez ces verbes ou la requête peut échouer avec une erreur de paramètres.
Si vous prévoyez de l'étalonnage, du keying ou du compositing, générez en MOV (chroma 4:4:4 + PCM). Pour publier directement sur les réseaux, le MP4 suffit et il est universel.
Format adaptive + durée automatique laissent le moteur choisir le format idéal pour le contenu. Dans les modes montage/extension/frames c'est même obligatoire.
Le moteur refuse les images avec des visages de personnes réelles non autorisées et le contenu de marques déposées. Utilisez des personnages génériques ou vos propres assets autorisés.
C'est le modèle de génération vidéo par IA de dernière génération de ByteDance, présenté à la conférence FORCE 2026 de Volcano Engine. Il génère des vidéos cinématographiques continues jusqu'à 30 secondes avec audio natif synchronisé, accepte jusqu'à 50 références multimodales (images, vidéos et audio) et effectue montage et extension de vidéo par prompt. Sur DXBuilder, vous y accédez directement sans clé d'API.
Le 2.5 double la durée maximale (30s vs 15s), plus que triple les références (50 vs 15), ajoute la sortie MOV avec chroma 4:4:4, accepte des références audio seules, et comprend bien mieux le langage cinématographique des références — cadrage, mouvement et intention créative.
Entre 4 et 30 secondes par rendu. Vous pouvez aussi laisser le moteur choisir automatiquement la durée idéale pour votre prompt. Dans les modes d'extension, vous pouvez prolonger une vidéo existante plusieurs fois pour raconter des histoires plus longues.
Oui — nativement. Utilisez () pour la musique, <> pour les effets sonores, {} pour le dialogue parlé avec lip-sync et 【】 pour les sous-titres. Il prend en charge la voix en 11 langues, dont le français.
480p et 720p, en 7 formats : 16:9, 9:16, 1:1, 4:3, 3:4, 21:9 et adaptive. Sortie en MP4 (universel) ou MOV professionnel avec H.264 + yuv444p + PCM pour l'étalonnage et le compositing.
Vous téléversez une vidéo et écrivez la modification : « supprime toutes les personnes sauf le protagoniste », « remplace le personnage de @Video1 par celui de @Image1 », « enlève la musique de fond ». Le moteur garde automatiquement le format et la durée de la vidéo originale.
La facturation est à la seconde : 45 crédits/s en 720p et 21 crédits/s en 480p. Si vous téléversez une vidéo de référence, sa durée s'ajoute au temps facturé, mais le tarif par seconde baisse (27 cr/s en 720p, 13 cr/s en 480p). Utilisez le calculateur de cette page pour le montant exact.
Seulement avec autorisation. Le moteur bloque les visages de personnes réelles non autorisées et les personnalités publiques. Pour les personnages humains, utilisez des images générées par IA, des personnages génériques ou vos propres assets sous licence.
Jusqu'à 50 : 30 images (@Image1–@Image30), 10 vidéos (@Video1–@Video10) et 10 audios (@Audio1–@Audio10). La durée totale des vidéos de référence ne peut pas dépasser 30 secondes, et il en va de même pour les audios.
Des publicités produit de 30 secondes, des vidéos e-commerce, des bandes-annonces et courts-métrages cinématographiques, des influenceurs virtuels avec personnage cohérent, du storytelling de marque multi-scènes, du contenu 9:16 pour TikTok/Reels/Shorts et des clips musicaux multilingues.
Pas de clé d'API, pas de configuration — écrivez le prompt, choisissez le format et le moteur fait le reste. Si vous manquez d'idées, l'IA en invente une pour vous.
Ouvrir le Studio Seedance 2.5