30秒の連続動画
Seedance 2.0 の2倍。セグメントの継ぎ接ぎや連続性の破綻なしに、1回のレンダリングで完全なストーリーを。

Volcano Engine の FORCE 2026 カンファレンスで発表された Dreamina Seedance 2.5 は、最大 30秒の連続シネマティック動画を生成し、最大 50のマルチモーダル参照を受け付け、テキストだけで既存動画の編集や延長ができます。本ガイドは公式ドキュメントを凝縮したものです — 作成モード、プロンプト構文、技術的制限、DXBuilder の料金。
Seedance 2.5 は、長編ストーリーテリング、マルチモーダル参照、精密な編集に特化した AI 動画生成モデルです。1回の呼び出しで、リアルな物理表現、映画のようなルック、同期されたサウンドを備えた完全な30秒のストーリーを生成できます。また、あなたの動画を変換・延長・修復することも可能です。DXBuilder の Seedance 2.5 スタジオのフラッグシップエンジンです。 → Studio
Seedance 2.0 の2倍。セグメントの継ぎ接ぎや連続性の破綻なしに、1回のレンダリングで完全なストーリーを。
1リクエストで最大30枚の画像 + 10本の動画 + 10個の音声。キャラクター、商品、ロゴ、スタイルをシーン間で一貫させます。
主人公の置き換え、オブジェクトの追加・削除、フレームの一部修復、サウンドトラックの差し替え — すべてテキストだけで。
どんな動画も前方または後方に延長。自然なトランジションと、光と動きの一貫性を維持します。
正確なリップシンクの音声、効果音、音楽を映像と並行して生成 — ポストプロダクション不要。
日本語、英語、ポルトガル語、スペイン語、韓国語、アラビア語、タイ語などのプロンプトと話し言葉に対応 — リップシンク付き。
| 機能 | Seedance 2.5 | Seedance 2.0 |
|---|---|---|
| 1回のレンダリングの最大時間 | 30秒 | 15秒 |
| マルチモーダル参照 | 50(画像30 + 動画10 + 音声10) | 15(画像9 + 動画3 + 音声3) |
| 音声のみの参照(画像なし) | ✓ 対応 | ✗ 画像/動画が必要 |
| 出力フォーマット | MP4 と MOV(4:4:4 クロマ) | MP4 のみ |
| 動画/音声参照の合計時間 | 30秒 | 15秒 |
| 生成前プランニング(3D ホワイトモデル) | ✓ | ✗ |
| 映画的意図の理解 | 大幅に向上(フレーミング、カメラ言語) | 基本的 |
エンジンは、アップロードされた参照素材とプロンプト内の単語から、各リクエストを6つのタスクタイプのいずれかに分類します。編集・延長・フレームモードにはアスペクト比と時間の必須制約があり、それを守ることで生成エラーを回避できます。
トリガー方法: 必要なのはプロンプトだけ — ファイルは一切不要。
ルール: 制限なし:アスペクト比(16:9 … 9:16)と時間(4〜30秒)を自由に選択。
"FPVドローンが雨の中、高層ビルの間を急降下。ネオンがアスファルトに反射。<雨とエンジン音>(シンセウェーブ)"
トリガー方法: 開始フレームとなる画像1枚 + 動きを記述したプロンプト。
ルール: アスペクト比は自動的に画像と同じになります(adaptive)。時間は4〜30秒で自由。
"画像の人物が動き出す:微笑み、髪がそよ風に揺れ、カメラが360°回り込む。"
トリガー方法: 2枚の画像:動画の最初と最後のフレーム。エンジンがトランジションを補間します。
ルール: アスペクト比は最初のフレームから継承(adaptive)。時間は4〜30秒で自由。
"最初のフレームから最後のフレームへ、光の粒子とリアルな物理表現によるシネマティックなトランジション。"
トリガー方法: 最大30枚の画像(@Image1…)、10本の動画(@Video1…)、10個の音声(@Audio1…)を組み合わせ。
ルール: アスペクト比と時間は自由。⚠ プロンプトに「編集」「続行」などの単語を入れないでください — エンジンがタスクを再分類してエラーを返す可能性があります。
"Reference @Image1 for the character. キャラクターがナイトマーケットを歩く。カメラの動きは @Video1 を参照。"
トリガー方法: 動画をアップロードし、トリガーワードを使用:編集、追加、削除、置き換え、変更。
ルール: アスペクト比:adaptive のみ(元動画のものを維持)。時間:自動(≈ 元動画と同じ、許容差0.4秒)。入力動画は4〜30秒。アップロードした動画の時間は課金対象になります。
"Video edit: remove everyone in @Video1 except the protagonist."
トリガー方法: 動画をアップロードし、トリガーワードを使用:続ける、前方/後方に延長、continue the story。
ルール: アスペクト比:adaptive のみ(元動画のものを維持)。時間は4〜30秒で設定可能、または自動。アップロードした動画の時間は課金対象になります。
"Extend @Video1. After the window opens, move into the art gallery shown in @Video2."
最初のフレーム(1:1)
最後のフレーム使用プロンプト:「画像の少女がカメラに向かって『チーズ』と言う。360度の軌道カメラショット」。出力動画は最初のフレームの1:1アスペクト比を自動的に継承します。
主体 + アクション/イベント + シーンと環境 + ビジュアルスタイル + カメラの動き / カット + サウンド
不要な部分は省略できますが、この順序は守ってください — モデルが従うよう訓練された構造です。
(壮大なオーケストラ音楽、盛り上がっていく)
<遠くの雷鳴> <打ち寄せる波>
{未来へようこそ!} — 明白でない場合は先に言語を指定
【好評発売中】
@Image1、@Video2、@Audio1 — 各素材が何を提供するか明記(外見、動き、声質)

スチームパンク調の30秒を1回でレンダリング。3つのウィンドウで構成 — [0-10s] 真鍮の時計が歯車に展開、[10-20s] ゾートロープと銅のケーブルカーを飛行、[20-30s] 機械仕掛けの帆船、巨大な月、そして時計への回帰。最後の1秒に @Image1 のロゴが登場。
"A premium, highly cinematic 30-second 3D motion-graphics sequence in a refined steampunk style... [0-10s]: A macro close-up of an antique brass clock face unfolds into interlocking gear rings... [10-20s]: The camera glides into an ornate brass zoetrope... [20-30s]: ...In the final second, a logo appears, referring to @Image1."

クッキーの広告で、各参照に役割があります:@Image1 が商品、@Video1 がオープニングの構図、@Video2 がカメラの動き、@Video3 がスローモーションのインパクト、@Video4-6 が振り付け、タイポグラフィ、ブランドエンディング。これが動画全体でブランドの一貫性を保つ方法です。
"...The strawberry flavor refers to @Image1. The opening builds visual focus on the fruit, referring to the composition of @Video1... one cookie snaps in half and enters slow motion, referring to the impact of @Video3..."

夕暮れのビーチでのシネマティックなラップ。ボーカリストが8つの言語で「こんにちは」を歌います — 英語、中国語、日本語、韓国語、ポルトガル語、タイ語、スペイン語、アラビア語 — 正確なリップシンク、ビートに合わせたハードカット、タイムウィンドウ付きで1つずつ記述された8つのショット。Seedance 2.5 の11言語ネイティブ対応を実証しています。
"...Lyrics (precise lip sync): English: 'Hello' / Portuguese: 'Olá' / Japanese: 'こんにちは'... Shot 5 [0:10-0:13] - A musician by the shore; fast lateral dolly... Lyric line 5 (Portuguese 'Olá'). Hard cut."
| アスペクト比 | 480p | 720p |
|---|---|---|
| 16:9 | 854 × 480 | 1280 × 720 |
| 4:3 | 752 × 560 | 1112 × 834 |
| 1:1 | 640 × 640 | 960 × 960 |
| 3:4 | 560 × 752 | 834 × 1112 |
| 9:16 | 480 × 854 | 720 × 1280 |
| 21:9 | 992 × 432 | 1470 × 630 |
4〜30秒、または自動 — エンジンがプロンプトに最適な時間を選択します。動画編集では、出力時間は常に元動画と ≈ 同じです(最大差0.4秒)。
MP4 — 最大の互換性。SNS やウェブへの公開に最適。MOV Pro — H.264 + yuv444p クロマ + PCM 音声:カラーグレーディング、キーイング、コンポジット向けの優れた色再現性。編集/延長ワークフローの入出力として推奨。
音声、効果音、音楽をネイティブに生成し映像と同期。11言語対応:日本語、英語、ポルトガル語、スペイン語、中国語、韓国語、アラビア語、タイ語、ベトナム語、インドネシア語、マレー語。
• 動画アップロードなし: 生成時間 × 基本レート(720p は 45 cr/秒 · 480p は 21 cr/秒)
• 動画アップロードあり(編集/延長):(アップロード時間 + 生成時間)× 割引レート(720p は 27 cr/秒 · 480p は 13 cr/秒)
アップロードした動画の時間は常に課金時間に加算されます — 一部だけ必要な場合は、アップロード前に動画をカットしてください。
主体 + アクション/イベント + シーンと環境 + ビジュアルスタイル + カメラの動き/カット + サウンド。不要なものは省略可 — ただし順序は守ること。
長い動画では [0-10s]、[10-20s]、[20-30s] のマーカーでプロンプトを構成。エンジンは各ブロックのタイミングを守り、ストーリーが流れます。
各素材が何を提供するか明示的に:「@Image1 はキャラクターの外見;@Video1 はカメラの動き;@Audio1 は声質」。
「編集」「削除」「続ける」「延長」はタスクのタイプを変えます。スタイル参照だけが欲しい場合、これらの動詞を避けないとパラメータエラーで失敗する可能性があります。
カラーグレーディング、キーイング、コンポジットをするなら MOV(4:4:4 クロマ + PCM)で生成。SNS に直接公開するなら MP4 で十分、互換性も抜群です。
adaptive アスペクト比 + 自動時間で、エンジンがコンテンツに最適なフォーマットを選びます。編集/延長/フレームモードでは必須でもあります。
エンジンは、許可のない実在人物の顔や商標コンテンツを含む画像を拒否します。汎用キャラクターか、権利を持つ自分の素材を使いましょう。
Volcano Engine の FORCE 2026 カンファレンスで発表された、ByteDance の最新世代 AI 動画モデルです。ネイティブ同期音声付きで最大30秒の連続シネマティック動画を生成し、最大50のマルチモーダル参照(画像、動画、音声)を受け付け、プロンプトによる動画編集・延長ができます。DXBuilder では API キー不要で直接利用できます。
2.5 は最大時間を2倍に(30秒 vs 15秒)、参照数を3倍以上に(50 vs 15)、4:4:4 クロマの MOV 出力を追加、音声のみの参照に対応し、参照素材の映画的言語 — フレーミング、動き、創作意図 — の理解が大幅に向上しています。
1回のレンダリングで4〜30秒。エンジンにプロンプトに最適な時間を自動で選ばせることもできます。延長モードでは既存動画を何度も延長して、より長いストーリーを作れます。
はい — ネイティブに生成します。() で音楽、<> で効果音、{} でリップシンク付きの話し言葉、【】で字幕を指定。日本語を含む11言語の音声に対応しています。
480p と 720p、7つのアスペクト比:16:9、9:16、1:1、4:3、3:4、21:9、adaptive。出力は MP4(汎用)またはプロ仕様の MOV(H.264 + yuv444p + PCM)で、カラーグレーディングやコンポジットに対応。
動画をアップロードして変更内容を書くだけ:「主人公以外の全員を削除」「@Video1 のキャラクターを @Image1 のものに置き換え」「BGM を削除」。エンジンは元動画のアスペクト比と時間を自動的に維持します。
秒単位の課金です:720p は 45 クレジット/秒、480p は 21 クレジット/秒。参照動画をアップロードすると、その時間が課金時間に加算されますが、秒単価は下がります(720p は 27 cr/秒、480p は 13 cr/秒)。正確な金額はこのページの計算機をご利用ください。
許可がある場合のみ。エンジンは許可のない実在人物の顔や公人をブロックします。人物キャラクターには AI 生成画像、汎用キャラクター、または権利を持つ自分の素材を使ってください。
最大50:画像30枚(@Image1〜@Image30)、動画10本(@Video1〜@Video10)、音声10個(@Audio1〜@Audio10)。参照動画の合計時間は30秒を超えられません。音声も同様です。
30秒の商品ローンチ広告、EC 動画、シネマティックな予告編や短編、キャラクターが一貫したバーチャルインフルエンサー、マルチシーンのブランドストーリーテリング、TikTok/Reels/Shorts 向け 9:16 コンテンツ、多言語ミュージックビデオなど。
API キーも設定も不要 — プロンプトを書いてフォーマットを選べば、あとはエンジンにお任せ。アイデアがなければ、AI が考えてくれます。
Seedance 2.5 スタジオを開く