Seedance 2.0 の使い方:初心者向けステップバイステップ完全チュートリアル(2026年)
2026/04/07

Seedance 2.0 の使い方:初心者向けステップバイステップ完全チュートリアル(2026年)

Seedance 2.0 で300回以上テストした結果をまとめた完全チュートリアル。コピペで使える15のプロンプトテンプレート、@リファレンスシステムの解説、映画レベルの撮影テクニックを網羅。初めての生成からマルチショットストーリーテリングまで。

Seedance 2.0 を使い始めた最初の一週間は、クレジットを大量に消費しながら、顔が崩れたり、歩き方がぎこちなかったり、安っぽいスライドショーのような映像ばかり生成していました。モデル自体が優秀なのは明らかでしたが、問題は私のプロンプトにありました。300回以上の生成を繰り返した結果、ようやく何が効くのかがわかりました。3層構造のプロンプト、ほとんどのチュートリアルが触れない@リファレンスシステム、そして初回からシネマティックな映像が出せるいくつかのテンプレート。これは、初日に欲しかったチュートリアルです。

Seedance 2.0 とは? — 30秒で概要を把握

Seedance 2.0 は ByteDance が2026年2月にリリースした最新のAI動画生成ツールです。Seedance 1.5を使ったことがある方向けに、特に重要な3つのアップグレードを紹介します。

  • マルチモーダル入力:テキスト+最大9枚の画像+3本の動画+3つの音声ファイルを同時に入力可能
  • ネイティブオーディオ:効果音、音楽、多言語リップシンク対話を生成パイプラインに内蔵
  • 15秒の動画尺:従来の上限を超え、1回の生成でマルチショットのストーリーテリングが可能に
仕様詳細
解像度480p、720p、1080p(標準版);480p、720p(Fast 版)
動画尺4〜15秒
アスペクト比16:9、9:16、1:1、4:3、3:4、21:9
入力タイプテキスト、画像、動画クリップ、音声トラック
オーディオネイティブ同期 — 効果音、音楽、ダイアログ

機能の詳細や Seedance 2.0 と Kling、Sora 2 の比較については、Seedance 2.0 完全ガイドをご覧ください。

Seedance 2.0 へのアクセス方法

中国の電話番号やVPNは不要です。最も手軽な方法は、ブラウザから直接 SoraVideo.art の Seedance 2.0 ツール を使うこと。テキストから動画、画像から動画、リファレンスから動画まで、すべて一箇所で完結します。

60秒で生成を始められます

SoraVideo.art → Seedance 2.0 にアクセスして、テキストから動画の生成を試してみましょう。ByteDance の別アカウントは不要です。新規ユーザーは $4.99 のスターターパック で始められます。このガイドのテンプレートをすべて試すのに十分なクレジットが含まれています。気に入ったら月額プランにアップグレードできます。Dreamina や BytePlus API など他のアクセス方法については、アクセスガイドをご確認ください。

5分で最初の動画を作る

多くのチュートリアルはテキストから動画の生成しか紹介しません。それは1速ギアだけで運転を学ぶようなものです。Seedance 2.0 には3つの生成モードがあります。手元の素材に合わせて選びましょう。

  • テキストから動画(Text-to-Video) → アイデアはあるけど素材がない場合
  • 画像から動画(Image-to-Video) → 写真を動かしたい場合
  • リファレンスから動画(Reference-to-Video) → 画像+動画クリップ+音声を組み合わせたい場合

初めての生成をステップバイステップで解説します。

最初は テキストから動画(Text-to-Video) から始めましょう。以下の初心者向けパラメータがおすすめです。

パラメータ推奨値理由
動画尺5秒素早く試行錯誤でき、クレジット消費も少ない
解像度720p画質と速度の最適なバランス
アスペクト比16:9汎用的なフォーマット
オーディオオンSeedance の独自の強み — 使わないのはもったいない

以下のスタータープロンプトをそのままコピーして貼り付けてください。

A golden retriever runs through a sunlit meadow toward the camera.
Slow motion. Cinematic golden hour lighting. Shallow depth of field.
Camera tracks the dog at eye level, slight handheld movement.
Warm color grading, film grain texture.

このプロンプトが効く理由:

  • 被写体が具体的:「犬」ではなく「ゴールデンレトリバー」
  • アクションが明確:「草原を走ってカメラに向かってくる」
  • カメラに指示がある:「目線の高さで追従、手持ち風の揺れ」
  • スタイルが定義されている:「ゴールデンアワー、浅い被写界深度、フィルムグレイン」

「Generate」をクリックして30〜60秒待ちましょう。結果が出たら、次の3つの質問を自分に投げかけてください。

  1. 被写体は正しいか? 犬の見た目がおかしければ、犬種・色・大きさをもっと具体的に指定する。
  2. 動きは正しいか? 動きが硬ければ、「natural gait(自然な歩様)」や「energetic sprint(力強い疾走)」といった言葉を追加する。
  3. カメラは正しいか? フレーミングがズレていれば、距離を指定する — 「medium shot」や「close-up」など。

変更は 一度に1つだけ。プロンプト全体を書き直すと、モデルの解釈がリセットされてクレジットの無駄になります。

最初の動画が完璧でなくても、それで大丈夫です。スキルは運ではなく、繰り返しの中で磨かれるものです。

3層プロンプト構造

何百ものプロンプトをテストした結果、何度も立ち返る同じ構造があります。効果的な Seedance 2.0 プロンプトには、必ず3つの層があります。

書く内容
シーン場所、時間、天候、雰囲気rain-soaked neon alley at midnight, steam rising from grates
被写体キャラクター、アクション、表情、服装woman in black trench coat, walking fast, tense expression
カメラ&スタイルレンズ、カメラワーク、カラーグレード、フィルムストックtracking shot from behind, film noir palette, 35mm grain

痛い目を見て学んだルール

モデルは左から右に読みます。最初に書いた内容が最も重視されます。 被写体が背景に埋もれてしまう場合は、被写体の説明をプロンプトの先頭に移動してください。

150語がスイートスポットです。 50語未満だとモデルが勝手に補完します。300語を超えると後半が無視され始めます。これは徹底的にテストしました — 120〜200語が安定して最良の結果を出します。

ポジティブな表現を使い、否定形は避けましょう。「no blur, no artifacts」ではなく「sharp focus, clean details」と書いてください。モデルは肯定的な指示のほうが正確に解釈します。

英語と中国語を使い分けるのも有効です。 アクションの説明は英語のほうが効果的です。ムードや雰囲気のキーワードは中国語のほうが強い結果を出すこともあります。私のやり方としては、メインのプロンプトは英語で書き、特定の美学を狙う場合にスタイルキーワードを中国語で入れています。

@リファレンスシステム — ほとんどのチュートリアルが見落としている機能

これこそ、Seedance 2.0 を他のすべてのAI動画生成ツールと一線を画す機能です。多くのチュートリアルでは一文で触れるだけですが、それは大きな間違いです。一貫性があり、制御可能な結果を得るための最も強力なツールなのです。

アップロードできるもの

タイプ上限制御対象
画像0〜9枚キャラクターの外見、環境、スタイル
動画0〜3本(合計15秒以内)カメラワーク、モーションスタイル、ペース
オーディオ0〜3ファイル(合計15秒以内)音楽のリズム、ダイアログのリップシンク、環境音

優先度の仕組み

モデルはリファレンスを以下の順序で重み付けします。

  1. @Audio = リズムアンカー — リップシンクのタイミングとビートに合わせた編集を制御
  2. @Video = モーションアンカー — カメラの軌道とアクションの振り付けをコピー
  3. @Image = ビジュアルアンカー — キャラクターの顔、服装、環境スタイルを固定

完全なプロンプト例

Character from @Image1 walks through the landscape in @Image2.
Camera follows from @Video1 perspective, smooth tracking movement.
Background music synced to @Audio1, beat-matched cuts.
Cinematic warm lighting, shallow depth of field, 35mm film texture.

実用的なヒント

  • 最初は2〜3ファイルから始めましょう。12ファイルではありません。 リファレンスが多いほど、矛盾するシグナルも増えます。複雑さは少しずつ追加してください。
  • キャラクター画像は、クリーンな背景のミッドボディポートレートを使いましょう。 背景がごちゃごちゃしているとビジュアルアンカーが混乱します。
  • 各リファレンスが何を制御するかをプロンプトで必ず明示しましょう。 ファイルをアップロードして祈るだけではダメです。「face from @Image1」や「camera movement from @Video1」のように、モデルに明確に伝えてください。

今すぐコピーできる15のプロンプトテンプレート

以下のテンプレートはすべてそのまま貼り付けて使えます。プロンプト、効く理由、推奨パラメータをそれぞれ記載しています。

テキストから動画のプロンプト

1. プロダクトCM

A sleek espresso machine sits on a marble kitchen counter.
Steam rises from a freshly pulled shot. Morning sunlight streams
through a window, casting warm highlights on brushed steel.
The camera performs a slow 180-degree orbit around the machine.
Shallow depth of field, product photography lighting,
warm neutral color grading, 4K commercial quality.

効く理由: 具体的な製品+自然な環境+制御されたカメラオービット+コマーシャル撮影の用語。 パラメータ: 16:9 · 10秒 · 720p · オーディオオン


2. アニメアクションシーン

Two samurai face each other in a bamboo forest at dawn.
Wind ripples their clothing. Leaves fall slowly between them.
In a sudden burst, both draw swords simultaneously.
Steel clashes with a brilliant spark. The camera whip-pans
between close-ups of their determined eyes and the
impact point. Anime cel-shading style, dramatic speed lines,
saturated color palette, dynamic composition.

効く理由: 明確なセットアップ → アクションビート → カメラ指示+アニメ特有のスタイルキーワード。 パラメータ: 16:9 · 8秒 · 720p · オーディオオン


3. 格闘シーンの振り付け

A martial artist in a white gi executes a spinning roundhouse kick
in an industrial warehouse. Dust particles explode from the impact
point. The camera captures the kick in slow motion from a low angle,
then snaps to real-time as the fighter lands and transitions into
a defensive stance. Dramatic side lighting with deep shadows.
Cinematic action film style, sharp focus on the fighter,
motion blur on the kick arc.

効く理由: 具体的な格闘技の動き+環境のリアクション(ほこり)+速度変化(スローモーション → リアルタイム)+強いライティング指示。 パラメータ: 16:9 · 10秒 · 720p · オーディオオン


4. ショートフィルムのオープニング

A lone figure in a worn overcoat walks through an abandoned
train station at twilight. Broken glass crunches under each step.
Pigeons scatter from the rafters. Volumetric light shafts cut
through dusty air from shattered skylights. The camera begins
with a wide establishing shot, then slowly dollies forward,
following the figure deeper into the station.
Desaturated teal-and-amber color grade, anamorphic lens flares,
melancholic atmosphere, film grain.

効く理由: 感覚的なディテール(ガラスの音、鳩、ほこり)+定番のドリーフォワードのオープニング+具体的なカラーグレード+感情的なトーン。 パラメータ: 21:9 · 8秒 · 720p · オーディオオン


5. SNSフック(縦型動画)

Extreme close-up of latte art being poured into a ceramic mug.
Milk swirls into a perfect rosetta pattern. Steam rises gently.
The camera is locked overhead, shooting straight down.
Warm morning light from the left. Cozy café aesthetic,
soft bokeh background, ASMR-quality detail.
Slow motion, satisfying visual rhythm.

効く理由: 俯瞰固定=縦型動画の安定したフレーミング+ASMR・気持ちいい系コンテンツのフック+具体的なラテアートのパターン。 パラメータ: 9:16 · 5秒 · 720p · オーディオオン

画像から動画のプロンプト

6. 商品写真 → プロモ動画

商品写真をリファレンス画像としてアップロードし、以下のプロンプトを使います。

The product in @Image1 sits on a clean surface.
The camera slowly orbits 180 degrees around it.
Soft studio lighting highlights surface textures and materials.
A subtle reflection appears on the surface below.
Product photography style, premium aesthetic,
smooth continuous camera movement.

効く理由: @Image1で商品の外見を固定+オービットカメラであらゆる角度を表示+スタジオライティングの用語でプロ品質のレンダリングを引き出す。 パラメータ: 16:9 · 8秒 · 720p · オーディオオフ


7. ポートレート → キャラクターアニメーション

ポートレート写真をアップロードして、以下のプロンプトを使います。

The person in @Image1 turns their head slowly from left to right,
as if noticing something in the distance. A gentle breeze moves
their hair. Natural expression transitions from neutral to
a slight smile. The camera holds a medium close-up, steady.
Soft natural lighting, cinematic skin tones,
shallow depth of field on the background.

効く理由: シンプルで制御された動き(首の回転)+自然な環境との相互作用(そよ風)+固定カメラで歪みを回避。 パラメータ: 16:9 · 5秒 · 720p · オーディオオフ


8. 風景写真 → シネマティックパン

風景写真をアップロードして、以下のプロンプトを使います。

The landscape in @Image1 comes alive with subtle motion.
Clouds drift slowly across the sky. Grass sways in a gentle wind.
Light shifts as the sun moves behind a cloud.
The camera performs a slow horizontal pan from left to right,
revealing the full scene. Epic cinematic scale,
golden hour warmth, wide-angle lens perspective.

効く理由: キャラクターの動きではなく環境の動き(雲、草、光)を求めており、風景写真との相性が良い。 パラメータ: 21:9 · 10秒 · 720p · オーディオオン


9. 最初のフレーム+最後のフレーム制御

2枚の画像をアップロードします。モデルは自動的に1枚目をオープニングフレーム、2枚目をクロージングフレームとして使用します。

Smooth cinematic transition from @Image1 to @Image2.
The camera slowly pushes forward as the scene transforms.
Lighting transitions naturally between the two environments.
Maintain visual continuity and fluid motion throughout.
Dreamlike quality, gentle pace, soft color blending.

効く理由: 2枚の画像をアップロードすると、Seedance 2.0 の最初-最後フレームモードが自動的に作動する。プロンプトはトランジションのスタイルをガイドする。 パラメータ: 16:9 · 6秒 · 720p · オーディオオン


10. 複数ショットでキャラクターの一貫性を保つ

キャラクターのリファレンス画像をアップロードし、プロジェクト内のすべての生成で以下のプロンプトを使います。

Character from @Image1 walks down a busy city street at night.
Maintain facial features and wardrobe fully consistent with @Image1:
short black hair, blue denim jacket, white sneakers.
Natural walking pace, confident posture.
The camera tracks from a side angle at waist height.
Urban night atmosphere, neon reflections on wet pavement.

効く理由: ダブルアンカー — @Image1のビジュアルリファレンス+主要な特徴のテキスト記述を明示。この冗長性が、複数の生成にわたる一貫性に不可欠。 パラメータ: 16:9 · 8秒 · 720p · オーディオオン

リファレンスから動画のプロンプト(Seedance 2.0 限定)

これらのテンプレートは、Seedance 2.0 でのみ使える完全なマルチモーダル機能を活用しています。

11. マルチモーダルミックス — 画像+動画+オーディオ

アップロードするもの:キャラクター写真+リファレンス動画クリップ+BGMトラック。

Use the first-person perspective framing of @Video1 throughout.
Use @Audio1 as background music throughout, beat-synced editing.
Character from @Image1 walks through a neon-lit street market.
Camera follows the character from behind, matching the movement
style in @Video1. The character pauses to examine a food stall,
turns to the camera, and smiles. Cinematic night photography,
rich saturated colors, shallow depth of field.

効く理由: 各@リファレンスに明確な役割がある — @Video1はカメラ、@Audio1はリズム、@Image1はキャラクター。 パラメータ: 16:9 · 10秒 · 720p · オーディオオン


12. 動画編集 — 要素の置き換え

アップロードするもの:元の動画+置き換え用の商品画像。

Replace the object being held in @Video1 with the product
shown in @Image1. Keep the original camera movement,
lighting, and hand gestures unchanged.
Maintain natural interaction between the hand and the new product.
Seamless integration, matching color temperature and shadows.

効く理由: 何を保持するか(カメラ、ライティング、ジェスチャー)と何を置き換えるか(オブジェクト)をモデルに明確に伝えている。 パラメータ: 元の動画のアスペクト比に合わせる · 元の尺に合わせる · 720p · オーディオオン


13. 動画の拡張 — マルチセグメント接続

アップロードするもの:接続したい2〜3本の動画セグメント。

Continue the narrative from @Video1 into @Video2.
Maintain consistent character appearance, lighting direction,
and color grade across the transition. The camera movement
flows naturally between segments without jump cuts.
Smooth temporal blending at transition points.
Cinematic continuity, professional editing feel.

効く理由: 明示的な連続性の指示により、クリップをつなぐ際に起こりがちな違和感のあるスタイル変化を防止。 パラメータ: 元のアスペクト比に合わせる · 8秒 · 720p · オーディオオン


14. ミュージックビデオ — オーディオ駆動型生成

アップロードするもの:キャラクター写真+音楽トラック。

Character from @Image1 performs to the rhythm of @Audio1.
Movement intensity follows the music dynamics: subtle sway during
quiet sections, energetic motion during the chorus.
Camera cuts sync to beat drops. Lighting pulses with the rhythm.
Music video aesthetic, high contrast, dramatic color grading,
concert-style spotlights.

効く理由: 特定の視覚的挙動(動き、カット、ライティング)を特定の音声イベント(ビート、サビ、静かなセクション)に紐付けている。 パラメータ: 9:16 · 15秒 · 720p · オーディオオン


15. トーキングヘッド — リップシンク対話

アップロードするもの:キャラクター写真+対話の音声録音。

Character from @Image1 speaks the dialogue from @Audio1.
Precise lip-sync matching the audio. Natural head micro-movements:
slight nods when emphasizing points, occasional blink,
subtle eyebrow raises. Professional presenter framing,
medium close-up, clean background.
Three-point studio lighting, warm skin tones, sharp focus on face.

効く理由: 具体的なマイクロムーブメントの指示(うなずき、まばたき、眉の動き)により、トーキングヘッド動画にありがちな「顔が固まる」問題を防止。 パラメータ: 16:9 · 音声の長さに合わせる · 720p · オーディオオン

カメラ用語チートシート

映像制作の経験は不要です。この表からカメラ用語を1つ選んでプロンプトに追加するだけで、映像のクオリティが一段上がります。

用語効果使うタイミング
Dolly inカメラが被写体に向かって前進する感情の高まりを表現したいとき
Dolly outカメラが被写体から後退する文脈や環境を見せたいとき
Tracking shotカメラが被写体を横方向に追従するアクションシーン、歩行シーン
Crane downカメラが垂直に下降する壮大なエスタブリッシングショット
Handheld自然な手ブレがわずかに入るドキュメンタリー風、臨場感
360° orbitカメラが被写体の周りを一周するキャラクターの登場、商品紹介
Whip pan超高速の水平方向カメラスナップ被写体間のトランジション
Rack focusフォーカスが前景から背景へ移動する要素間の注目を誘導したいとき
Dutch angleカメラが軸方向に傾いている緊張感、不安感、スタイリッシュなショット
POVカメラがキャラクターの目線を表現する没入型の一人称視点

キャラクターの一貫性を保つ方法

AI動画で最も難しいのがキャラクターの一貫性です。以下は、実際に効果があるシステムです。

  1. プロジェクト内のすべてのプロンプトで、常に同じ@Image1を使用する。 これがビジュアルアンカーになります。
  2. リファレンス画像がある場合でも、テキストで主要な身体的特徴を繰り返す。 毎回「short silver hair, scar on right cheek, black leather jacket」のように書いてください。モデルにはビジュアルとテキストの両方のアンカーが必要です。
  3. キャラクターデザインはシンプルに。 アクセサリーを減らし、シンプルな服装にすると、複数の生成にわたって安定した結果が得られます。
  4. リファレンス画像には、クリーンな背景のミッドボディポートレートを使う。 背景がごちゃごちゃしていたり極端なアングルだと、ビジュアルアンカーシステムが混乱します。

よくあるプロンプトの失敗と修正方法

失敗パターン悪い例修正方法
あいまいすぎる"a nice video of nature"具体的に: "red fox crossing a frozen river at dawn, wide shot"
矛盾する指示"fast-paced slow motion"どちらか選ぶ: "slow motion" か "fast-paced editing"
プロンプトが長すぎる300語以上120〜200語に削減 — 重要な要素を先頭に
カメラ指示がない完全に欠落最低1つ追加: "tracking shot" か "static medium shot"
否定表現"no blur, no artifacts"肯定表現に: "sharp focus, clean output, crisp details"
リファレンスの過剰投入12ファイルを一度にアップロード2〜3ファイルから始め、必要な場合のみ追加

FAQ

Seedance 2.0 の最適なプロンプトの長さは? 何度もたどり着くスイートスポットは150語です。50語未満だとモデルの推測が多くなりすぎ、300語を超えると後半が無視され始めます。最も重要な要素を先頭に配置しましょう — 被写体とアクションが最初、スタイルとカメラが次です。

Seedance 2.0 で中国語のプロンプトは使えますか? はい。ムードや雰囲気の表現では、中国語のほうが強い結果を出すこともあります。私は両方を使い分けています — 被写体やアクションの説明には英語、特定の美学を狙うスタイルキーワードには中国語。どちらの言語もネイティブに対応しています。

複数の動画でキャラクターの一貫性を保つには? 常に同じ@Image1リファレンスを使いましょう。そして毎回テキストで主要な特徴を繰り返します:「short silver hair, mole under left eye, blue jacket」のように。モデルにはビジュアルとテキスト両方のアンカーが必要です。シンプルなキャラクターデザインのほうが複雑なものより安定します。

Seedance 2.0 と Sora 2 のプロンプトの違いは? ツールが異なれば、効果的なプロンプトスタイルも異なります。Sora 2 は雰囲気や感情を表す言葉をより効果的に読み取ります。Seedance 2.0 は具体的なアクションの記述や@リファレンスの指示により強く反応します。アプローチの比較については、別途 Sora 2 プロンプトガイドを書いていますのでそちらもご覧ください。

生成にはどのくらい時間がかかりますか? 720pで5秒のクリップは通常30〜60秒です。オーディオ付きの15秒クリップは90〜120秒かかることがあります。プロンプトの調整段階では、低解像度(480p)にすると生成が速くなります。

Seedance 2.0 の動画は商用利用できますか? ライセンスはプラットフォームによって異なります。SoraVideo.art では、生成したコンテンツは商用利用が可能です。商用コンテンツを公開する前に、各プラットフォームの利用規約を確認してください。

Seedance 2.0 はネガティブプロンプトに対応していますか? 画像生成ツールのような独立したフィールドとしては対応していません。代わりに、肯定表現を使いましょう:「no blur」の代わりに「sharp focus」、「no shaking」の代わりに「stable composition」。モデルは肯定的な指示のほうが確実に従います。

まとめ

Seedance 2.0 は、2026年に私が使った中で最も高機能なAI動画生成ツールです — ただし、正しい使い方を知っている場合に限ります。3層プロンプト構造、@リファレンスシステム、そして上記の15のテンプレートが、私が日常的に使っているすべてです。

まずはテンプレートを1つ選んで生成してみてください。結果を確認し、1つだけ変更して、もう一度生成する。最初のセッションでシネマティックなクリップが作れるようになるはずです。

Seedance 2.0 が初めてですか? まずアクセスガイドで準備を整えてから、このチュートリアルに戻ってプロンプトを試しましょう。本格的に使う前にコストを把握したいですか? Seedance 2.0 料金ガイドをチェックしてください。全機能を詳しく知りたいですか? Seedance 2.0 完全ガイドで技術的な詳細をすべてカバーしています。

Seedance 2.0 で制作を始めましょう

Seedance 2.0Sora 2 StoryboardKling Motion Control など、SoraVideo.art ですべてのAI動画ツールを一箇所で利用できます。料金プランを見る

著者

avatar for SoraVideo.art Team
SoraVideo.art Team

カテゴリー

    ニュースレター

    コミュニティに参加

    最新ニュースとアップデートを配信します