-900x506.webp)
ByteDanceによるSeedance 2.5 AI動画ジェネレーター
getimg.aiで直接利用できるネイティブオーディオと参照コントロールを使って、テキストや画像から最大30秒の動画を生成できます。
Seedance 2.5はByteDanceの最新のSeedance動画モデルで、より長時間のオーディオ・ビデオ生成と、参照ベースのストーリーテリングのために構築されています。出力は6つのアスペクト比で、480p、720p、または1080pに対応しています。
getimg.aiでSeedance 2.5を直接使用する
getimg.aiを開いた瞬間に、Create動画ジェネレーターでSeedance 2.5を使用できます。APIキーも、プロバイダーの個別アカウントも、モデルをロック解除するための最低利用金額も必要ありません。
テキストと画像から動画へ
プロンプトを書くか、画像から始めて次に何が起こるべきかを記述します。どちらの方法も同じCreate動画ジェネレーターを通じて実行され、大まかな説明をモデルに届く前に整えたい場合は、プロンプト強化機能も利用できます。
最初のフレーム、最後のフレーム、参照画像
オープニングフレームを固定したり、クリップの着地点を設定したり、参照画像で人物、オブジェクト、場所をガイドしたりできます。これらは別々のガイダンスモードなので、ショットに合ったものを選ぶことができます。
ネイティブオーディオ、6つのアスペクト比、最大30秒
音声は映像と同じパスで生成されます。16:9、9:16、1:1、4:3、3:4、または21:9から選び、4秒から30秒の間で長さを設定して、480p、720p、または1080pで出力します。
モデルの機能とgetimg.aiで利用可能な機能
ByteDanceは、単一のプラットフォームが提供するよりも幅広い機能セットを備えたSeedance 2.5を提供しています。現在、getimg.aiのCreate動画ジェネレーターでは、これら6つのコントロールが利用可能です。
現在getimg.aiのワークフローで利用できないもの:動画参照、音声参照、タイムスタンプ編集、マルチラウンド拡張、グリーンスクリーン編集。これらが他の場所でSeedance 2.5のデモとして紹介されているのを見たことがある場合、それらはgetimg.aiのコントロールではなく、モデル自体の機能です。
画像ガイダンスのメソッドを選択する
Seedance 2.5は、getimg.aiで3つの異なる方法による画像入力を受け付けます。それぞれ異なる問題を解決するため、何かをアップロードする前に、自分が実際にどれを必要としているかを知っておく価値があります。
参照画像と最初/最後のフレームは別々のモードであり、現在、getimg.aiの同じ生成内で組み合わせることはできません。
getimg.aiでのSeedance 2.5の使い方
初めてのSeedance 2.5クリップの生成はすぐに完了します。
1. Create動画ジェネレーターを開く
こちらをクリックして、プロンプトボックスのモデルピッカーからSeedance 2.5を選択します。4Kや、より軽量で低コストな生成が必要な場合は、Seedance 2.0、2.0 Fast、2.0 Miniが同じリストにあります。
2. プロンプトを書く
被写体、アクション、環境、カメラの動作、およびオーディオを記述します。当社の動画プロンプトガイドや、このページの下の方にあるプロンプトの公式を参照してください。オプションで、最初のフレーム、最後のフレーム、または参照として画像をアップロードします。
3. 生成する
6つのアスペクト比(16:9、9:16、1:1、4:3、3:4、21:9)から選択し、4秒から30秒の間で長さを選び、出力を480p、720p、または1080pに設定します。動画と音声は1回のパスで一緒に生成されます。
映画のような連続長回しのアクションショット。リアルな歴史的スタイル、16:9。オーディオ:激しく加速する部族のドラムビート、泥だらけの足音、そしてくぐもった雄叫び。急速に後退する極端なローアングルのトラッキングショット。獰猛なバイキングの戦士が、大雨の中、霧が立ち込める鬱蒼とした松の森を全速力で駆け抜ける。彼は歩調を崩すことなく槍の突きを受け流し、濡れた倒木を飛び越える。カメラは彼と一緒に倒木を越えて上昇し、完璧なフォーカスを維持する。彼は重々しく着地し、深い泥の中でわずかに滑りながら、リアルな重量感と勢いを見せつけ、その直後に手斧をカメラレンズのすぐそばをかすめるように投げつける。落ち着いたカラーパレット、非常にリアルな物理表現、シネマティックなモーションブラー、生々しく荒々しい雰囲気。
Seedance 2.5が30秒間で何をするかを見る
これはつなぎ合わせた編集ではなく、1回の生成です。1つのタイムラインプロンプトから生成された、720pの単一の30秒のSeedance 2.5クリップです。カッティング、画面上のタイトルカード、BGM、そしてオープニングカードから製品のクローズアップ、最後のフレームに至るまで一貫して維持されるブランド名は、すべて同じパスから出力されました。サウンドをオンにしてご覧ください。
長さはクリップの可能性を変えます。これが、30秒という時間にこだわる実用的な理由です。
より長い動画。ネイティブオーディオ。参照コントロール。
Seedance 2.5は、以前のSeedanceの世代と比較して、モーションの安定性、複数の被写体が存在するシーン、ショットのトランジション、および長編の連続性を向上させています。複雑な相互作用には、依然として複数回の生成や追加の編集が必要になる場合があります。
最大30秒、テキストまたは画像入力、同じ生成パスに含まれるオーディオ。
シネマティックなマクロ自然ASMR、16:9。音楽なし、純粋な環境音。ショット1:暗く湿った苔むした林床の極端なクローズアップ。光るアメジスト色の種が苔の上に置かれている。水滴が葉を打つ鮮明な音。ショット2:タイムラプス効果とリアルタイムの滑らかなカメラモーションの組み合わせ。種が鋭く鮮明な結晶質の「ティン」という音とともに割れて開く。半透明で光る紫色の茎が急速に上へと成長する。生物発光する花粉の小さな粒が空中に漂い、柔らかいボケの光輪で暗い背景を照らす。クリスタルの花びらの超詳細なテクスチャ、ガラスのような植物を通る光の屈折、そして湿った魔法のような雰囲気に厳密に焦点を合わせる。
あなたの指示に従うテキストから動画への変換
被写体、アクション、環境、カメラの動作、ペース、およびオーディオを記述します。Seedance 2.5は、これらの指示を使用して、生成されたクリップ全体のショットの構造と動きをガイドします。
複数の被写体のシーンや暗示されたカメラワークは、以前のSeedanceバージョンよりもクリップ全体で確実につながりを維持しますが、慌ただしい相互作用にはまだ2回目のパスが必要になる場合があります。
16:9、超リアルでシネマティックなストリートレースのショット。オーディオ:甲高いエンジンの空ぶかし、攻撃的なタイヤのきしみ音、そして金属に当たる雨音。夜の濡れたアスファルトのヘアピンカーブで、カメラは地面に近い低い位置から始まる。マットブラックのヴィンテージポルシェ911がアグレッシブにドリフトしてフレームに入ってくる。カメラは右への高速のウィップパンを実行し、車の速度を完璧に追跡して車を非常にシャープに保つ。車は滑るようにフレームアウトする。カメラはパンニングを突然止め、即座に遠くの車のテールランプから、極端な手前のアスファルトの上に落ちている濡れて潰れた空き缶へとラックフォーカスを行う。タイヤが雨水を跳ね上げる完璧な水の物理演算。
Seedance 2.5のプロンプトの書き方
信頼できるSeedance 2.5のプロンプトは、1つの順序に従います:シーン、被写体、アクション、カメラ、タイミング、照明、ペース、オーディオ。毎回すべての要素が必要なわけではありませんが、この順序にすることで、モデルが推測に頼るのを防ぐことができます。
映画のような雨の夜のストリートシーン。黄色いコートを着た女性が待っているタクシーに向かって走る。彼女の前を後ろに下がりながら進む低いトラッキングショット、わずかな手持ちカメラの揺れ、濡れた舗装路に反射するネオン。8秒の時点で彼女は車に到達し、ドアを開ける。遠くの交通音、雨音、足音、音楽なし。
オーディオを指定することは、ショットを指定することと同じくらい重要です。音について記述しない場合、モデルが代わりに決定します。
プレミアムな製品のコマーシャル、16:9、クリーンなスタジオ照明、光沢のあるダークストーンのカウンター、浅い被写界深度。0-5秒:暗い背景に対して柔らかいリムライトの中にマットブラックのエスプレッソマシンが置かれている。グループヘッドから蒸気が上がり始めると同時に、左から右へゆっくりとオービット。5-10秒:透明なグラスのカップにダブルショットが注がれ、クレマが形成されて層になるスローモーションのクローズアップ。カメラは注がれる様子にプッシュインする。10-15秒:引きのワイドショット。完成したカップがカウンターの上にあり、温かい朝の光がシーン全体に広がり、蒸気が上へと漂う。オーディオ:低いグラインダーのハム音、ポンプのシューという音、グラスに注がれる液体の音、柔らかい環境のルームトーン。音楽なし、ナレーションなし。
30秒のクリップのプロンプト作成
30秒になると、タイミングは記述よりも大きな重要性を持ちます。モデルにタイムラインを与えると、クリップを構成するための基盤ができあがります。上記の30秒の例も、このようにプロンプトが作成されました。
各セグメントを独自のビート(展開)として記述します:何が起こるか、カメラがどう動くか、そしてオーディオがどうなるかです。通常、4つのビートで十分です。
0〜8秒:セットアップ
場所、被写体、雰囲気を確立します。何かが起こる前に視聴者がシーンを読み取れるように、カメラの動きはシンプルに保ちます。ここで環境音も指定します。これが、その後に続くすべての基盤となるからです。
動画と一緒に生成されるオーディオ。後からではありません。
生成されたサウンドトラックは、同じオーディオ・ビデオ生成において、セリフ、環境音、効果音、音楽を組み合わせることができます。映像と同じプロンプトで、希望する音を記述します。
オーディオとビデオは共同で生成され、同じプロンプトとシーンの構造に反応します。出力は単一のミックスされたトラックであり、後で組み立てるための個別のステム(音源)ではありません。
非常にリアルなSFドラマ、16:9。単一の連続的なシネマティックショット。オーディオは、宇宙服のヘルメット内のリズミカルで孤立した荒い息遣いの音を特徴とし、背後にはかすかで不気味な電子的なドローン音と微かな無線の静電ノイズが流れている。宇宙飛行士が、ショルダーランプの鋭い白い光だけで照らされた巨大で暗いエイリアンの洞窟の中で凍りついたように立っている。カメラは宇宙飛行士の反射するゴールドのバイザーに向かって、ゆっくりと緊張感のあるドリーインを実行する。震える、畏敬の念に満ちた声が通信チャンネル越しに聞こえてくる:「ヒューストン、信じられないだろう。スキャンは間違っていた。これらは岩の層じゃない、巣だ。そして孵化しようとしている」。バイザーの反射には、深く生物発光する緑色の心拍とともに脈打ち、孵化し始めている巨大な半透明の卵を横切る光のビームが映し出される。
Seedance 2.5か、Seedance 2.0か?
Seedanceファミリーは、単純な品質のランキングではなく、実際のトレードオフによって分かれます。ショットにとって最も重要な制約条件に基づいて選んでください。
最も長いクリップが必要ですか?Seedance 2.5
単一の生成で最大30秒、480p、720p、または1080p、6つのアスペクト比に対応。より長いストーリーテリングや、より長い連続アクションに最適です。
4Kが必要ですか?Seedance 2.0
最大15秒、1080pおよび4K出力で、同じ6つのアスペクト比に対応。最大長よりもネイティブな出力解像度を重視する場合は、これを選択してください。
より軽量な実行が必要ですか?2.0 Fast または Mini
どちらも720pで生成され、1秒あたりのコストが大幅に低くなります。Fastは最大15秒まで、6つのアスペクト比すべてを維持します。Miniは最大12秒まで、16:9、1:1、9:16をカバーします。
同じプロンプトでSeedanceファミリーをテストしました
getimg.aiで、Seedance 2.5、2.0、2.0 Fast、2.0 Miniに同一のプロンプトを実行し、すべての出力を保持しました。以下のクリップは未編集で、同じ長さとアスペクト比で生成され、ネイティブオーディオはオンになっています。それらを並べて再生し、モーション、プロンプトへの追従性、そしてオーディオをご自身で判断してください。
左上:Seedance 2.5。右上:Seedance 2.0。左下:Seedance 2.0 Fast。右下:Seedance 2.0 Mini。
以下のスペックは、プロバイダーのマーケティングから引用したものではなく、getimg.aiのCreate動画ジェネレーターで測定されたものです。テスト1、人間のアクション:日没時に屋上の縁を跳び越えるパルクールランナー。5秒、16:9、オーディオオン。
4つではなく、3つのプロンプトを実行しました。Seedance 2.5のみが30秒に到達できるため、長い物語のテストは同等の比較になりません(2.0と2.0 Fastは15秒、Miniは12秒で停止します)。その上限の違いは、上記の30秒の例で示されています。
Seedance 2.5
最大30秒。480p、720p、1080p。6つのアスペクト比。最初のフレーム、最後のフレーム、参照画像。ネイティブオーディオ。720pで1秒あたり240クレジット、1080pで540。より長いストーリーテリングや連続アクションに最適です。
Seedance 2.0
最大15秒。最大4K。6つのアスペクト比。最初のフレーム、最後のフレーム、参照画像。ネイティブオーディオ。1080pで1秒あたり350クレジット、4Kで1,400。出力解像度を優先する場合に最適です。
Seedance 2.0 Fast
最大15秒。480pと720p。6つのアスペクト比。最初のフレーム、最後のフレーム、参照画像。ネイティブオーディオ。720pで1秒あたり120クレジット。720pでの大量の作業に最適です。
Seedance 2.0 Mini
最大12秒。480pと720p。16:9、1:1、9:16。最初のフレーム、最後のフレーム、参照画像。ネイティブオーディオ。720pで1秒あたり75クレジット。ファミリーの中で最も軽量なオプションです。
テスト2:製品コマーシャル
磨かれたコンクリートの台座の上で静止している一対の白いレザースニーカー。その周りをカメラが旋回し、柔らかいオーバーヘッドライトがレザーの上を掃くように照らす。5秒、16:9、オーディオオン。
プロンプトはカメラが動き、製品が動かないことを求めていますが、これは2つの解釈のうち難しい方です。各モデルがショットを旋回するか、代わりに靴を静かに回転させるか、そして角度が変わるにつれて製品の形状がどのように維持されるかをご覧ください。
左上:Seedance 2.5。右上:Seedance 2.0。左下:Seedance 2.0 Fast。右下:Seedance 2.0 Mini。
テスト3:セリフ
朝の光の中、カフェのテーブルにいる2人の同僚、一言のセリフ、静かな環境音、音楽なし。5秒、16:9、オーディオオン。
セリフは3つのテストの中で最も困難です。唇の動きに対する声のタイミングや、各モデルが部屋の音に対してどのようにスピーチのバランスをとっているかに耳を傾けてください。
左上:Seedance 2.5。右上:Seedance 2.0。左下:Seedance 2.0 Fast。右下:Seedance 2.0 Mini。
よくある質問
Seedance 2.5は、ByteDance Seedによって開発されたByteDanceの最新のSeedance動画モデルです。テキストプロンプト(テキストから動画へ)またはアップロードされた画像(画像から動画へ)から動画クリップを生成し、音声は映像と同じパスで生成されます。
getimg.aiでは、Seedance 2.5は、480p、720p、または1080pで、6つのアスペクト比にわたり、最初のフレーム、最後のフレーム、および参照画像ガイダンスを使用して、4秒から30秒の単一のクリップを作成します。
getimg.aiの動画ジェネレーターを開いて、Create動画生成を開始します。プロンプトボックスのモデルピッカーからSeedance 2.5を選択します。Seedance 2.0、2.0 Fast、2.0 Mini、1.5 Pro、1.0 Pro Fastも同じリストにあります。
テキストから:プロンプトを書き、4秒から30秒の間で長さを設定し、アスペクト比と出力品質を選択して生成します。画像から:最初のフレームとしてアップロードし、何が起こるかを記述して実行します。すべてがブラウザ内で実行され、インストールするものは何もありません。
長々としたプロンプトよりも、明確で具体的なプロンプトの方が効果的です。被写体、アクション、環境、カメラの動作、希望するオーディオを指定してください。
同じ生成ではできません。現在のgetimg.aiのワークフローでは、参照画像と最初/最後のフレームは別々のガイダンスモードであるため、クリップごとに1つを選択します。
特定のフレームを正確にする必要がある場合は、最初のフレーム、または最初+最後のフレームを使用します。単一のフレームを固定することなく、人物、オブジェクト、場所、または全体的な視覚的方向性をガイドしたい場合は、参照画像を使用します。
3つすべてがネイティブオーディオ付きの動画を生成しますが、長さ、解像度、コントロールの面でトレードオフがあります。
Seedance 2.5は単一のクリップで30秒に達し、480p、720p、または1080pで出力します。Seedance 2.0は15秒で停止しますが、最大4Kで出力します。どちらも21:9と4:3を含む6つのアスペクト比をカバーし、最初のフレーム、最後のフレーム、参照画像を受け付けます。Seedance 1.5 Proは、より軽量な短編向けのオプションです。3つのアスペクト比(1:1、16:9、9:16)、最初のフレームと最後のフレームのコントロール、そして最大12秒のクリップです。
長く連続したテイクが1つ必要な場合は、Seedance 2.5を選んでください。解像度が優先される場合はSeedance 2.0を選択してください。標準的な短いクリップには、Seedance 1.5 Proが依然として堅実で低コストな選択肢です。
Seedance 2.5は、オーディオとビデオが1回の生成パスで合成されるマルチモーダルアーキテクチャを使用しています。テキストと画像の入力は、順番にではなく、構図、モーション、カメラの動き、およびオーディオを同時に形成します。
オーディオは映像と同じプロンプトとシーン構造から生成されるため、別々に調達されて後から重ね合わせられるのではなく、画面上の内容と一致します。
現在、当社の公開APIカタログにはありません。Seedance 2.5はgetimg.aiのウェブアプリで利用可能です。
当社のAPIには現在、厳選された以前のSeedanceモデルが含まれています:Seedance 1.5 Pro API。
APIアクセスは同じアカウントで実行されますが、サブスクリプションクレジットではなくトップアップ(チャージ)方式で個別に請求されるため、プログラムで生成し、ご自身のペースでスケールアップすることができます。
有料プランには、当社の利用規約に基づく適格な生成コンテンツの商用利用権が含まれています。アップロードされた参照元、サードパーティの知的財産、およびモデル固有の制限は引き続き適用される場合があります。
最初の30秒のSeedance 2.5クリップを生成する
Seedance 2.5は、getimg.aiのCreate動画ジェネレーターにあり、ネイティブオーディオ、最初のフレーム、最後のフレーム、および参照コントロールを備えています。有料プランには、当社の利用規約に基づく適格な生成コンテンツの商用利用権が含まれています。