テキストから動画へのジェネレーター

シーン、動き、雰囲気、カメラの動きを記述し、用途に合ったモデルとパラメーターで動画を生成します。

プロンプトからモーションへ長さの制御動画モデルの選択
0 / 2,000
~75 cr

Text-to-Video AI――シーンを書けば、映像が手に入る

被写体、モーション、ムード、カメラを説明し、ネイティブ音声付きの映画的クリップを生成。現在ブラインド選好投票で勝利しているモデルSeedance 2.0と、Veo 3.1 Fastが支えます。

嵐の中の帆船を捉えた映画的なAIフィルムの一場面

平易な文章から映画的なシーンを

嵐の海、ネオン街のカーチェイス、夜の静かなダイナー――友人に語るように書けば、モデルが撮影演出を担います。Veoの出力は繰り返し「生成ではなく演出された映像」と評されます。意図ある光、説得力ある物理、本物のカメラ文法。

3フレームにわたって花が咲くタイムラプスシーケンス

指定できるモーションとタイミング

ゆっくりとしたプッシュイン、タイムラプスのブルーム、手持ちの躍動――プロンプト内のモーション指示に従い、尺はあなたが設定(モデルにより4~15秒)。クリップは近似ではなく、ブリーフに一致します。

回転するスマートフォンの商用スタイルのプロダクト動画フレーム

数分でプロダクト・ブランドクリップ

回転するヒーローショット、ポアショット、開封――かつてスタジオセッションが必要だった商用スタイルの映像が、一段落から生成されます。正確なコストを事前表示する秒単価により、キャンペーンの予算化が可能です。

夕暮れの光の筋を伴う都市のスカイラインのタイムラプス

音声付き、縦型対応

ネイティブの対話、環境音、エフェクトが映像とともに届きます。9:16の縦型と16:9のワイドスクリーンはどちらも一級対応。出力は無音の下書きではなく、投稿できるクリップです。

このページで作った Text to Video の動画

どれも書いた文章だけから始まりました。生成に使ったプロンプトは下に記載しています。

プロンプトSeedance 2.5 · 480p · 16:9 · 4 秒クリップ · 440 クレジット

A ceramicist in a sunlit workshop looks up from the wheel and speaks warmly to camera: "This one finally came out right." Clay-dusted hands, natural skin texture, shallow depth of field, soft window light, ambient studio room tone.

プロンプトSeedance 2.0 Mini · 720p · 16:9 · 5 秒クリップ · 150 クレジット

A golden retriever puppy sprinting across a sunlit meadow toward the camera, ears flapping, slow-motion feel, backlit grass glowing, joyful energy.

プロンプトKling 3.0 Turbo · 1080p · 16:9 · 5 秒 · 350 クレジット

A parkour athlete vaulting across rooftop gaps at golden hour, dynamic tracking camera, accurate body mechanics and momentum, dust kicked up on landings, cinematic sports energy.

プロンプトSeedance 2.0 Mini · 720p · 9:16 · 5 秒 · 150 クレジット

Handheld vertical walk through a neon night market, steam rising from food stalls, lanterns swaying, people passing in soft motion blur, lively street ambience.

プロンプトKling 3.0 Turbo · 720p · 16:9 · 5 秒 · 275 クレジット

Close-up of an elderly fisherman laughing warmly at dusk on a boat deck, wrinkles and windblown hair rendered naturally, genuine expressive performance, handheld documentary feel.

プロンプトSeedance 2.0 Mini · 480p · 16:9 · 4 秒 · 60 クレジット

Two tiny paper boats racing down a rain-gutter stream after a storm, water rushing over pebbles, playful close follow shot.

プロンプトKling 3.0 Turbo · 720p · 9:16 · 5 秒 · 275 クレジット

Vertical fashion film: a model in a flowing emerald dress walking toward camera down a rain-slick runway, fabric rippling naturally with each step, confident stride, editorial lighting.

プロンプトSeedance 2.5 · 480p · 16:9 · 4 秒 · 440 クレジット · 黒板の文字は「SOUPE DU JWIN」になりました

Close-up of a chef\'s hands rapidly julienning a carrot on a wooden board, knife tapping fast, a handwritten chalkboard menu reading "SOUPE DU JOUR" visible behind, busy kitchen sounds.

切り替えて使えるテキストから動画へのモデル

書かれたひとつのシーンを複数のエンジンへ——動きが気に入ったものを選んでください。

テキストから動画への仕様

入力テキストプロンプトのみ——画像は不要です。
プロンプトの言語27のインターフェース言語すべて。英語以外のプロンプトは生成前に補強されます。
長さモデルにより 4〜30 秒。長い作品は、気に入ったクリップを延長して作ります。
解像度全ラインアップで 480p と 720p。1080p と 4K は Seedance 2.0 standard で利用できます。
オーディオ同じ処理の中でネイティブに同期音声を生成するエンジンもあれば、無音のクリップを返すものもあります。パネル上に表示されます。
コスト出力1秒あたりの課金。480p で 15 クレジット/秒から。生成前に全額が表示されます。
生成の失敗課金されません——クレジットは残高に残ります。

テキストから動画へのジェネレーターの使い方

シーンを書いて、エンジンを選んで、生成する。

  1. 1

    シーンを書く

    被写体・動き・場所・カメラワークを説明します。テキストから動画のモデルは、「ゆっくりドリーイン」「手持ち」「ワイド」といったショット用語に、画像モデルよりはるかに強く反応します。

  2. 2

    モデル・長さ・解像度を選ぶ

    テキストから動画への各エンジンは、動きと音声にそれぞれ強みがあります。料金は秒単位で、生成前に表示されます。

  3. 3

    生成して続ける

    クリップをダウンロードする、延長する、さらに編集へ持ち込む。プロンプトと設定は履歴に紐づいたままです。

テキストから動画へのプロンプトの書き方

テキストから動画へのモデルが読むのは、あらすじではなくショットの記述です。次の4要素を、この順番で。

1

被写体

画面に誰が、または何が写っているか。見分けのつく特徴を1つ添えて。

染みのついた白いコックコートを着たシェフ

2

アクション

動作は1つ。それが展開していくとおりに描写します。

皿に盛りつけている、ピンセットで最後のハーブを置くところ

3

カメラ

位置と動き。答えが「動かさない」でも書いてください。

フィックスの俯瞰ショット

4

画の質感

光、色、仕上がり。

厨房の硬い光、ハイコントラスト、ドキュメンタリー

曖昧な例

雨の中を歩く女性

具体的な例

ロングコートの女性が夕方の雨の中をカメラに向かって歩いてくる、傘を後ろに傾け、背後で店の灯りがぼける、目線の高さでゆっくり引くドリー、浅いピント、寒色のブルーに暖色の窓明かり

なぜうまくいくのか

短いほうは被写体と天気しか指定しておらず、カメラも進行方向も光もレンズもモデル任せです。長いほうはそのすべてを固定しているので、2回撮っても同じショットになります。

曖昧な例

スキンケアボトルの商品動画

具体的な例

曇りガラスの美容液ボトルが濡れた石の面でゆっくり回転、カメラは製品の高さでフィックス、右からのソフトなキーライト1灯、水滴がハイライトを受ける、マクロ、クリーンなコマーシャルの質感

なぜうまくいくのか

商品動画が失敗するのは、被写体そのものよりフレーミングと光であることのほうが圧倒的に多いです。カメラを固定し、ライトを1つ指名し、マクロを選ぶ——本来モデルが推測するはずの3つの決定を、こちらで決めてしまえます。

やめるべき癖

  • 動きを詰め込みすぎること。動作が1つ増えるたびに、顔や手が破綻する機会も増えます。1クリップに明確な動作1つのほうが、3つより遥かに安定します。
  • カメラを指定しないこと。カメラの振る舞いを言わなければモデルが選び、たいていは流れる動きを選びます。「フィックス(固定)ショット」は有効で役に立つ指示です。
  • いきなり最大の長さを指定すること。ズレは時間とともに積み重なります。最初から30秒を狙わず、まず気に入った短いテイクを作り、それを延長しましょう。

テキストから動画へ、その先へ

プロンプト起点の動画はひとつの道筋にすぎません。参照画像、アバター、編集という道もあります。

テキストから動画へのAIに役立つ資料

テキストから動画への料金と毎日の無料クレジット

テキストから動画へは出力の秒数で課金されます。無料アカウントは毎日80クレジット、有料プランではプレミアムエンジンとより長い尺が使えます。

無料

$0

始めるのに最適

  • 200 ウェルカムクレジット、1日最大 80 まで
  • Z Image Turboは0クレジットで下書き
  • 標準の生成速度
  • 生成履歴を含む
始める

プレミアム

一番人気
$29/month

年額請求 · $240/年

  • 月間 8,000 クレジット、1日の上限なし
  • すべてのプレミアムモデル――GPT Image 2、Nano Banana、Seedream、Seedance、Veo、Kling
  • 5倍の生成速度、優先キュー
  • AIプロンプト強化
プレミアム にアップグレード

Ultimate

$49/month

年額請求 · $380/年

  • 月間 18,000 クレジット、1日の上限なし
  • 最大4K解像度のHD生成
  • 優先サポート
  • 最速のキューと新モデルへの早期アクセス
Ultimate にアップグレード

テキストから動画へ — よくある質問

1

Text-to-Videoはどう機能しますか?

あなたがシーン――被写体、モーション、ムード、カメラ――を説明すると、AI動画モデルがネイティブ音声を含めてゼロからクリップを生成します。ソース映像は不要です。

2

どのモデルを使うべきですか?

手頃な反復にはSeedance 2.0 Fast、マルチショットストーリーにはSeedance 2.0、シングルショットの映画的な磨きにはVeo 3.1 Fast、正確な1080p/尺の制御が必要なときはSeedance 1.5 Pro。

3

動画の長さはどのくらいまで可能ですか?

モデルにより1回の生成あたりおよそ4~15秒。Seedance 2.0ではシーケンスを継続するシーン拡張が利用可能です。

4

クリップに音声は含まれますか?

はい――SeedanceとVeoは対話、環境音、エフェクトをネイティブに生成します。Seedanceではより低い秒単価のために音声を無効にできます。

5

コストはいくらですか?

モデル、解像度、音声に応じた1秒あたり――常に生成前に表示され、失敗時には自動返金。

6

良い動画プロンプトはどう書けばいいですか?

被写体、アクション、設定、ムード、カメラの動きを指定。内蔵のプロンプトエンハンサーが、短いアイデアをよく構造化された動画ブリーフへ自動的に拡張します。

7

TikTokやReels向けの縦型動画を作れますか?

はい――縦型プラットフォームには生成ごとに9:16を、YouTubeやWebには16:9を選べます。

8

良いテキストから動画へのプロンプトはどう書けばいい?

被写体、動き、カメラを分けて書いてください。「皿を盛り付けるシェフ」は被写体、「皿を盛り付けるシェフへゆっくり寄る、浅い被写界深度、暖かいキッチンの光」がショットです。テキストから動画へのモデルは、後者のほうがはるかに忠実に従います。

9

テキストから動画でセリフや音は生成できますか?

ネイティブ音声に対応したエンジンなら可能です——同期した発話も含みます。それ以外は無音のクリップになります。どちらなのかは、クレジットを使う前にモデルパネルへ明記されています。

10

テキストから動画へのクリップが、なぜプロンプトから外れていくのですか?

長くなるほどプロンプトから外れやすくなります。埋めるフレームが増え、支えになる情報が減るからです。短いクリップのほうがプロンプトをしっかり守ります。長さが必要なら、まず気に入った短いテイクを生成してから延長するほうが、最初から30秒を求めるより確実です。

一段落書けば――一本のクリップをプレミア上映

動画の生成を始める

ワンクリック AI 動画ツールを見る

生成の前後の作業はワンクリックで——仕上げ、スタイル変更、共有まで。