生成AIを学ぶならココ!
おすすめのスクールTOP3
| サービス名 | 1位 デジハク生成AI | 2位 SAMURAI ENGINEER | 3位 バイテック生成AI |
|---|---|---|---|
![]() | ![]() | ![]() | |
| おすすめ度 | |||
| 向いている人 | 生成AIを仕事や副業で活用したい人 | AIアプリ開発や転職を目指す人 | 仕事や副業で生成AIを活用したい人 |
| 現行コース・ 料金(税込) | MINI: 一括346,500円 利用期間・サポート期間60日 PRO: 一括548,000円 利用期間無期限、サポート期間180日 | AIアプリコース(通常料金): 16週間728,000円 24週間924,000円 入学金99,000円を含む キャンペーン適用時は公式ページで要確認 | LITE:一括178,000円(税込) PRO:一括298,000円(税込) 教材は無期限で利用可能 |
| サポート | MINI:専任AIメンター、チャットサポート(60日) PRO:専任AIメンター、案件サポート(180日) | 専属エンジニア講師、学習コーチ、Q&A掲示板 | LITE:教材+チャットサポート PRO:専任AIメンター+案件サポート |
| 給付金・制度 | 個人向け給付金の対象可否は公式サイトで要確認 | 対象コースあり 制度・条件・上限はコースごとに異なる | 公式ページで対象可否を要確認 |
| 無料相談・体験 | 公式サイトで料金・相談内容を確認 | 無料カウンセリングあり | 無料個別カウンセリングあり |
| デジハクの料金を確認 | 無料カウンセリングを確認 | 無料個別カウンセリングを確認 |
各社の公式サイトを2026年8月3日に確認しています。料金・キャンペーン・給付金の条件は変更されるため、申込み前は各社公式ページの最新条件をご確認ください。
※給付金は年齢だけで決まる制度ではありません。対象者・対象コース・申請時期・修了や転職などの条件をご確認ください。
※給付金は年齢だけで決まる制度ではありません。対象者・対象コース・申請時期・修了や転職などの条件をご確認ください。
AI動画のプロンプトは、文章を長くするほど正解に近づくものではありません。モデルが受け取れる入力形式、生成できる秒数、カメラの制御、音声の対応範囲を先に確認し、必要な条件だけを順番に指定することが重要です。
この記事では、2026年8月4日時点で公式情報を確認できるAI動画ツールを基準に、ツールの選び方、プロンプトの型、失敗したときの直し方を整理します。過去のモデル名や一律の無料枠を前提にせず、公開前に確認すべき権利・表示の注意点まで扱います。
先に結論
初めてなら、まず「何を動かすか」「何秒の動画か」「音声が必要か」を固定してください。Runway Gen-4.5は短いテキスト・画像からの映像とカメラ指示、Google Veo 3.1は音声付きの映像やフレーム指定、Luma Ray3.2はLumaの現行モデルを使った制作、Vidu Q3は音声付きで長めの1カットを試す用途から比較すると、選択理由を説明しやすくなります。
AI動画ツールはモデル名より「入力」と「出力」で選ぶ
AI動画の比較で混乱しやすいのは、モデル名と提供サービス、料金プランが同じものとして扱われがちな点です。同じモデルでも、Webアプリ、API、動画編集サービス内の機能で使える入力形式・解像度・音声・クレジットが異なります。下表は、現行の公式情報で確認できる範囲を切り出した比較です。
| モデル・サービス | 確認できる入力・出力 | 向いている用途 | 確認が必要な点 |
|---|---|---|---|
| Runway Gen-4.5 | テキスト→動画、画像→動画。2〜10秒、720p、複数の画面比率に対応 | 短い広告素材、カメラ移動、画像を起点にした演出 | Standard以上のプラン、12クレジット/秒などの条件を公式画面で確認 |
| Google Veo 3.1 | テキスト・画像からの動画、音声付き動画、先頭・末尾フレームなど | 会話、効果音、縦型動画、前後の画をつなぐ制作 | Gemini、Flow、API、Vertex AIなど提供面ごとに機能・解像度・料金が異なる |
| Luma Ray3.2 | Lumaが案内する2026年6月リリースの現行動画モデル | Lumaの制作環境で、現行モデルを試しながら映像表現を詰める用途 | 利用面、プラン、クレジット、機能はLumaの現行画面で確認する |
| Vidu Q3 | ネイティブ音声付き動画、1回の生成で最大16秒、カメラ・テンポ指定 | 短いストーリー、セリフや効果音を含む広告・SNS素材 | Web版とAPI版で秒数、解像度、料金が変わる可能性がある |
| Sora 2 | 音声付き動画として発表されたモデル | 現行の制作候補としては扱わない | OpenAI公式告知ではSora製品は2026年4月26日に利用終了。現在のアクセス可否を前提にしない |
RunwayのGen-4.5は、公式ヘルプでテキスト・画像からの動画、2〜10秒、720p、12クレジット/秒などの条件が明示されています。Veo 3.1は音声やフレーム指定が強みですが、どの機能が使えるかは提供面で変わります。Soraは旧記事のように「今すぐ使える代表ツール」として並べるのではなく、OpenAIの提供終了告知を確認したうえで、候補から外すのが安全です。
プロンプトに入れる8項目
最初から世界観や撮影意図をすべて盛り込むと、どの条件が効いたのか分からなくなります。次の8項目を上から埋め、生成結果を見て1項目だけ修正してください。
- 主役:人物、商品、動物、建物など。色・形・年齢・素材も必要な分だけ指定する
- 動作:歩く、振り向く、手に取るなど、開始と終了が想像できる動きにする
- 場所と時間:室内・屋外、季節、時間帯、天候を指定する
- 構図:全身、胸上、俯瞰、中央配置など、主役の見え方を決める
- カメラ:固定、ドリー、パン、手持ち風など、1カットで主となる動きを1つ選ぶ
- 光と質感:自然光、逆光、柔らかい影、商品写真風などを指定する
- 時間設計:何秒で何が起こるか、前半・後半の変化を短く書く
- 音声と制約:会話、環境音、字幕の有無、画面比率、避けたい表現を明記する
「高品質」「映画のように」といった形容詞だけでは、結果の良し悪しを判断できません。「開始2秒は固定、3秒目から右へ移動」のように、観察できる条件へ変換するのがコツです。
失敗したらプロンプトを長くせず、原因を1つに絞る
生成結果が崩れたときは、すべてを書き直すのではなく、失敗した項目を記録します。次の表のように「症状→仮説→1回の修正」を残すと、ツールを変えても知見を再利用できます。これは、この記事でおすすめする独自のプロンプト検証方法です。
| 症状 | 考えられる原因 | 次に変える条件 |
|---|---|---|
| 人物や商品が途中で別物になる | 主役の特徴が曖昧、または動作を詰め込みすぎ | 外見の特徴を3つまで固定し、1カットの動作を1つに減らす |
| カメラも被写体も動きすぎる | カメラ指示と動作指示が競合している | カメラを固定にして被写体だけ動かし、次の生成でカメラを追加する |
| 口の動きと音声が合わない | セリフ、話者、発話時間が曖昧 | 話者を1人に絞り、短いセリフと発話タイミングを指定する |
| 縦型にすると主役が切れる | 横長前提の構図をそのまま縦にしている | 先に9:16を選び、主役を中央寄りに置く指示を追加する |
| 動画はきれいだが広告として弱い | 映像の説明だけで、視聴者の行動が決まっていない | 冒頭の引き、商品が見える秒数、最後の行動喚起を別々に指定する |
Runway Gen-4.5で使えるプロンプト5例
Runwayの公式ヘルプでは、Gen-4.5はテキスト・画像からの動画、複雑な連続指示、カメラ動作に対応し、生成時間は2〜10秒と案内されています。例文はその仕様を前提にしていますが、プランや画面の変更は生成前に確認してください。
例1:商品を見せる固定カメラ
A matte black water bottle stands on a pale stone table. The camera remains locked. Soft morning light moves across the label while one small water droplet rolls down the bottle. Minimal product commercial, clean background, 6 seconds.
例2:画像を起点にしたカメラ移動
Use the uploaded street photo as the visual reference. Start with a wide shot, then make a slow forward dolly toward the neon sign. Keep the building shapes and sign lettering consistent. Rainy evening, realistic reflections, restrained motion, 8 seconds.
例3:人物の一動作
A woman in a navy coat stands on a quiet train platform. She looks at the arriving train and gently turns her head to the right. Keep her face, coat, and hairstyle consistent. Natural overcast light, medium shot, 5 seconds.
例4:縦型SNS用の短いカット
Vertical 9:16 video. A baker places one warm croissant on a white plate, then looks at the camera with a small smile. Keep the croissant fully inside the frame. Bright window light, clean food advertisement, 6 seconds.
例5:カメラと被写体を分ける
First 3 seconds: a red kite moves slowly in the wind while the camera is fixed. Last 3 seconds: the camera tilts upward to follow the kite. Keep the sky simple and the kite shape unchanged. Documentary style, 6 seconds.
Google Veo 3.1で使えるプロンプト5例
Google DeepMindの公式ページでは、Veo 3.1はテキスト・画像からの動画、音声付き動画、先頭・末尾フレーム、アウトペインティング、オブジェクト追加などの機能が案内されています。実際の利用面によって選べる機能が違うため、プロンプト例は「対応している画面で使う」前提です。
例6:環境音を含む縦型動画
Vertical 9:16, 8-second video. A small coffee shop opens its wooden door at dawn. Include the soft bell on the door, quiet street ambience, and the sound of a coffee grinder starting. Warm natural light, slow camera push-in.
例7:短い会話
Two colleagues stand beside a whiteboard in a bright office. One says in Japanese, 「この案で進めましょう」, and the other nods. Natural room ambience, clear speaker turns, medium shot, no subtitles, 8 seconds.
例8:先頭フレームから始める
Use the uploaded first frame as the opening composition. A paper airplane leaves the desk, crosses the room, and lands beside a window. Preserve the desk, window, and paper color throughout. Gentle afternoon light, 8 seconds.
例9:商品を中心にした音声付き広告
A silver travel mug rotates slowly on a wooden table. A calm voice says, 「毎日の移動を、少し軽く」. Add a subtle city ambience but keep the voice clear. Product advertisement, centered composition, 8 seconds.
例10:前後のフレームをつなぐ
Begin with the uploaded empty park bench image and end with the uploaded image of a person sitting on the bench. Create a natural transition through changing sunlight and moving leaves. Keep the bench position stable, cinematic realism, 8 seconds.
Luma Ray3.2で使えるプロンプト5例
Lumaの現行モデル情報では、Ray3.2が2026年6月にリリースされた動画モデルとして案内されています。旧記事にあったRay2や「Dream Machine」を現行モデル名として固定せず、LumaのアプリまたはAPIで表示されるモデル・プランを確認してから使います。
例11:静かな情景
A quiet Japanese garden after rain. A single maple leaf falls into a shallow pond and creates small ripples. The camera makes a very slow lateral move. Muted colors, soft fog, contemplative mood, 6 seconds.
例12:画像から雰囲気を広げる
Use the uploaded portrait as the visual reference. Preserve the person identity and clothing. Add a gentle breeze that moves only the hair and nearby curtains. Soft window light, subtle motion, intimate documentary style, 6 seconds.
例13:建物の連続性
A red brick bookstore on a narrow street at blue hour. Start with a wide exterior view, then move slowly toward the entrance. Keep the sign, windows, and brick pattern consistent. Warm interior light, realistic architecture, 8 seconds.
例14:料理の短い工程
Close-up of hands placing three sliced strawberries on a tart. The camera remains steady and the hands move slowly. Keep the tart shape and fruit positions natural. Bright kitchen light, clean food editorial style, 5 seconds.
例15:幻想的な風景
A small lighthouse stands on a dark blue coast under a wide night sky. Clouds move slowly behind the lighthouse and one warm beam sweeps across the water. Keep the lighthouse structure unchanged. Dreamlike but physically believable, 8 seconds.
Vidu Q3で使えるプロンプト5例
Vidu Q3の公式ページでは、音声・動画の同時生成、セリフ・ナレーション・効果音・音楽、最大16秒の1回生成、フレーム単位のカメラ制御が案内されています。音声を使う例では、話者と音の役割を分けて書き、生成後に聞き取りやすさを確認します。
例16:ナレーション付き商品紹介
16-second vertical product video. A compact desk lamp turns on as evening arrives. Japanese narration: 「机の上に、集中できる明かりを」. Add a soft switch click and quiet room ambience. Keep the lamp centered and the background uncluttered.
例17:短いストーリー
16-second story in three beats: a child finds a blue umbrella, walks through light rain, and shares it with a small dog. Gentle footsteps and rain sounds. No dialogue. Keep the umbrella blue and the child outfit consistent across the three beats.
例18:カメラとテンポの指定
12-second video. Start with a slow close-up of a train ticket, then pull back at a medium pace to reveal a station entrance. Add distant station ambience and one soft announcement. Keep the ticket text unreadable and the camera movement smooth.
例19:人物のセリフ
10-second vertical scene. One person at a kitchen counter says in Japanese, 「今日は早く帰れたね」. A second person smiles but does not speak. Natural kitchen ambience, clear turn-taking, warm evening light, medium shot.
例20:SNS向けの一言訴求
8-second vertical advertisement for a reusable shopping bag. The bag unfolds from a pocket, holds several vegetables, and closes neatly. Add a short upbeat sound effect and a calm voice saying, 「持ち歩ける、いつもの選択」. Keep the logo readable only if it is present in the reference image.
用途別に使えるプロンプト5例
ツールを先に決めるより、完成動画を置く場所から逆算するとプロンプトが短くなります。次の5例は、特定モデルの機能に依存しすぎない基本形です。画面比率や音声の指定は、選んだツールの対応状況に合わせて残してください。
例21:SNSの冒頭3秒
Vertical short-form video. In the first 2 seconds, a bright yellow notebook drops onto a desk. In the next 4 seconds, a hand opens it to a clean page. Strong opening movement, centered object, clear daylight, no extra text.
例22:サービス紹介
A small business owner receives a notification, checks a simple dashboard, and smiles with relief. Three clear shots, calm pacing, realistic office light, no identifiable personal data on the screen. End with empty space on the right for a title overlay.
例23:採用・会社紹介
Documentary-style montage of a team entering a bright workshop, checking a prototype, and discussing around a table. Show natural collaboration rather than staged poses. Warm but realistic colors, three short shots, leave space for captions.
例24:アニメーション風の演出
Stylized 2D animation of a paper boat traveling along a stream at sunset. The boat moves from left to right while the background scrolls slowly. Keep the color palette limited to orange, blue, and cream. Smooth motion, no text.
例25:複数カットのつながり
Create three matching shots of the same green suitcase: in a bedroom, at a station, and beside a hotel door. Keep its size, color, handle, and small sticker consistent. Use the same camera height and gentle forward motion in each shot.
生成前に料金・無料枠・提供面を確認する
AI動画サービスの料金は、無料枠、クレジット、解像度、生成秒数、API利用で変わります。古い記事にある「無料で何本作れる」「このモデルは必ず使える」という表現は、更新時点がずれると誤情報になります。比較するときは、公式画面で次の4点を同じ条件で確認してください。
- 使いたいモデルが、Web版・アプリ・APIのどこで提供されているか
- 1本の生成に必要なクレジットと、再生成・アップスケールの扱い
- 秒数、画面比率、解像度、音声、透かしの条件
- 商用利用、入力画像、人物・ロゴ・音源の権利条件
AI動画を公開するときの権利と表示
生成できたことと、公開してよいことは別です。人物の顔・声、商品ロゴ、写真、音源、店舗や施設の映像を使う場合は、入力素材の利用許諾を確認します。実在人物に見える映像や、事実と誤認される映像は、AI生成であることや編集内容を説明できるようにしておくと、視聴者とのトラブルを減らせます。
Googleは、AI生成画像や動画に不可視のウォーターマークを付け、検出に使える仕組みとしてSynthIDを案内しています。ただし、すべてのAI動画サービスに同じ仕組みが付くわけではありません。ウォーターマークの有無を、権利確認や公開時の表示の代わりにしないでください。
AI動画プロンプトのよくある質問
AI動画のプロンプトは日本語と英語のどちらがよいですか?
優劣を固定するより、選んだモデルが意図を再現できる書き方を優先します。短い文、主役・動作・カメラの順序、固有名詞の説明をそろえ、同じ条件を日本語と英語で1回ずつ試して比較すると判断できます。
長い動画を1回で作るべきですか?
短いカットを複数作って編集する方が、主役や動きの崩れを直しやすい場合があります。Runway Gen-4.5のように生成秒数が明示されるモデルもあれば、Vidu Q3のように最大秒数が異なるモデルもあるため、完成尺ではなく1カットの役割から分けてください。
Soraは今もAI動画の比較対象ですか?
OpenAIの公式告知ではSora製品は2026年4月26日に利用終了とされています。旧記事のように現行の利用候補として紹介せず、アクセスできると確認できた場合だけ公式情報を再確認してください。
AI動画を広告やSNSで使うときに必要なことは?
入力素材の権利、生成サービスの商用利用条件、人物・声・ロゴの扱い、AI生成であることの表示を確認します。完成動画に事実らしい演出が含まれる場合は、視聴者が実写と誤認しない説明も加えます。
AI動画を作る前に固定する3つの判断
プロンプトを改善する前に、次の3つを決めると、ツール選びと修正の方向がぶれません。
- 目的:SNSの冒頭、商品の説明、長尺動画の素材など、動画の役割を1つにする
- 出力:縦・横、1カットの秒数、音声の要否、字幕を後付けするかを決める
- 公開条件:素材の権利、商用利用、AI表示、事実との区別を確認する
動画の企画や制作工程だけでなく、生成AIを使ったコード作成や作業の整理にも関心がある場合は、ChatGPTでプログラミングを活用する方法も参考になります。





