AI動画生成の業務導入モデルは、短いカットを試し、製品事実と権利を人が検証してから一本に編集する制作を対象にします。 本稿では法人向け設備管理SaaSの90秒オンボーディング動画を題材にします。会社、工数、成果は編集部が設定した架空条件で、Google Cloudの仕様・料金など出典付きの事実とは分けて示します。
AI動画生成の業務活用を90秒・12カットの想定事例で検証する
架空企業「北辰ファシリティソフト」は、設備点検アプリの利用開始時に、管理者が行う三つの設定を動画で案内しているとします。従来稿は画面収録、ナレーション収録、モーショングラフィックスを制作会社へ一括発注し、完成まで15営業日かかっていました。四半期ごとに管理画面が変わるため、古いボタン位置が残ると問い合わせが増えます。
今回のAI利用は、実画面そのものを作り替えるのではなく、冒頭の課題提示、抽象的な設備イメージ、章間のつなぎ、終端の行動喚起に限定します。
完成物は16:9、1080p、90秒、12カットです。実在製品の操作を示す6カットはテスト環境の画面収録を正本とし、生成映像は使いません。残る6カットを各8秒以内の生成素材とし、編集時に3〜6秒へ切り詰めます。
Google Cloudの「Veo 3」仕様ページは、4秒・6秒・8秒、16:9または9:16、720pまたは1080p、24fps、MP4という出力条件を示しています。ページの最終更新日は2026年7月24日です[1]。この制約から、90秒を一度に生成する計画ではなく、編集可能な短尺素材へ分割します。
| 確認対象 | 合格条件 | 正本 | 不合格時の扱い |
|---|---|---|---|
| 製品操作 | ボタン名、順序、遷移先が検証環境と一致 | リリース候補版の画面収録 | 生成で補わず、製品担当へ差し戻す |
| 生成カット | 人物、設備、保護具、時刻の矛盾がない | 承認済み絵コンテと素材台帳 | 二回まで再生成し、直らなければ素材サイトへ切り替える |
| ナレーション | 確定台本と一字一句一致し、固有名詞の読みが正しい | 法務・製品確認済み台本 | 該当文だけ再収録して波形を再確認する |
| 字幕 | 意味の欠落がなく、表示時間が発話区間に収まる | 確定台本とタイムコード | 字幕担当が手修正し、自動確定させない |
| 権利 | 全カットに出所、利用範囲、承認者が記録済み | 素材・音源・人物同意の台帳 | 一項目でも空欄なら書き出しを止める |
この事例の中心は「動画をAIだけで完成させること」ではなく、生成してよい6カットと、実物を撮る6カットの境界を公開前に守れることです。
生成対象にするカットと従来撮影へ戻すカットを比較する
AI動画は、現実に存在しない概念表現や、厳密な製品再現を求めない短い背景素材で効率が出やすい一方、手順、寸法、安全動作、人物の発言を証拠として示す場面には不向きです。
原著論文「Lumiere: A Space-Time Diffusion Model for Video Generation」(Bar-Talほか、arXiv:2401.12945、2024年1月公開)は、時間方向を含む一貫した動きの生成を技術課題として扱っています[5]。
研究上の改善は、特定製品の物理挙動やブランド表現が業務上正しいことを保証するものではありません。そのため、見栄えの評価と事実の評価を分離します。
| カット | 表現する内容 | 選ぶ方式 | 判断理由 |
|---|---|---|---|
| 1 | 紙の点検票が積み上がる抽象場面 | テキストから動画生成 | 架空の状況で、実在設備の正確な再現を要しない |
| 2 | 建物とセンサーを結ぶ概念図 | 静止画生成後に編集で動きを付与 | 文字を映像モデルへ任せず、線とラベルを編集側で固定できる |
| 3〜5 | 管理者登録、拠点登録、担当者招待 | 検証環境の画面収録 | クリック位置と表示文言が製品事実に当たる |
| 6 | 章間の設備フロア移動 | 画像から動画生成 | 承認済みの無人フロア画像だけを参照できる |
| 7〜9 | 点検予定、通知、完了確認 | 検証環境の画面収録 | 誤ったUIを見せると利用者が操作できなくなる |
| 10〜12 | 効果の概念、問い合わせ先、ロゴ | 生成素材と手作業の合成 | ロゴ、URL、数値は編集ソフトで正確に配置する |
生成へ回さない条件も先に書きます。保守員が機械を止める手順、保護具の着用方法、薬機・金融・法令に関わる説明、顧客の証言、事故映像、実在人物の顔や声を模した場面は、この試作の対象外です。生成映像の手指や計器が一瞬だけ崩れる場合でも、安全や性能の説明に接続するなら採用しません。修正で隠すのではなく、画面収録、3D、実写、ライセンス済み素材のいずれかへ戻します。
入力素材と権利台帳を同じカット番号で管理する
入力は、確定台本、絵コンテ、ブランドガイド、製品画面、参照画像、ナレーション、音楽、字幕原稿に分けます。画像から動画を作る場合、Veo 3の公式仕様では入力画像の上限が20MBとされています[1]。技術的に受け付けられる形式でも、顧客ロゴ、人物、撮影場所、機密設備が写る画像は、利用根拠を確認できるまでアップロードしません。
EXIFに位置情報が残る撮影素材は、原本を保全したうえで作業コピーから削除します。
この想定案件の受付形式は、台本をUTF-8のCSV、絵コンテをPDF、参照静止画をPNGまたはJPEG、画面収録をMP4、音声をWAVに固定します。形式名だけで受理せず、カットID、版番号、作成者、権利台帳IDを伴わないファイルは制作キューへ入れません。これはモデル共通の対応形式ではなく、変換時の欠落と素材の取り違えを防ぐために案件側で定める入力契約です。
文化審議会著作権分科会法制度小委員会「AIと著作権に関する考え方について」(2024年3月15日)は、生成・利用段階の侵害判断で既存著作物との類似性と依拠性が問題になり得ること、同文書自体は法的拘束力を持たず個別事案の最終判断ではないことを説明しています[4]。したがって「生成物だから自由に使える」とは扱いません。
プロンプトに作家名や競合広告の固有表現を入れず、類似が疑われる出力は法務担当へ送り、公開期限を理由に承認を省略しない運用にします。
| 列 | 記入例 | 空欄時の処置 |
|---|---|---|
| cut_id | C06 | 編集タイムラインへ配置しない |
| 入力の出所 | 自社撮影・無人設備フロア・2026-07-18 | データ管理者へ出所確認を依頼 |
| 許諾範囲 | 自社Web、営業資料、展示会で2027年3月まで利用 | 用途を限定した再許諾を取得 |
| 人物・個人情報 | 人物なし、位置情報削除済み | マスキング後に別担当が再確認 |
| 生成条件 | モデルID、プロンプト、seed、生成日時、担当者 | 同じ素材を再現できないため不採用 |
| 類似性確認 | 検索・社内素材照合済み、懸念なし | 法務判断が完了するまで公開保留 |
| 最終承認 | 制作責任者とブランド責任者の二名 | 書き出しジョブを実行不可にする |
C2PA Specifications 2.4は、メディアの来歴を検証可能にするContent Credentials関連仕様をまとめています[3]。資格情報が付く製品では保持して書き出しますが、付与の有無だけで映像の真実性や許諾を断定しません。台帳、編集履歴、承認記録と組み合わせ、どの情報を誰が確認したかまで追跡します。
絵コンテから最終書き出しまでを7段階で進める
制作を安定させるには、プロンプトの試行を始める前に、映像で主張する事実を固定します。モデルを変えると画風や人物の一貫性が変わるため、一つの案件内ではモデルID、解像度、縦横比、参照画像、主要な指示語を固定します。
経済産業省「AI事業者ガイドライン第1.2版」(2026年3月31日)は、AI開発者・提供者・利用者の役割を分け、リスクに応じた記録と見直しを求める任意の指針です[6]。本事例では制作責任者をAI利用者側の最終判断者に置きます。
- 主張表を確定する:各カットが伝える一文、根拠となる製品仕様、禁止する誇張を製品責任者が承認する。
- 絵コンテを12枠に分ける:画面収録6枠、生成6枠を色ではなく制作方式名で明記し、尺の合計を90秒に合わせる。
- 低解像度の候補を作る:生成カットごとに三案を出し、構図と動きだけを比較して、文字やロゴは後工程へ回す。
- 採用候補を再生成する:1080p、16:9、24fpsで統一し、出力ファイルと生成ログをcut_idへ結び付ける。
- 画面収録と合成する:UIは検証環境から収録し、カーソル位置、ズーム、個人情報のダミー化を確認する。
- 音声と字幕を付ける:ナレーション波形、BGMライセンス、字幕タイムコードを別トラックで管理する。
- 三者確認後に書き出す:製品担当、ブランド担当、権利確認担当が同じ版番号を見て承認する。
案件内の生成単位12カット = 画面収録6 + 生成6生成6カット × 3候補 = 初回18本採用候補6本 × 再生成2案 = 仕上げ12本予定生成数 = 30本停止上限 = 45本(予定の1.5倍)45本に達しても6カットが合格しない場合: 追加生成を止める 該当カットを静止画モーションまたは素材映像へ変更する
処理時間は、担当者が操作した時間と生成サービスを待った時間を分けて計ります。各ジョブには受付時刻、処理開始、完了通知、担当者が候補を開いた時刻を保存し、「生成待ち時間=完了通知-受付時刻」「確認着手までの滞留=候補を開いた時刻-完了通知」として集計します。この想定案件では、1日目に台本と主張表、2日目に絵コンテ、3日目に初回18本、4日目に仕上げ12本、5日目に編集、6日目に三者確認、7日目に修正と書き出しを置きます。1ジョブが30分を超えても状態を取得できない場合は同じ要求を再送せず、ジョブIDを添えて運用担当へ引き継ぎます。初回18本の90パーセンタイルが60分を超える、または4日目の正午までに合格候補が4カット未満なら、生成待ちで納期を使い切る前に静止画モーションへ二カットを切り替えます。これにより、APIが速い一例だけで7営業日を見積もらず、キュー待ちと人のレビュー待ちのどちらが遅延原因かを案件終了時に説明できます。
生成待ちが長くても同じ指示を連打しません。ジョブIDと状態を確認し、二重課金や似た候補の増殖を避けます。モデルのプレビュー版、廃止予定版、地域制限がある機能を本番工程へ入れる場合は、移行日と代替モデルを制作計画へ記載します。Veo 3公式ページにはプレビューの廃止先と推奨GAエンドポイントが掲載されているため、案件開始日に再確認します[1]。
確認画面では映像・音声・字幕・権利を一つの時刻へそろえる
レビュー画面は、左に再生映像、右上に確定台本と製品仕様、右下にカット別の判定欄を置きます。再生ヘッドを動かすと、該当時刻のナレーション、字幕、入力素材、生成条件、権利状態が同時に切り替わる設計です。コメントだけの確認では「どのフレームの何が違うか」が残らないため、開始時刻と終了時刻を必須にします。承認者は完成動画だけでなく、生成前の正本へ戻って比較できます。
| 観点 | 確認方法 | 合格 | 人へ戻す条件 |
|---|---|---|---|
| 時間的一貫性 | 開始・中央・終了の3フレームと全速再生を比較 | 人物、設備、光源が不自然に変形しない | 一瞬でも別物に見える、物体が出現・消失する |
| 製品事実 | 主張表と検証環境を横並び表示 | 機能名、操作順、数値が正本と一致 | 存在しない機能、誤ったUI、根拠のない効果がある |
| 音声同期 | 波形と口形または画面遷移のタイムコードを照合 | ずれが200ミリ秒以内という案件基準を満たす | 語頭が切れる、字幕より先に次の場面へ進む |
| 字幕 | 台本差分と固有名詞辞書を機械照合後に目視 | 誤字0、重要語欠落0、1行の長さが社内基準内 | 数字、URL、製品名、否定表現に差分がある |
| 権利・個人情報 | カットIDから素材台帳を開く | 出所、許諾、保存期限、承認者がそろう | 実在人物の類似、競合ロゴ、顧客情報の疑いがある |
| 来歴 | ファイルのContent Credentialsと編集履歴を確認 | 生成・編集の経路を社内記録から追える | 来歴情報が欠け、元データも特定できない |
確認画面の「承認」は、カット単体、音声付き仮編集、最終書き出しの三段階に分けます。カット単体で合格しても、連結後に人物の服装や時間帯が変われば再審査です。最終版には不可視の修正が紛れないよう、承認対象ファイルのSHA-256、長さ、解像度、音声チャンネル数を記録します。承認後に字幕だけを直した場合も新しい版番号を振り、以前の承認を流用しません。
生成秒数、再試行、人の確認を分けて制作費を試算する
Google Cloudの生成AI料金ページでは、2026年7月30日の参照時点でVeo 3.1 Fastの1080p・音声なし動画が1秒0.10米ドル、Veo 3.1の1080p・音声なし動画が1秒0.20米ドルと示されています[2]。以下はVeo 3.1 Fastを用いる想定試算です。
税、クラウド保存、編集ソフト、為替差、失敗応答の扱い、最低利用額は含みません。実際の見積もりでは契約地域と請求画面を確認します。
生成費の想定8秒 × 45本 × 0.10米ドル/秒 = 36.00米ドル想定為替 1米ドル = 150円36.00米ドル × 150円 = 5,400円人件費の想定企画4時間 + 絵コンテ5時間 + 生成操作4時間+ 編集7時間 + 三者確認6時間 = 26時間26時間 × 5,000円/時間 = 130,000円音源・ナレーションの想定 = 25,000円想定合計 = 5,400円 + 130,000円 + 25,000円 = 160,400円
比較対象の従来制作は、外注費300,000円と社内確認8時間×5,000円で340,000円、納期15営業日という想定です。AI併用案は160,400円、7営業日なので、差額は179,600円、短縮は8営業日になります。ただし、初回だけ必要なレビュー画面改修80,000円と台帳整備40,000円を含めると初回総額は280,400円で、差額は59,600円まで縮みます。二回目以降もUI変更や権利確認が多ければ、削減効果は同じになりません。
| 費目 | 従来制作の想定 | AI併用の想定 | 実測へ置き換える値 |
|---|---|---|---|
| 外部・API費 | 制作会社300,000円 | 生成5,400円、音源等25,000円 | 請求書の税込額と為替 |
| 社内時間 | 確認8時間 | 企画から確認まで26時間 | タイムトラッキングの承認済み時間 |
| 初期整備 | 既存フロー内 | レビュー画面・台帳120,000円 | 開発、教育、保守の実額 |
| 再制作リスク | 契約の修正回数に依存 | 45本を超えたら方式変更 | 不合格カット数と追加編集時間 |
API単価だけを見て「動画一本5,400円」と説明するのは不適切です。承認済み動画までの総費用には、入力整備、再生成、編集、字幕、権利確認、保存、教育、失敗時の代替素材が入ります。生成本数が45本へ達した時点を費用面の停止条件とし、候補が増えるほど良いという運用を避けます。
公開できた秒数と重大差分で導入前後を評価する
再生回数や生成本数では、制作が良くなったか判断できません。この想定事例では、承認済み秒当たり総費用、初回合格率、重大差分、確認時間、公開後の訂正件数を測ります。初回合格率が上がっても、製品事実の誤りが一件あれば公開可否は別判定です。見栄えの平均点で重大な一カットを埋め合わせない設計にします。
| 指標 | 計算式 | 想定結果 | 判定基準 |
|---|---|---|---|
| 承認済み秒当たり総費用 | 案件総費用 ÷ 公開版90秒 | 160,400円÷90秒=1,782円/秒 | 従来340,000円÷90秒=3,778円/秒より低い |
| 生成カット初回合格率 | 初回候補で採用できたカット ÷ 生成対象6カット | 4÷6=66.7% | 50%以上を継続条件とする編集部案 |
| 重大差分率 | 事実・権利の重大差分カット ÷ 全12カット | 0÷12=0% | 一件でも残れば公開不可 |
| 確認時間 | 三者確認の合計時間 ÷ 全12カット | 6時間÷12=30分/カット | 品質を保ったまま次回20分以下を目指す |
| 公開後訂正率 | 30日以内に差し替えた動画 ÷ 公開動画数 | 試作段階のため未測定 | 事実誤認または権利理由の差し替え0件 |
66.7%や1,782円という値は公開実績ではなく、比較方法を示すための計算例です。実運用では案件ごとに生成対象の難しさが異なるので、商品実写、人物、抽象表現を同じ母集団へ混ぜません。公開後30日で問い合わせログを確認し、「動画どおりに操作できない」という申告が一件でもあれば、該当版を非公開にして製品担当が原因を調べます。
視聴維持率は内容理解の手掛かりになりますが、権利や事実の合格を代替しません。
権利不明、事実誤認、再生成超過を公開停止へ結び付ける
導入障壁は、モデルの操作よりも、誰が止めるか曖昧な点に現れます。制作担当は見た目を直せても、製品仕様の正誤、著作物との類似、人物同意、広告表示の適否を単独では決められません。そこで、製品差分はプロダクト責任者、権利疑義は法務、個人情報は管理責任者、費用超過は制作責任者へ戻します。
担当部署が回答しないまま公開日を迎えた場合、公開日を動かし、未承認素材を使う判断はしません。
| 停止条件 | 検知方法 | 停止範囲 | 代替策 |
|---|---|---|---|
| 入力権利が確認できない | 素材台帳の許諾範囲が空欄 | 該当素材を使う全カット | 自社撮影または用途明記の素材へ交換 |
| 既存作品との類似が疑われる | ブランド担当または検索で近似表現を発見 | 法務結論が出るまで公開版全体 | 構図と表現を変更し、再度照合 |
| 製品挙動が正本と違う | 検証環境との横並び確認 | 誤りを含むカットと関連字幕 | 画面収録へ置き換える |
| 生成が45本を超える | ジョブログの本数集計 | 該当生成カット | 静止画モーションか実写へ変更 |
| 人物・顧客情報が混入する | フレーム目視と素材台帳照合 | 案件を隔離し共有を停止 | 情報管理責任者の指示で削除・報告 |
| 公開後に重大誤りが判明する | 問い合わせ・監視窓口から通報 | 公開チャネルから直ちに取り下げ | 原因記録後に正しい版を再承認 |
この方法が向かない案件
一回の撮影で証拠性を担保すべき事故記録、機械の安全教育、医療行為、契約当事者の証言、実在人物の推薦コメントには、この想定フローを当てません。生成であることを表示しても、誤った動作や発言のリスクは消えないためです。
AI事業者ガイドライン第1.2版は法令そのものではなく、事業者の自主的な取組を支える指針です[6]。一方、契約、著作権、個人情報、業界規制には個別の判断が必要です。判断が必要な資料を制作担当のチェック欄だけで済ませず、専門部署の回答文書または承認番号へリンクします。
他社へ再現する前に100点の適用判定票で採否を決める
この事例を再現できるのは、短尺へ分割でき、正本があり、生成部分を別素材へ交換できる会社です。次の判定票は編集部の提案で、80点以上かつ必須項目をすべて満たす場合だけ試作へ進みます。費用効果が高くても、権利台帳と停止権限が未整備なら見送ります。60〜79点は入力や体制を整えて再評価し、59点以下は撮影・画面収録・既存素材を主軸にします。
| 判断項目 | 配点 | 満点条件 | 必須 |
|---|---|---|---|
| 事実の正本 | 20 | 製品仕様、確定台本、検証環境を同じ版で参照できる | 必須 |
| 生成範囲 | 15 | 全カットの半数以下で、代替素材へ戻せる | 必須 |
| 権利と個人情報 | 20 | 入力・出力・音源・人物をカット単位で記録できる | 必須 |
| 確認体制 | 15 | 製品、ブランド、権利の三者が同じ確認画面を使える | 必須 |
| 費用上限 | 10 | 生成本数、API費、人件費、代替費の上限がある | 任意 |
| 処理時間 | 10 | 生成待ちとレビューを含む締切を試算済み | 任意 |
| 公開後対応 | 10 | 取り下げ権限、連絡先、元版への復旧手順がある | 必須 |
たとえば、正本20点、生成範囲15点、権利10点、確認15点、費用10点、処理時間5点、公開後10点なら合計85点です。しかし権利が満点でなく必須条件を落としているため、点数だけなら80点を超えても試作開始は不可です。素材ごとの利用範囲を確定してから再採点します。この「点数と必須条件の二重判定」により、安価という理由で権利確認を相殺できないようにします。
次に取る行動は一本の絵コンテを制作方式で仕分けること
自社で最初に行う作業は、予定している一本の動画を8〜15カットへ分け、それぞれを「画面収録」「実写」「生成」「ライセンス素材」「文字・図形編集」のどれで作るか決めることです。生成候補には、正確に再現しなければならない固有名詞、人物、製品動作、数値がないかを記します。全カットを生成へ寄せる案ではなく、置換可能な2〜6カットから試します。
次に、生成候補一つだけで三案を作り、素材台帳、レビュー票、費用記録まで通します。見栄えが良くても、出所を説明できない、正本と比較できない、45本の上限内で合格しない場合は方式変更です。反対に、権利と事実を追跡でき、承認済み秒当たり総費用と納期が従来案を下回るなら、同じ判定票で残りのカットへ広げます。
参考文献・出典
- AI動画生成の公式モデル仕様:Google Cloud「Veo 3」(モデル仕様、最終更新2026年7月24日、参照日2026年7月30日)
- Google Cloud「Vertex AI Pricing – Veo」(料金表、版表記なし、参照日2026年7月30日)
- Coalition for Content Provenance and Authenticity「C2PA Specifications 2.4」(Version 2.4、参照日2026年7月30日)
- 文化審議会著作権分科会法制度小委員会「AIと著作権に関する考え方について」(2024年3月15日、参照日2026年7月30日)
- Omer Bar-Talほか「Lumiere: A Space-Time Diffusion Model for Video Generation」(arXiv:2401.12945、2024年1月23日公開、参照日2026年7月30日)
- 経済産業省「AI事業者ガイドライン 第1.2版」(2026年3月31日、掲載ページ最終更新2026年4月1日、参照日2026年7月30日)
これで「AI動画を使うか」という抽象論を、一本の制作判断へ落とし込めます。