
READ REPORT
東大広告研究所さんのAIアニメ広告の作り方を、私の講座動画の音声工程と重ねて読んだ
2026年10月6日
家事と子育てのスキマで経営する3方よしAI共創コンサルタントの田中啓之、ひろくん(@passion_tanaka)です。今回は、東大広告研究所さん(@adops_lab)がXのアーティクルで公開した、アニメ広告をAIで作る方法を紹介するね。私が持ち帰ったのは、映像を作る前に、誰のどんな疑問に答える広告かを一文で決める、という順番です。
商品の特徴を台詞で読み上げるだけの広告は、見る人にとって説明を聞かされる時間になります。東大広告研究所さん(@adops_lab)のXアーティクルは、AIで自主制作した会話型のアニメ広告を例に、台本・原画・音声・動きを分けて作る方法を説明しています。2026年9月29日公開。先に人物の目的を決め、商品はその行動に必要な小物として登場させる。そうすると、会話と映像がつながる、という考え方です。私が学んだのは、直したくなった時に戻る先が決まるように、部品を分けておくという作り方でした。試すなら、相手の疑問と伝えたい価値を一文で決めて、台本を3案出してもらうところから。そのまま使える依頼文は、最初の章に置いています。
3行でわかるポイント
- 東大広告研究所さんは、商品名を先に出して特徴を台詞で読み上げると登場人物は説明役になる、と書いています。先に人物の目的を決め、商品を行動に必要な小物として登場させる台本の作り方です。
- 原画・商品画像・音声・字幕をコードで時間軸に置くと、台詞を変えたいときは音声と発話区間へ、表情を変えたいときは該当場面の差分へ戻れます。映像生成とコード描画は、動きの複雑さと再現性で分けます。
- 私なら、映像を作る前に、誰のどんな疑問に答える広告かを一文で決めます。分からない項目はAIに推測させず、未確認と書いて渡します。そのまま使える依頼文も、本文に置きました。
東大広告研究所(X・@adops_lab)・2026年9月29日公開。AIで自主制作した会話型のアニメ広告を例に、台本から確認までの作り方を説明したXアーティクル
東大広告研究所さんのアニメ広告の作り方から持ち帰った結論。「先に「社長へコーヒーを届けたい」のような目的があれば」商品は小物になる

東大広告研究所さん(X・@adops_lab)のアーティクル(台本の考え方の部分より)
先に「社長へコーヒーを届けたい」のような目的があれば、コーヒーは行動に必要な小物として登場します。
東大広告研究所さんは、AIで自主制作した会話型のアニメ広告の作り方を、Xのアーティクルで公開しています。人が企画と監修を担い、商品画像にはメーカーの公式素材を使っているそうです。
最初に出てくるのが、台本の考え方です。「商品名を先に出し、特徴を台詞で読み上げると、登場人物は説明役になります」。そう書かれています。
じゃあ、どう書くのか。答えは、先に人物の目的を決めることでした。例は、社長へコーヒーを届けたい。コーヒーを運んで、渡す。その動作があるから、商品カットを差し込むより、会話と映像がつながります。
自分の商材に当てはめるなら、機能から書き始めません。人物が何をしたいかから決めます。元記事の例には、二人で同じ時間を過ごしたい、価格の違いに納得したい、名前から生まれた誤解を解きたい、があります。
で、いきなり映像を考えると、手が止まります。まず台本を3案出してもらう依頼文を、元記事の指示文を短くまとめ直して置いておきます。そのままコピーして、【 】を埋めて使ってください。
コピーして使える依頼文(提案です。未実装です)
次の入力だけを事実にして、会話型アニメ広告の台本を3案作ってください。冒頭・舞台・展開・オチは案ごとに変えてください。
商品名:【 】/商品の公式情報:【公式ページの文を貼る】/広告を見る相手:【 】/相手の疑問や欲求:【 】/伝えたい価値:【1つだけ】
私なら、映像を作る前に、誰のどんな疑問に答える広告かを一文で決めます。決まっていないまま依頼すると、AIは商品の説明に寄っていくからです。
元記事も、広告で伝える価値は1つに絞る、と書いています。条件は、1つだけです。価値を3つも4つも入れると、会話が商品説明に引っ張られます。
台本・絵・声・動きを部品に分ける作り方を、講座動画の音声工程と重ねて読む。「台詞を変えたいときは音声と発話区間へ」

東大広告研究所さん(X・@adops_lab)のアーティクル(制作工程の部分より)
台詞を変えたいときは音声と発話区間へ戻り、表情を変えたいときは該当場面の差分へ戻れます。
次は、作り方の話です。元記事によると、これまでのアニメ広告は、台本、原画、音声、動きを別々に用意して、修正のたびに各担当へ戻る必要がありました。
短い広告でも調整箇所が多く、企画の段階で見送りやすい表現だったそうです。
そこでAIにアニメーションのコードを書かせると、原画、商品画像、音声、字幕を時間軸の上に置けます。動画のどの瞬間に、どの表情を出すか。口を開くか。商品をどこへ動かすか。カメラをどこまで寄せるか。
それをコードで指定する方法です。
一本の映像を毎回まとめて生成するのと比べて、直す対象を切り分けやすくなります。そこが、この方法のいちばんの効き所だと、元記事は見ています。直す所が決まります。
これを読んで、私の講座動画と同じ向きだな、と思った所があります。台詞を1行ずつ音声にする工程です。
AI氣道『Claude Codeで台本から動画を作る手順を、最初に1分の見本を頼む流れでmanaさんが解説』より
「私の講座動画も、台本を1行ずつ読ませて、つないでいます。声の聴き比べの記事では、同じ台本9行を5本の声で読ませて、文字起こしと照らしました。」
講座動画の音声は、台本を1行ずつ読ませる形で作っています。同じ台本を別の声で読ませて文字起こしと照らした話は、『Claude Codeで台本から動画を作る手順を、最初に1分の見本を頼む流れでmanaさんが解説』で書いています。
1行ずつ音声にしておくと、読み間違えた行だけを作り直せます。全部を作り直さなくてよいのです。元記事の言う「戻る先が決まる」は、この感覚に近いと思いました。
元記事はここからさらに進めて、音声の発話が始まる位置と終わる位置を測り、その区間に口の開閉、表情、字幕を合わせています。
ただ、元記事にも書かれているとおり、台詞の音声だけでは演技の確認までは終わりません。口と表情と字幕が合っているかは、別の確認として残ります。
「判断基準は、動きの複雑さと再現性です」。映像生成とコードでの描画を、場面ごとに分ける

東大広告研究所さん(X・@adops_lab)のアーティクル(映像生成とコード描画の部分より)
判断基準は、動きの複雑さと再現性です。
では、全部をコードで描けばいいのか。元記事の答えは、場面ごとに分けることです。
映像生成は、複雑なアクションや質感を一続きで見せたい場面に向きます。コードでの描画は、会話の間や表情の差分を正確に繰り返したい場面に向きます。元記事の分け方を、5つにまとめ直します。
- 複雑なアクションや質感を一続きで見せたい場面は、映像生成を使う
- 会話の間や表情の差分を、正確に繰り返したい場面は、コードで描く
- 商品を決まった位置へ出す動きや、字幕は、コードで描く
- 物理的に複雑なカメラ移動や背景の変化は、映像生成を検討する
- 台詞やタイミングを直す可能性が高い場面は、部品を分けておく
映像生成のモデルとして、元記事はSeedance 2.5とMiniMax H3の名前を挙げています。画像や動画、音声を参照しながら、複雑な映像を作る選択肢になるそうです。
ただし、複数人物の細かなやり取りや、商品を同じ形で出し続ける場面は、確認が欠かせないとも書いています。
元記事は、こう続けます。「モデル名だけで制作方法を決めると、修正時に困ります」。モデルは、これからも入れ替わります。ここは変わりません。残るのは、動きの複雑さと再現性という見方です。
毎回同じキャラクターが話す場面は、固定した素材が効きます。特別なアクションは、映像生成が効きます。この役割分担で、工数を理由に見送っていた表現を、企画の候補へ戻せます。選べる幅が広がります。
元記事は、そう整理しています。
ちなみに、元記事は広告の民主化にも触れています。少人数でも表現を積み上げられる構造が大事だ、という見立てで、市場データによる予測ではないと、元記事自身が書き添えています。
「どの疑問を入口に選ぶか」。3本の作例は、冒頭の疑問がそれぞれ違う

東大広告研究所さん(X・@adops_lab)のアーティクル(作例の部分より)
ここで差が出るのは生成操作の回数より、どの疑問を入口に選ぶかです。
元記事は、自主制作した3本を、冒頭の疑問、舞台、展開、オチを商品ごとに作り分けた例として紹介しています。人が企画と監修を担い、商品画像はメーカーの公式素材。
配信成果は未計測で、台本と演出の設計だけを扱う、と断り書きがあります。
1本目は、ヘパリーゼWです。入口は「飲み物にレバー!?」という名前への驚き。最初の場面から工場の比喩へ移り、成分の情報へ進んで、最後はラベルを読む行動に戻ります。
誤解を否定する前に、その誤解を物語の入口に使う型です。
2本目は、ヘパリーゼW PREMIUM 極です。入口は、希望小売価格の違いへの驚き。売り場で価格に驚き、配合を確認して、選ぶ理由へ戻ります。1本目とは、冒頭も舞台も展開もオチも別の台本です。
3本目は、ネスカフェ エスプレッソベース 無糖です。入口は、一緒に飲みたいけれど、甘さの好みが違う二人の欲求。
同じ無糖の希釈用コーヒーから2杯作り、片方だけ甘さを足す行動で、好みに合わせられる特徴を見せています。
面白いのは、境界の置き方です。成分の説明を効能の断定へ広げない。配合量の差を、効果の倍率に置き換えない。価格は希望小売価格で、特定の店の実売価格と混ぜない。生成した実演映像を、実物のテストと誤読させない。
どれも、公式情報の範囲で作った自主制作の表現として扱われています。境界が大事です。
3本を並べると、入口の型が分かれます。1本目は驚き、2本目は比較、3本目は人物同士の好みの違い。
元記事は、「商品情報を先に並べるより、どの疑問なら行動が生まれるかを選ぶと、別商材にも台本を展開できます」と書いています。
ここで私が学んだのは、同じ商品情報を持っていても、入口の疑問を変えれば台本は別物になる、という点です。語尾や小物だけを変えた案は、別の案として数えません。
「自動的に動画を読み込めることと、人が自然に理解できることは別の確認項目」。6段階の「完了」を先に決める

東大広告研究所さん(X・@adops_lab)のアーティクル(スマートフォンで確認する部分より)
自動的に動画を読み込めることと、人が自然に理解できることは別の確認項目です。
元記事は、自分の商品を映像にする手順を、6段階で書いています。段階ごとに、何ができたら完了か、という条件がついているのが特徴です。
- 相手と伝える価値を決める。完了は、誰が何を知り、どう動く動画かを1文で説明できること
- 構造の違う台本を3案作る。完了は、3案を1行ずつ要約しても違いが分かること
- 原画とキャラクターの差分を揃える。完了は、どの差分でも同じ人物に見えること。商品画像は、利用条件を確認した公式素材か、許諾を得た素材を使う
- 音声から時間軸を作る。完了は、発話していない人物の口が動かず、台詞の切れ目と表情の変化が揃うこと。尺が長い時は、動きを速める前に台詞を削る
- 感情に合わせて演技を指定する。完了は、音を消しても、感情の移り変わりと商品を使う瞬間が追えること
- スマートフォンで通常速度で確認する。完了は、台詞・表情・字幕・商品提示の4点を、一度の視聴で追えること
4つ目は、音声の区間に口・表情・字幕を合わせる確認です。6つ目は、人が通常の速さで見て自然に分かるかの確認です。同じ「合っている」でも、確認の種類が違います。確認は2段です。
ここで、声のクローンを試した時のことを1つだけ書きます。同じ文で4本作ったうちの1本が、読み違えました。
AI氣道『VoiceStudioで自分の声をボイスクローン。ElevenLabs v4 TurboとGemini 3.8 TTSとも聞き比べ』より
「見本を20秒に増やして、長さを7.5秒に指定した4本のうち、1本だけ「変更しないで」を「変更にしないで」と読みました。」
ナレーションに使うなら文字起こしで台本と照らし合わせる工程を1つ挟むと安心だという話は、『VoiceStudioで自分の声をボイスクローン。ElevenLabs v4 TurboとGemini 3.8 TTSとも聞き比べ』で書いています。
文字起こしと照らして確かめられるのは、台本どおりに読めたかどうかです。間や表情が自然かどうかは、人が通常の速さで見て確かめる別の確認になります。元記事の「別の確認項目」は、この違いのことだと受け取りました。
元記事は、問題が出た時の戻り先も決めています。台詞が入らなければ台本、口の動きがずれれば音声の区間、商品が見えなければ手元とカメラ。
最後は、企画の意図と商品の情報を知る人が見て、誤解を生む表現がないかまで確かめます。最後は人です。
私なら、映像より先に一文を決める。「入力欄が埋まっていないまま依頼すると」、AIは一般論で埋める

東大広告研究所さん(X・@adops_lab)のアーティクル(指示文の部分より)
入力欄が埋まっていないまま依頼すると、AIは足りない条件を一般論で補いやすくなります。
元記事の後半には、そのまま使える指示文が2本置かれています。
1本目は、商品の公式情報と、広告を見る相手を渡して、入口からオチまで構造が違う台本を3案返してもらうものです。各案で、商品が必要になる理由と、制作前に公式情報で確かめる項目も出させます。
2本目は、採用した台本と制作素材を渡して、台詞ごとの開始・終了の時刻、演技、描画の方法、スマートフォンで動画を通常速度で見るときの確認表を返してもらうものです。
映像生成に任せる場面とコードで描く場面を、先に分けておく。そうすると、問題が出た時の戻り先がはっきりします。
元記事は、2本目の指示文のあとに、こう書いています。「入力欄が埋まっていないまま依頼すると、AIは足りない条件を一般論で補いやすくなります」。分からない項目は推測させず、未確認と明記する。
これが元記事の置いた約束事でした。1本目と2本目、どちらの指示文にも当てはまる注意です。
私は、ここに共感しました。空欄をそのまま渡して、AIに埋めてもらうのは楽です。でも、埋まった中身は、誰の商品でもない、一般論になります。
AI氣道『Fujinさんのショート動画量産8工程(Opus 5.5・GPT Image 2.5・Gemini TTS)。台本を書くAIにも「推測は推測と書く」を貼れるか』より
「でも私は、台本を書くAIにも貼りたいと思いました。①のリサーチに推測が混ざったら、そのまま台本の1行目になるからです。」
台本を書くAIにも推測は推測と書かせたい、という話は、『Fujinさんのショート動画量産8工程(Opus 5.5・GPT Image 2.5・Gemini TTS)。台本を書くAIにも「推測は推測と書く」を貼れるか』で書いています。
元記事の「未確認と明記します」は、この考えを映像の依頼文に置いたものに見えます。台本の入口で推測が混ざると、そのまま映像の1行目になる。空欄を一般論で埋めさせない理由が、ここにあります。ここが要です。
だから、私なら、入力欄を埋める前に、まず一文だけ書きます。
最初の1文(提案です。未実装です)
相手は【 】に疑問があり、伝えたい価値は【 】、見終わったら【 】してほしい。
短くて構いません。この一文を、最初の章の依頼文に入れて、台本を3案出してもらいます。出てきた3案を1行ずつ要約して、構造の違いが分かるか確かめてください。違いが分からなければ、入口の疑問を変えて、もう一度です。
最初の章の依頼文には、足したほうがよい2文があります。各案に、登場人物の目的、商品が必要になる理由、商品を使う動作を書いてもらうこと。公式情報にない効果や広告成果は書かせないこと。
商品の特徴を読み上げるだけの台本を避けるための、元記事の指示文の要点です。
元記事は、一度の指示で無修正の完成品が出るわけではない、とも書いています。企画、素材、音声、動き、確認の順に分けて進めるのが、元記事の整理です。
よくある質問
Q. アニメ広告は、AIへの一度の指示で完成しますか?
A. 元記事は、一度の指示で無修正の完成品が出るわけではない、と書いています。企画、素材、音声、動き、確認の順に分けて進めます。
Q. 映像生成とコードでの描画は、どう使い分けますか?
A. 元記事の判断基準は、動きの複雑さと再現性です。複雑なアクションや質感は映像生成、会話の間や表情の差分、商品の位置や字幕はコードで描きます。
Q. この作例で、広告の成果は出ているのですか?
A. 元記事に載っているのは自主制作の作例で、配信成果は未計測と書かれています。この記事が扱うのは、台本と演出の設計の部分です。
Q. 既存のアニメのキャラクターを使ってもよいですか?
A. 元記事は、既存アニメの原画、声、台詞はコピーせず、独自のキャラクター設定を作ると書いています。商品画像は、利用条件を確認した公式素材か、許諾を得た素材を使います。
Q. 最初の一歩は何ですか?
A. 私の提案は、相手の疑問と伝えたい価値を一文で書いて、台本を3案出してもらい、各案を1行で要約して違いを確かめることです。提案です。未実装です。
まとめ:商品は小物にして、人物の目的を先に決める。直せるように部品を分ける
東大広告研究所さんの記事は、AIで作るアニメ広告を、台本・原画・音声・動きに分けて作る方法として説明していました。台本では、先に人物の目的を決め、商品を行動に必要な小物として登場させます。
私がこの記事から学んだのは、2つです。1つは、映像を作る前に、誰のどんな疑問に答えるかを一文で決めること。もう1つは、直したくなった時に戻る先が決まるように、部品を分けておくことです。講座動画で台本を1行ずつ音声にしている私には、後者がよく分かりました。
最初の一歩は、15分です。自分の商材で、相手の疑問と伝えたい価値を一文で書いて、台本を3案出してもらってください。分からない項目は、推測させずに、未確認と書いて渡してみてください!
この記事で学んだことを誰かに教えて恩送りして学びを深めよう!
COLUMN
食材の名前を読み上げる料理番組と、「今夜は何を食べさせたいか」から始まる献立

料理番組にたとえると、商品の特徴を台詞で読み上げる広告は、食材の名前を順番に読み上げる番組です。「本日は玉ねぎ、豚肉、しょうが」。ここまでで、見ている人はもう席を立ちたくなります。献立を決める前に、食材の話から入ってしまうからです。元記事の言う「商品名を先に出し、特徴を台詞で読み上げると、登場人物は説明役になります」は、この読み上げ番組の状態だと受け取りました。見ている人が知りたいのは、食材の名前より先に、今夜それがなぜ食卓に並ぶのかです。順番が逆なのです。
一方、「今夜は、仕事で疲れて帰る家族に、温かいものを出したい」から始まる番組は、食材が自然に出てきます。冷蔵庫を開けて、玉ねぎを切って、鍋に入れる。その動作を見ているうちに、玉ねぎがなぜ必要だったかが分かります。元記事の言う「商品は人物の行動に必要な小物になる」という考え方は、この献立の順番に当たると思います。キッチンに立つ人の目的が先にあって、食材は、その目的を果たす道具として登場します。説明しなくても、見ている人が自分で理由に気づく。それが、読み上げ番組との違いです。献立が先です。
下ごしらえにあたるのが、部品に分けることです。玉ねぎを先に切って、タッパーに入れておけば、味付けだけをやり直せます。全部を鍋に入れてから薄いと気づいても、玉ねぎだけ取り出すことはできません。台本、絵、声、動きを分けておくのは、味付けだけをやり直すための下ごしらえです。部品が下ごしらえです。味見は、完成品を出す前に、必ず自分の舌で行います。献立は一文で決めて、下ごしらえは分けて、味見は人の舌で。この流れを、料理の順番に置き換えて、私は読みました!
分身AIのこれまでの歩みは、分身AIと歩んだ100日の全まとめにまとめています。
分身AIのことをもっと知るなら、分身AI.comもチェックしてね!
関連記事
台本を1行ずつ音声にして動画をつくる手順と、読み違いの確かめ方を書いた回
自分の声のクローンで台本を読ませ、読み違いと文字起こしで照らす対処を書いた回
台本・画像・声の8つの工程で、ショート動画を量産する流れを読んだ回
参考リンク
この記事で紹介した元記事
台本を1行ずつ音声にする講座動画の作り方
声のクローンの読み違いと、文字起こしで照らす対処を書いた回
今回紹介した記事
| 著者 | 東大広告研究所(X・@adops_lab) |
| 媒体 | X(アーティクル) |
| 公開日 | 2026年9月29日 |
| 元URL | https://x.com/i/article/2104876814460178432 |
無料プレゼント
Aiport(ClaudeCode AIエージェント実践会)
ClaudeCodeでAI秘書+分身AI+AIカンパニーが無料で作れるキット&解説動画をプレゼント!
▶ 無料で入会してキットを受け取るAI生成コンテンツについて
この記事はAIツール(Claude Code)を活用して制作しています。構成・文章生成にAIを使用し、最終的な内容の確認・編集・公開判断はひろくん(田中啓之)本人が行っています。「分身AIひろくん」(bunshin-ai.com)とは別のコンテンツです。
AI氣道 — 三方よしのAI活用
家事と子育てのスキマで経営する、ひろくんのAIブログ
毎朝無料LIVE配信中!見逃しても大丈夫、アーカイブも完全無料。
記事も完全無料。見逃しても大丈夫!
YouTubeチャンネル: @AIKIDO-GPTs
| 曜日 | 時間 | メインホスト | ゲスト | テーマ |
|---|---|---|---|---|
| 月 | 7:00〜7:30 | ひろくん | ただっち | AI最新ニュース・実験 |
| 月 | 13:00〜 | ひろくん | れんくん(戸野塚蓮) | AI経営術LIVE |
| 火 | 7:00〜7:30 | ひろくん | 公ちゃん | 共感ストーリー×分身AI |
| 水 | 7:00〜8:00 | ひろくん | 高崎さん・たくみくん | AI×開発・教育 |
| 木 | 7:00〜7:30 | ただっち | ともみん | AI×デザイン |
| 金 | 7:00〜7:30 | ただっち | 友くん | AIツール最前線 |
| 土 | 7:00〜7:30 | ただっち | ゆきちゃん | AI×起業・発信 |
| 日 | 7:00〜7:30 / 7:30〜 | WACAコラボ | ひろくん+仲間たち | 生成AI最新ニュースまとめ |
日曜7:00〜7:30のLIVEは無料視聴、7:30〜のWACAのZOOMは登録制です。詳細・登録はこちら
火曜15:00〜 社長モテる化計画LIVEもやってるよ!