
READ REPORT
Fujinさんのショート動画量産8工程(Opus 5.5・GPT Image 2.5・Gemini TTS)。台本を書くAIにも「推測は推測と書く」を貼れるか
2026年10月2日
家事と子育てのスキマで経営する3方よしAI共創コンサルタントの田中啓之、ひろくんです。今回は、Fujinさん(@Fujin_Metaverse)のXの投稿「ショート動画量産システムの作り方」を紹介するね。
9月28日の朝、私はAIにリール動画を任せました。公開の手前でAIが止まって、確認がスマホに届きます。「両方公開する」を選んだ1分後に、動画は公開されていました。作る、直す、出す。ほとんどをAIが持ってくれた朝です。だから、Fujinさんの投稿を読んで、「えぐいですよね」に頷きました。調べる、台本、声、絵、編集、投稿まで、8工程を完全自動化できると言い切っています。賛成です。ただ、1か所だけ「ちょっと待って」と言いたい。作れることと、受け取る人に届くことは、別だからです。この記事では、8工程を順に読みながら、私が手放す所と、残す所を決めていきます。
3行でわかるポイント
- 賛成する所は、作成から投稿までをAIに持ってもらうことです。私のリールも、書き出した音をAIが文字に起こし直して、つなぎ目4か所を自分で見つけていました。
- 「ちょっと待って」と言いたい所は、公開の手前です。自動で投稿できることと、出してよいことは別です。私のリールは、公開の手前で止まって、私が選んだ1分後に公開されました。
- 手放さない所は、何を、誰に届けるかです。声の聴き比べでは、数字は横並びでも、5本を全部聴いて選んだのは私でした。
Fujinさん(@Fujin_Metaverse・表示名はAI自動化の人)・2026年9月26日投稿。8工程のワークフローと、詳細PDFはリプでDMで届くことを紹介した投稿
Fujinさんのショート動画「動画生成AI・演者一切不要。」60秒を6秒ごとに見ると、絵の上に画面と字幕が重なっていた
Fujinさん(@Fujin_Metaverse)のXの投稿「Opus 5.5 × GPT Image 2.5 × 3.8 TTS ショート動画量産システムの作り方」(2026年9月26日)(投稿の冒頭)
動画生成AI・演者一切不要。
「動画生成AI・演者一切不要。」この一文から、Fujinさんの投稿は始まります。
演者がいらない。これは、賛成です。顔を出さなくても、発信は続けられます。
添付の60秒の縦動画を、6秒ごとに止めて見ました。白髪で、頭に角のあるアニメ調のキャラクターが、マイクの前に座っています。
その絵の上に、ChatGPTの画面風のカードと、大きな字幕が入れ替わります。字幕には「なぜ知ったかぶりするの?」と出ていました。
動画を生成しなくても、絵と画面と字幕を重ねれば、60秒の動画になる。ここが、私は面白かったんです。口や手の形はコマごとに違って見えましたが、生成なのか差し替えなのかは、コマからは分かりません。
私の手元にも、plan.json に絵の指示と字幕と読み上げ文を書いて、動画にする設計図があります。同じ型かどうかは、分かりません。
演者不要の動画も、部品に分けて見ると、何でできているかが見えてきます。そこから、自分の1本を考え始められます。
好きな動画を6秒ごとに止めてみる ショート動画を1本選んで、6秒ごとに止めます。見えた部品と、コマからは分からないことを、紙の左右に分けて書いてみてください。
「①Opus 5.5にリサーチさせる ②台本を書いてもらう」動画の3行を、台本を書くAIにも貼れるか
Fujinさん(@Fujin_Metaverse)のXの投稿「Opus 5.5 × GPT Image 2.5 × 3.8 TTS ショート動画量産システムの作り方」(2026年9月26日)(①と②の工程)
①Opus 5.5にリサーチさせる ②台本を書いてもらう
①でOpus 5.5にリサーチさせて、②で台本を書いてもらう。ここが、この投稿でいちばん気になった所です。
添付動画の字幕に、ChatGPTの知ったかぶりを防ぐ3行が出ていたからです。
「分からないことは『分かりません』と答えて」「推測で答えるときは、推測だと書いて」「大事な情報には、どこで確認できるか添えて」。
この3行は、ChatGPTに答えさせる時の話です。でも私は、台本を書くAIにも貼りたいと思いました。①のリサーチに推測が混ざったら、そのまま台本の1行目になるからです。まだ8工程で試してはいません。
分身AIに自己紹介やブログを書かせて、捏造や憶測を見た時、消されたと感じました。それは単なる事実の精度ではなく、「想いや愛や魂」だったんです。
だから、体験ストーリーは、憶測も捏造もない事実だけで語ると決めています。
台本をAIに任せることには、賛成です。ただ、台本の根になる事実だけは、任せる前に自分で照らし合わせたい。この3行は、その入口になると思っています。
台本の1行目の根を決める 次に作る動画の台本の1行目に使う事実を、1つ選んでください。元の資料で照らし合わせられる事実から選んで、出典を台本の横に書きます。書けなければ、その1行は台本から外します。
「③Gemini 3.8 Flash TTSで音声クローン作成」声は、誰のものかを先に決める仕事
Fujinさん(@Fujin_Metaverse)のXの投稿「Opus 5.5 × GPT Image 2.5 × 3.8 TTS ショート動画量産システムの作り方」(2026年9月26日)(③の工程)
③Gemini 3.8 Flash TTSで音声クローン作成
③は、声の準備です。Gemini 3.8 Flash TTSで、音声クローンを作ります。
気になったのは、誰の声をクローンにするのかが、投稿の本文に書かれていないことです。
Googleの公式ブログ(2026年9月23日)には、声の複製の条件が書かれています。本人の声か、使う権利のある声の、30秒ほどの音声サンプルから作れます。作る前に、声の持ち主が同意を話した録音を出します。その録音は、参照した声の話者と一致している必要があります。生成した音声には、SynthIDという透かしも入ります。
私のクローンは、自分の声です。講座動画のナレーションに使っています。聴き比べに使ったGeminiの2本も、Google側に保存してあった自分の声のクローンでした。
声で感じることは、テキストではないものがいっぱいあります。言霊というか、響くんです。
だから③は、技術の工程に見えて、先に決める工程だと思っています。誰の声か。使っていい範囲はどこまでか。他人の声なら、持ち主の同意の録音が、公式の条件です。この2つを決めてから、クローンを作ります。
声の持ち主と範囲を1行で書く 声のクローンを作る前に、声の持ち主と、使っていい範囲を1行で書いてみてください。他人の声なら、持ち主本人の同意の録音を出せるかも、あわせて1行に書きます。出せないなら、その声は使いません。
「④台本をもとにTTSsで音声化」平均の数字は横並びでも、差は行ごとに出た。最後は5本を全部聴いて選んだ
Fujinさん(@Fujin_Metaverse)のXの投稿「Opus 5.5 × GPT Image 2.5 × 3.8 TTS ショート動画量産システムの作り方」(2026年9月26日)(④の工程)
④台本をもとにTTSsで音声化
④は、台本を声にする工程です。どのTTSを使うかは、投稿に書かれていません。
私は、同じ台本9行を、自分の声で5本の読み上げにして、全部聴き比べました。ElevenLabsが3本(v3・v4・v4 Turbo)、Geminiが2本(3.8 Flashと3.8 Flash-Lite)。v3は本番で作ったものをそのまま使い、残りの4本を新しく作りました。
文字起こしAIで台本と照らした一致率の平均は、5本とも0.90から0.93。ほぼ横並びです。差が出たのは、行ごとでした。
AI氣道『ElevenLabsとGemini 3.8 TTSの料金と声。同じ台本9行を自分の声で5本聴き比べた結果』より
「逆にGeminiの2本は、冒頭の1行目で崩れました。「SNSでそう騒がれた事件」が、Flashでは「SNSで捜査を上げた事件」(0.72)、Flash-Liteでは「SNSで捜査分かれた事件」(0.75)と聞き取られています。」
行ごとの差は、『ElevenLabsとGemini 3.8 TTSの料金と声。同じ台本9行を自分の声で5本聴き比べた結果』で書いています。
この数字は、文字起こしAIが聞き取った結果です。耳で聞いた発音の誤りとは、同じではありません。
AI秘書の凛ちゃんが名乗る行では、9月まで使っていたv3だけが、名前を「ディント」と聞き取られました。
v4とv4 Turboは、平均が同じ0.93でした。数字では、決められません。選んだのは、5本を全部聴いた私です。好みだったのは、v4 Turbo。品質は十分で、Geminiより好きでした。
数字は、判断の材料です。決めるのは、耳です。ここは、AIに渡さない所だと思っています。
この聴き比べは、台本1本と、自分の声1つだけです。Gemini 3.8 TTS全体の評価ではありません。
1行目を2種類で読み上げて聴き比べる 自分の台本の1行目を、2種類の読み上げで作ってみてください。必ず耳で聴いて、どちらで出すかを決めます。数字を出すなら、文字起こしの一致率は別の行にメモします。
「⑤GPT Image 2.5で素材生成してもらう」私が日本語を絵に入れたのはGrok。同じ指定が効くかは、小さな1枚で試す
Fujinさん(@Fujin_Metaverse)のXの投稿「Opus 5.5 × GPT Image 2.5 × 3.8 TTS ショート動画量産システムの作り方」(2026年9月26日)(⑤の工程)
⑤GPT Image 2.5で素材生成してもらう
⑤は、動画に使う絵の素材です。GPT Image 2.5に作ってもらう、と書かれています。
添付動画の絵は、アニメ調のキャラクターの1枚絵と、ChatGPTの画面風のカードに見えました。どの絵がGPT Image 2.5で作られたのかは、投稿からは分かりません。
絵の素材で、私がいちばん気になるのは、絵の中の日本語です。AIに日本語を描かせると、崩れた記号のようになることが多かったからです。
私が試したのは、GPT Image 2.5ではなく、Grokの動画生成です。9月16日の記事の作業は、私の依頼でAIが手を動かしました。私がしたのは、最初の一言と、出てきたものへのダメ出しです。
AI氣道『【婆が如く】AI動画の作り方noteをGrokだけで再現してみた|できたこと・崩れたこと』より
「この動画で一番の発見は、出したい日本語は「」で囲んで書けば、そのまま絵の中に描かれるということでした。」
「」で囲む発見は、『【婆が如く】AI動画の作り方noteをGrokだけで再現してみた|できたこと・崩れたこと』で書いています。
出したい日本語は、「」で囲む。これだけで、絵の中に描かれました。
ただ、限りもありました。大きなタイトル文字は出るのに、ポスターの中の小さい看板は、読めない文字になっていました。GPT Image 2.5で同じことが起きるのかは、まだ試していません。
日本語の入った絵を、小さな1枚で試す 絵に入れたい日本語を、1つだけ選んでください。「」で囲んで頼んで、出てきた絵の文字を声に出して読みます。読めなければ、その文字は絵に入れず、字幕で入れる側に回します。これは私からの提案で、投稿が勧めている方法ではありません。
「⑥全ての素材を動画編集で合わせる ⑦書き出して最終チェックする」文字起こしが読んだことと、耳で確かめたことを分けて書く
Fujinさん(@Fujin_Metaverse)のXの投稿「Opus 5.5 × GPT Image 2.5 × 3.8 TTS ショート動画量産システムの作り方」(2026年9月26日)(⑥と⑦の工程)
⑥全ての素材を動画編集で合わせる ⑦書き出して最終チェックする
⑥で素材を編集で合わせて、⑦で書き出して最終チェックをします。最終チェックを工程に入れているのは、賛成です。
私のリールでは、この確認を、AIが先に始めていました。
書き出した57秒版の音声を、AIが文字に起こし直して、元の台本と突き合わせる。最初の書き出しは、つなぎ目が4か所おかしいと、AIが報告してきました。
「ブリーフィング」の頭が切れて、「イフング」と聞こえた、というのもその1つです。
私は、確認までAIに任せていいと思っています。制作だけでなく、味見と直しまで任せたいからです。
ただ、書き方には線を引いています。偽りとは「事実じゃないことを事実のように振る舞うこと」だからです。
文字起こしが「イフング」と返したことは、記録で確認できます。でも、実際の音がそう欠けたのかは、耳で確かめるまで言い切りません。だから「発音が崩れた」とは書かず、「文字起こしではこう読めた」と書きます。
「ここは直したい」という想いは、そのまま書いてかまいません。
書き出した音を文字に戻して、耳で確かめる 完成した動画の音を、文字起こしにかけてみてください。台本と並べて、違う所の時刻をメモします。その時刻だけ、耳で聴き直します。「文字起こしでの読み」と「耳で確かめた結果」は、別々に書きます。
「⑧イン◯タやTikT◯kに投稿させる」私のリールは、公開の手前でAIが止まって確認が届いた
Fujinさん(@Fujin_Metaverse)のXの投稿「Opus 5.5 × GPT Image 2.5 × 3.8 TTS ショート動画量産システムの作り方」(2026年9月26日)(⑧の工程・伏せ字は投稿のまま)
⑧イン◯タやTikT◯kに投稿させる
⑧は、投稿です。イン◯タとTikT◯kに投稿させる、と書かれています。伏せ字は、投稿のままです。
ここが、私の「ちょっと待って」です。
私のリールの話を、短く並べます。9月28日の朝、投稿先を伝えました。AIは、YouTubeを非公開のままアップロードして、TikTokは投稿ボタンの手前まで入力を済ませていました。
9時9分に確認が届き、9時17分に私が「両方公開する」を選びました。公開は、9時18分です。
AI氣道『ショート動画作りをClaude Opus 5.5に任せたら、ワンプロンプトで公開まで進んだ』より
「判断がいる時は、AIの側からスマホに質問が届きます。公開・配信・削除みたいな取り返しのつかない操作は、必ずこの手前で止まる。だから安心して任せられる。」
リールの中で私が話した言葉は、『ショート動画作りをClaude Opus 5.5に任せたら、ワンプロンプトで公開まで進んだ』で書いています。
私は、投稿までAIに任せる方向に、賛成です。AIが仕上げて、公開の手前で止まる。それも、委ねる形の1つだと考えています。
ただ、自動で投稿できることと、出してよいことは、別です。発信では、外部公開は必ず明示承認を得ると決めています。
⑦はできの確認で、⑧は出していいかの判断です。投稿の本文には、人が承認する場所が書かれていません。あるのかないのかは、分かりません。
公開の前に止まる設定かを調べる AIに任せている自動投稿が1つでもあれば、投稿先の管理画面を開いてみてください。人の承認を待って、下書きか非公開のまま止まる設定かを調べて、「ある」「ない」「分からない」のどれかを書きます。予約投稿は、承認なしでも時刻が来れば出ることがあるので、「ある」には数えません。
「これで作成から投稿まで完全自動化可能。」8工程のうち、自分が語って違和感がないかを問う1か所
Fujinさん(@Fujin_Metaverse)のXの投稿「Opus 5.5 × GPT Image 2.5 × 3.8 TTS ショート動画量産システムの作り方」(2026年9月26日)(投稿の結び)
これで作成から投稿まで完全自動化可能。
投稿は、この一文で8工程をまとめます。続けて「えぐいですよね。」と書いて、詳細PDFはリプでDMする、と案内しています。
8工程が1本の線でつながっているのは、見事です。作成から投稿まで、AIが持つ。この方向には、賛成です。
ただ、「完全自動化できる」と、「受け取る人に届く」は、別です。何を、なぜ、その人に届けるのか。そこを抜いたまま、作れる本数だけ増やしたくありません。
「魂は渡さないだろ。魂は込めるもの。」と、私は言っています。目的と、守りたいものと、判断軸は、先に自分で掘る。そのうえで、実行や量産のボールを、人にもAIにも仕組みにも委ねます。
そして、できあがった型の温度を、身体で確かめます。「違和感。しっくりこない。ワクワクもウズウズもない」。このサインが出たら、まだ出しません。
私が確かめたのは、投稿の本文と、添付動画のコマと、Googleの公式ブログと、自分の過去の記録までです。8工程を通しで動かしたわけではありません。詳細PDFも、受け取っていません。
8工程のどこに、「これは自分が語って違和感がないか」と問う場所を置くか。私は、公開の直前に置きたいと、今は思っています。
8工程を紙に書いて、問いを置く1か所に印をつける まず、作りたい動画を1行で書きます。次に、その動画の作り方を8つの工程に分けて書きます。投稿の8工程を借りても構いません。書けたら、「これは自分が語って違和感がないか」と問う1か所に印をつけてください。
よくある質問
Q. この投稿の8工程で、本当に動画が作れますか?
A. 投稿には、作成から投稿まで完全自動化可能と書かれています。私は8工程を通しで試していないので、作れるとも作れないとも言えません。添付の60秒動画が8工程で作られたのかも、確かめていません。詳細PDFは、リプでDMされる形で、受け取っていません。
Q. 音声クローンは、誰の声でも作れますか?
A. Googleの公式ブログ(2026年9月23日)には、本人の声か、使う権利のある声の、30秒ほどの音声サンプルから作れるとあります。声の持ち主が同意を話した録音も、作る前に出します。その録音は、参照した声の話者と一致している必要があります。投稿には、誰の声を使うかは書かれていません。
Q. Gemini 3.8 TTSは、日本語の読み上げに向いていますか?
A. Googleの記事は、Voice Arenaで、Gemini 3.8 FlashとFlash-Liteが日本語を含む主要言語で上位だったと紹介しています。私の聴き比べは、台本9行と自分の声のクローンの1回だけです。Geminiの2本は、冒頭の1行目が、文字起こしで崩れて聞き取られました。向いているかは、自分の台本を聴いて決めるのが確実です。
Q. 完全自動化にすると、公開の前の確認は要らなくなりますか?
A. 要るかどうかは、あなたが何を守りたいかで決まります。私は、外部公開は必ず明示承認を得る、と決めていて、リールも、公開の手前でAIが止まって確認が届きました。投稿には⑦の最終チェックがあります。人が公開を承認する場所が入っているかは、本文からは分かりません。
Q. ショート動画を作るのに、顔出しや撮影は要りますか?
A. 投稿は、動画生成AIも演者も要らないと書いています。添付動画は、キャラクターの絵の上に、画面風のカードと字幕が重なる作りに見えました。私のリールは、撮った動画を切る型だったので、同じ型ではありません。
まとめ:ショート動画の量産でも、動画の3行を台本づくりに戻して、問いを置く1か所を先に決める
Fujinさんの8工程を読んで、私は、賛成する所と、待ってと言う所を分けました。調べる、台本、声、絵、編集、投稿。作成から投稿まで、AIに持ってもらう。この方向には、賛成です。
待ってと言う所は、公開の手前です。自動で投稿できることと、出してよいことは、別です。私のリールは、公開の手前で止まって、私が選んだ1分後に公開されました。
手放さない所は、何を、誰に届けるかです。声は、数字が横並びでも、5本を全部聴いて選びました。確認はAIに任せます。ただ、事実じゃないことを事実のように書くことだけは、しません。
動画の3行(分からないと答える・推測は推測と書く・確認先を添える)は、台本を書くAIにも貼ってみたいと思っています。まだ試してはいません。
あなたの一歩は、8工程を紙に書いて、「これは自分が語って違和感がないか」と問う1か所に印をつけることです。
COLUMN
量産の1本は、見る人には1分の1
8工程を読みながら、お弁当のことを思い出しました。実際に400個のお弁当を作った時、一つも手抜きできないと、より強く感じたんです。作る側にとっては400分の1でも、受け取る人には1分の1です。
この感覚は、ショート動画を量産する時にも、そのまま当てはまると思っています。何本作っても、見る人が見るのは、その1本です。
添付の動画は60秒でした。見ている人は、その60秒を私たちに預けてくれます。その60秒に、作り手の向き合い方は出ると思っています。
量産は、1本あたりにかける手が薄くなりやすい作業だと思っています。だから私は、量産の前に、最初の1本を完璧に作ります。完璧は、完成度100%のことではありません。未完成でも、愛と感謝のメッセージを伝えるために手抜きせず、本質と核心に嘘偽りなく向き合うことです。
違和感があれば、やり直します。やり直しは罰ではなく、人もAIも学んで育つ時間だと考えています。
投稿の8工程は、作って出すまでの並びでした。出したあとに、受け取った1人がどう感じるかは、8工程の外にあります。
だから私は、出す前の自分の目を、工程の中に残したいと思っています。仕組み化したあとも、想いや愛や魂を薄めたくありません。あなたの8工程には、その1人に向き合う場所が、どこにありますか。
私が自分のAIに任せて試してきた日々は、分身AIと歩んだ100日の全まとめに残しています。
分身AIのことをもっと知るなら、分身AI.comもチェックしてね!
関連記事
公開の手前でAIが止まって確認が届いた、リール1本の記録
動画を描く型と切る型で読み分けて、確認を依頼文に入れる回
Grokで日本語を絵に入れた、できたことと崩れたこと
参考リンク
投稿者のアカウント
声の複製の条件を書いたGoogle公式ブログ
Gemini APIの音声生成の公式ドキュメント
今回紹介した記事
| 著者 | Fujinさん(@Fujin_Metaverse・表示名はAI自動化の人) |
| 媒体 | X |
| 公開日 | 2026年9月26日 |
| 元URL | https://x.com/Fujin_Metaverse/status/2103650121951117458 |
無料プレゼント
Aiport(Claude Code AIエージェント実践会)
Claude CodeでAI秘書+分身AI+AIカンパニーが無料で作れるキット&解説動画をプレゼント!
▶ 無料で入会してキットを受け取るAI生成コンテンツについて
この記事はAIツール(Claude Code)を活用して制作しています。構成・文章生成にAIを使用し、最終的な内容の確認・編集・公開判断はひろくん(田中啓之)本人が行っています。「分身AIひろくん」(bunshin-ai.com)とは別のコンテンツです。
AI氣道 — 三方よしのAI活用
家事と子育てのスキマで経営する、ひろくんのAIブログ
毎朝無料LIVE配信中!見逃しても大丈夫、アーカイブも完全無料。
記事も完全無料。見逃しても大丈夫!
YouTubeチャンネル: @AIKIDO-GPTs
| 曜日 | 時間 | メインホスト | ゲスト | テーマ |
|---|---|---|---|---|
| 月 | 7:00〜7:30 | ひろくん | ただっち | AI最新ニュース・実験 |
| 月 | 13:00〜 | ひろくん | れんくん(戸野塚蓮) | AI経営術LIVE |
| 火 | 7:00〜7:30 | ひろくん | 公ちゃん | 共感ストーリー×分身AI |
| 水 | 7:00〜8:00 | ひろくん | 高崎さん・たくみくん | AI×開発・教育 |
| 木 | 7:00〜7:30 | ただっち | ともみん | AI×デザイン |
| 金 | 7:00〜7:30 | ただっち | 友くん | AIツール最前線 |
| 土 | 7:00〜7:30 | ただっち | ゆきちゃん | AI×起業・発信 |
| 日 | 7:00〜7:30 / 7:30〜 | WACAコラボ | ひろくん+仲間たち | 生成AI最新ニュースまとめ |
日曜7:00〜7:30のLIVEは無料視聴、7:30〜のWACAのZOOMは登録制です。詳細・登録はこちら
火曜15:00〜 社長モテる化計画LIVEもやってるよ!