
画像をAIに読み込ませたら、プロンプトが自動で出てきた話
家事と子育てのスキマで経営する3方よしAI共創コンサルタントの田中啓之、ひろくんです。今回は2025年1月17日の朝LIVE。いやー、この日はただっちさんが持ってきたツールが面白かった。「画像を入れたらプロンプトが出てくる」ってやつ。実際に試してみたら、けっこう再現性高くてびっくりしたんですよね。
それだけじゃなくて、動画生成の話、3Dモデル化、営業AIエージェント……気づいたらめちゃくちゃ話が広がってたLIVEでした。ざっくりまとめます。

フリーイメージtoプロンプトジェネレーター、実際どうだった?
今回のメインがこれ。「フリーイメージtoプロンプトジェネレーター」って名前のツールで、簡単に言うと画像を読み込ませるとプロンプトが出てくるやつです。でね、ここがミソで——普通の画像生成って「プロンプトを書く→画像が出る」っていう一方通行でしょ。これは逆走するんですよ。画像から言葉を取り出す。完成品から、レシピを逆算してくれる感じ。
使い道がね、めちゃくちゃわかりやすい。たとえば「このイラストと同じ雰囲気で作りたい」って思っても、普通は「で、どんなプロンプト書けばいいんだ?」ってなるじゃないですか。色味、構図、タッチ、光の入り方……いざ言葉にしようとすると、急に手が止まる。あの「頭にイメージはあるのに、言葉にできない」感じ。あれ、地味にストレスなんですよ。そこをAIがパパっと言語化してくれる。これが今回いちばんの収穫でした。

ひろくん(05:52〜)
「画像から画像のプロンプトを作って、画像生成をする。イメージというテキスト、テキストというイメージを作るんだけど、再現性がめちゃくちゃ高いな、っていう感じがしてて」
「イメージというテキスト、テキストというイメージ」——この言い回し、自分で言っといてなんですけど、けっこう本質ついてるなと思っていて。つまり、絵と言葉が行ったり来たりする。絵を入れたら言葉になって、その言葉を入れたらまた絵になる。この往復が回り始めると、もう「狙った絵」にぐっと近づけられるんですよ。再現性が高い、っていうのはそういうこと。当てずっぽうじゃなくなる。
ただっち(6:00〜)
「アルテ…」
ひろくん
「アルテ…アル日本語とか英語とかも選べますけどこれはプロンプター英語の方が多分」
正直に言うと、この辺りの録音、ちょっと聞き取りづらいんですよ。ただっちさんと二人であれこれ唸ってる声だけが妙に残ってて(笑)。でも話の本筋はシンプルで、ツールの中で「英語で出すか、日本語で出すか」を選べる、ってところ。でね、二人の結論は「英語のほうがいいかな」でした。画像生成エンジンって、もともと英語のプロンプトで学習してる量が多いから、英語のほうが細かいニュアンスを拾ってくれることが多いんですよね。この辺の小さい肌感覚、実際に触ってる人じゃないと出てこないやつ。
実際にただっちさんが試したのは、自分のレシピ本の表紙。自前の素材を突っ込んで、どこまで詳細にプロンプト化できるか、って実験です。これがね……

ただっち(06:25〜)
「僕もさっき試したんだけど、ちょっと難しいかなと思ったけどすごく詳細にはできました。相当詳細に」
「相当詳細に」。ここ、けっこう大事なんですよ。ふわっと「いい感じのプロンプト」が出るんじゃなくて、被写体・背景・質感・ライティングまで、こまかく拾ってくる。だから出てきたテキストをちょっと手直しするだけで、自分のイメージにかなり寄せられる。ゼロから書くのと、8割できてるのを直すの——もう、しんどさが全然ちがうでしょ。
あ、そうだ。このツール、プロンプト生成だけで終わらないんです。出てきたプロンプトをそのままGenSparkやFluxに流して、画像生成まで一気にできる。「画像を読む→言葉にする→また絵にする」が、ひとつの流れでつながってる。ここが便利なんですよ。料理で言うとね、できあがった一皿を味見して、レシピを書き起こして、その場でもう一回作り直せる——みたいな話。再現の回路がぐるっと閉じてるんです。

画像→プロンプト→画像生成、この流れが一気通貫でできる時代になってた。


GenSpark・Rekraftで女の子キャラを量産してみた結果
続いてはただっちさんの「個人研究」コーナー(笑)。もともとGrokで作った女の子キャラクターを、別のツールで再現できるか試してみた、っていう話。いやー、これが思った以上に面白い試行錯誤でした。ぶっちゃけ、地味な検証なんですけど、こういうのが一番リアルなんですよね。
ポイントは「裏側のエンジン」。このキャラ、もともとGrokで作ってるんだけど、その裏側がFluxで動いてる。だったら「Fluxで作れば似るんじゃないか」って仮説を立てて、Fluxベースのツールを順番に試していくわけです。仮説→検証→ダメ→次、っていう。研究そのもの。

ただっち(09:16〜)
「名前皆さん募集して、この女の子量産したいなと思って。もともとGrokで作ったんですけど、裏側Fluxで作ってるので、Fluxで作ってVoxで試したらかなり微妙でしたね。ブロックは微妙でしたね」
「名前を募集して、この子を量産したい」。もうこの時点で、ただっちさんの中ではキャラがひとり立ちしかけてる(笑)。でね、ここからが本番です。「Fluxで作れば似る」って仮説を持って、いざ別ツールに移植してみたら——Voxは「かなり微妙」。同じFluxベースのはずなのにVoxはハマらなかった。仮説どおりにいかない。ここがAIの面白いとこで、エンジンが同じでも、ツールごとの味つけで結果が変わるんですよ。
じゃあGenSparkはどうか。ここでも「うーん、ちょっと違うな」って空気が流れて。完全には寄らない。みんなで画面のぞき込みながら「似てる?似てない?」ってやってる、あの感じ。でね、Rekraftに持っていったら……これが急に化けたんです。


ただっち(12:14〜)
「これですね、この子ですね。おぉ。これ、アレンジ度高くない?似てる似てる。ジェンスパーク、いいね。優秀」
「似てる似てる」「いいね、優秀」。この瞬間の盛り上がり、伝わりますかね。さっきまで「微妙」「ちょっと違う」って言ってたのが、急に手応えが出る。ぽいぽいぽい、って言いながら二人で盛り上がってましたね。結局このLIVEの体感としては、Rekraftが一番、元のキャラの顔や雰囲気を保ったまま再現できてた。同じFlux系でも、ここまで差が出るのか、と。
でね、ここから話がさらに転がって。「ネバブラの集合写真を再現しようとしたら、人数が増えちゃった」っていう珍事も出てきて(笑)。複数人の集合写真ってAIが一番苦手とするやつで、人数も顔も、わりとふわっと盛ってくるんですよ。
ひろくん(14:34〜)
「やっぱりジェンツパークのほうは4人だよ」
「ジェンスパークのほうは4人」。元が何人だったかって話なのに、ツールを通したら人数が変わってる(笑)。ここ、笑い話に見えて、実はすごく大事なポイントなんです。AIの画像再現って、まだ「だいたい合ってる」レベルなんですよ。雰囲気はバッチリ寄せてくるけど、人数とか細部の事実は平気でズレる。だから「最後は人間が数える」。この一手間は、まだ当分なくならないでしょうね。
ツールによって人数まで変わる。AIの画像再現性はまだ「だいたい合ってる」レベル。



動画生成の進化と3Dモデル化…AIが「見るもの」から「立体化するもの」へ
動画生成の話も出てきました。私、Soraを久しぶりに起動したんですよ。そしたら「1月4日以降、触ってないですね」って(笑)。いっぱい遊んで、ちょっと飽きて、離れてた。でね、これ自分でも「あるあるだな」と思って。新しいAIツールって、最初の1週間ぐらいはめちゃくちゃ使うんですよ。ドワーって。で、ひと通り遊ぶと、すっと離れる。

ひろくん(16:30〜)
「動画とか画像とか、音楽先生は一瞬ハマってドワーってやってる。ちょっと飽きると一緒に離れる」
「一瞬ハマってドワー、飽きると離れる」。これ、笑い話に聞こえるけど、AIツールとの正しい付き合い方かもなって思うんですよ。全部のツールをずっと使い続けるなんて無理でしょ。一回ガッツリ触って、何ができて何ができないかを体で覚える。で、本番で必要になったときに戻ってくる。引き出しに入れとくだけでいいんです。触っとくのと、知ってるだけ、では全然ちがう。
でね、動画生成の進化そのものは本物で。「全部AIって思えないもんね」ってただっちさんも言ってました。ただ、まだ弱点もある。そこが正直なところ。
ただっち(17:35〜)
「なんか動きが小さいといいけど、ちょっと動くともうルーマンとかはだいぶ破綻しちゃうから。ぶっ壊れてくるもんね」
ここのツール名、正直このシーンの音声だとはっきり拾いきれてないんですけど(笑)、言いたいことはちゃんと伝わってきて。止まってる画、ちょっとだけ動く画はめちゃくちゃキレイ。でも、大きく動かすと——人の形がぐにゃっと破綻する。手の指が増えたり、顔が溶けたり。動きが激しくなるほどボロが出るんです。だから今の動画AIは「大きく動かさない」のがコツ。風で髪がそよぐ、湯気がゆらぐ、くらいの小さい動きに留めると、もう実写と見分けがつかない。弱点を避けて使えば、めちゃくちゃ強い。


そして話は3Dモデル化へ。ここがこの日いちばんロマンあったとこ。カムイ(AI画像解釈ツール)に、Gemini 2.0のマルチモーダルと、OpenAIのO1 APIを組み合わせて、写真から3Dデータを作る、っていう話なんです。平面の写真が、立体に起き上がる。「見るもの」だったAIが、「立体化するもの」になってきてる。

ひろくん(20:09〜)
「ぬいぐるみとか、自分の作った子供の作品とかを3Dかアート化して、それをVR空間上に置いてみるっていうのがいいなって思ってます」
ぶっちゃけ、ここが一番グッときた。子供が粘土でこねた作品とか、お絵かきとか、ぬいぐるみとか——ああいうの、捨てられないでしょ。でも全部は取っておけない。それを3D化して、VR空間にぽんって置いておけたら……物理的にはかさばらないのに、いつでも見に行ける。思い出が立体のまま残るんですよ。これは技術というより、家族の話なんですよね。
ただっち(20:27〜)
「展覧会もできるよね、無限に」
「展覧会もできるよね、無限に」。これがまた効いてて。場所代もいらない、額縁もいらない、子供の作品だけを集めたVR美術館が、無限に作れる。おじいちゃんおばあちゃんを招待したっていい。遠くに住んでても、その空間に入れば一緒に見られる。技術の話のはずなのに、最後は「誰と、どんな時間を過ごすか」に着地する。これがAIの面白いとこなんですよ。
写真一枚から3Dモデルへ。子供の作品がVR美術館に並ぶ日は遠くない。


AIが日常に浸透してきた…アデランスの話とか(笑)
でね、AIって今や「特別なもの」じゃなくなってきてるよね、っていう話になりました。一部のオタクが触る道具じゃなくて、気づいたら生活の中に溶けてる。実際、自分の親世代が知らないうちにAIの恩恵を受けてる、ってことが増えてるんですよ。そこで私が出した例が、ちょっと面白くて。「アデランス」の話。

ひろくん(21:04〜)
「最近だとアデランス。カツラの髪型シミュレーション。なんかね、カツラーが出てきて、アデランスする人にとって、まさにこの自分の髪型、もし上げるとどうなるかみたいな」
カツラの髪型シミュレーション、ですよ。自分の顔写真に、いろんな髪型をのせて「あなたがこれを着けたらこうなりますよ」って先に見せてくれる。これって、地味だけどすごい話で。だって、いちばんの不安って「自分に似合うかどうか」じゃないですか。高い買い物なのに、着けてみるまでわからない。その「わからない」が、一番こわいんですよ。そこを先に見せてくれたら、迷いがごっそり減るでしょ。買った後に「あれ、思ってたのと違う……」ってなる悩みが、丸ごと消える。料理で言うと、注文する前に試食できる、っていう話なんです。
ただっちさんがすかさず「女性の例もあるよね」って乗ってきて——これがまた、わかりやすかった。

ただっち(22:01〜)
「女性のイメージね。口紅とかを置いておいて、この色を使うとあなたこの口紅になりますよ、みたいな」
口紅も同じ。「この色を選ぶと、あなたの唇はこうなりますよ」って、自分の顔で見せてくれる。カツラも、口紅も、根っこはまったく同じなんですよ。「買ってから後悔する」を、AIが先回りでつぶしてくれる。試着室が、自分の顔の中に入ってくる感じ。お店に行かなくても、画面の中で何回でも試せる。失敗のリスクがゼロに近づくから、お客さんは安心して選べるし、お店は「思ってたのと違った」っていう返品やクレームが減る。両方トクするんですよ。
いやー、そうだ。ここで私、筋トレジムの例も出してきて、ここがまた熱かった。シミュレーションって、買い物だけじゃない。もっと深いとこに刺さるんです。

ひろくん(21:44〜)
「ライトアップやってよかったですって言われたら、やろうかなって。お客様の声が本人、自分本人」
ここ、正直サービス名の音声が微妙で、はっきり特定はできないんですけど(笑)、言いたいことの骨格はブレなくて、めちゃくちゃ大事な話だと思っていて。今までの「お客様の声」って、他人の体験談だったんですよ。誰かの成功談を見せられても、いや、それはその人の話でしょ、自分は別でしょ、って心のどこかで思っちゃう。でもAIのシミュレーションなら、未来の”自分”を先に見せられる。頑張った先の自分の姿が、画面に出てくるんです。「他人の声」が「自分のビフォーアフター」に変わる。これ、説得力の桁がちがうでしょ。自分が頑張った先の姿が見えたら、続けられる理由になる。ただっちさんも「イメージできるのはいいよね」って言ってて、二人して「これは来るな」ってなりましたね。
AIのシミュレーションが「他人の体験談」から「自分のビフォーアフター」に変わる。


営業AIエージェント「アポトリ」が怖いくらいすごい件
ここからがLIVE後半の本題。営業AIエージェントの話です。「アポトリ」っていうツールを紹介したんですけど、これがね……正直、えぐい。便利すぎて、ちょっと怖いくらい。どういうものかっていうと、相手の会社の情報を渡すと、その会社専用の営業メールを自動で作ってくれるんですよ。

ひろくん(22:47〜)
「会社の情報を渡していくと、もういろんな情報、すごい精度に上がってくるのがあってね。SOとか会社の情報とか全部拾ってきて、その会社が何をやっててどんな課題があるかっていうのを意気込みになった状態でホームページ見てるんですけどよかったら商談します、伺いませんかみたいなものを作ってくれて、1to1メール、ワントゥーワンメール」
ここのキモは「1to1メール」、ワントゥーワンメールってとこ。普通の営業って、同じ文面を何百社に一斉送信するでしょ。だから「あ、これテンプレだな」ってバレる。読まずに捨てられる。でもアポトリは、相手の会社が何をやってて、どんな課題を抱えてるかを、ホームページから全部拾ってくる。そのうえで「御社のこの課題、こう解決できますよ」って、一社ごとに違う文面を作る。受け取った側は「うちのこと、ちゃんと調べてくれてる」って感じる。これが効くんですよ。
そう、これが一番の衝撃で。「全く1回も関係性がない」のに、超個別化されたメールが自動で送られてくる。私自身も海外ツールで試したことがあるんですけど、もう「社長、いつもお世話になってます」みたいなテンションで来るんですよ。一回も会ってないのに(笑)。最初ちょっと、ゾッとしました。でも逆に言うと、それくらい自然に作れちゃう時代になってる、ってことなんですよね。

ただっち(23:53〜)
「僕もよく営業マンションでやってましたけど、めっちゃ長年お世話になってるつもりで電話する。新規に電話するっていうのをよくやってました」
ここでただっちさんが「あー、それ昔やってた」って乗ってきて。営業マンって、新規の相手にも「長年お世話になってるつもり」で電話する、っていうテクニックがあるらしいんですよ(笑)。つまり、AIがやってることって、できる営業マンが昔から人力でやってた「事前リサーチ+親密フリ」を、自動で・大量に・一瞬でやってるだけなんです。技術が、人間の職人芸を再現してる。だからこそ効くし、だからこそ怖い。
でね、私が描いてたのはもっと先で。メール1本で終わらせるんじゃなくて、「集客から自動化していく。教育して、商談まで自動化していく。提案まで自動化していく。フォローまで自動化していく」っていう、一気通貫の構想なんです。点じゃなくて、線でつなぐ。

ひろくん(25:44〜)
「分析AIエージェントで、入院中も稼げるか実験でやろうとするの提案してセールスして、販売後のフォローをするところ。集客から自動化、集客したらその分身の家が接客して教育するっていうのが全部できちゃう」
「入院中も稼げるか実験で」——ここ、半分本気なんですよ(笑)。私、このあと入院を控えてて。普通なら仕事が止まる期間でしょ。でも、集客して、接客して、教育して、提案して、フォローまで——この一連の流れをAIエージェントに任せられたら、自分が動けない間も回り続ける。寝てる間に分身が働いてくれる、みたいな世界。それを自分の体で実験してやろう、と。便利を語るより、自分で試して「ほんとに回るのか」を見たいんですよね。
営業エージェントは今、集客から受注・フォローまで一気通貫でやれる段階に来てる。


日本のAI規制緩和・マイクラ世代・CreateXYZ…未来の話が止まらなかった
LIVE後半はどんどん話が広がって。気づいたら日本のAI規制の話になってました。でね、これ意外と知られてないんですけど、日本ってAIに対する規制がわりと緩いんですよ。だから「実験場」としては、めちゃくちゃ恵まれてる。

ひろくん(28:52〜)
「日本は割と緩いので、ドバドバとAI実験場になるんじゃないかなって。ヨーロッパはガチガチですから。ここに日本のチャンスがあるな、というところもある」
ヨーロッパはAI規制がかなりガチガチ。個人情報の扱いとか、生成物の責任とか、もうルールでガチガチに固められてる。一方で日本はまだ緩い。これ、見方を変えれば「日本でなら、まず試せる」ってことなんですよ。新しいことをやろうとすると、規制が壁になる国が多いなか、日本は実験のハードルが低い。ここに、ちゃんとチャンスがあるな、と。緩いのは不安でもあるけど、動ける、ってことでもあるでしょ。
ひろくん(29:29〜)
「特にマイクラやってる子供たちマイクラ世代からすごい企業が出てくるんじゃないか」
でね、もう一個の未来予想がこれ。マイクラ世代。マインクラフトで育った子供たちって、もう「自分で世界を作る」のが当たり前なんですよ。ブロックを積んで、仕組みを組んで、ゼロから何かを生み出す。あの感覚をネイティブで持ってる世代が、AIを手にしたら——そりゃ、とんでもない企業が出てくるでしょ。私たちが「すげー」って言ってるツールを、彼らは空気みたいに使いこなす。ほんと、楽しみで仕方ないんですよ。

そして話はCreateXYZへ。これがまた未来っぽくて。Stripe決済を組み込んだAIアプリが、一瞬で作れるやつなんです。私も試しに「リフォーム屋さんのSEO対策アプリ」を作ってみて、しかも1000円課金できるモデルまで組んだんですよ。コードもほとんど書かずに、です。アイデアを思いついてから、お金を取れる形になるまでが、もう一瞬。

ひろくん(30:07〜)
「公開すれば、どんどん無料で試せますよ。ここから先は1000円払ってね、みたいなものが一瞬で作れる。実践会やったらちょっとみんなその日からAIアプリ作って売り上げを出せるっていう」
「無料で試せて、ここから先は1000円払ってね」。この”フリーミアム”の形が、誰でも一瞬で作れる。これって、すごいことなんですよ。今までは、こういう課金つきのWebアプリを作ろうと思ったら、エンジニア雇って、何ヶ月もかけて……だったでしょ。それが、その日のうちに作れて、その日のうちに売上が立つ。だから入院中にAIエージェントの実験をして、退院したら実践会でみんなに教える——っていう計画も話したんです。「その日からみんなが売上を出せる」状態を、一緒に作りたいんですよね。
そして〆は、阪神淡路大震災30年の話。「AIも大事だけど、防災も大事だよね」って。ただっちさんも「備えあれば憂いなしですからね」って締めてて、なんかこの流れが、すごくLIVEらしかったです。最先端のAIの話で盛り上がったあと、最後はちゃんと地に足のついた防災の話に戻ってくる。浮かれっぱなしじゃない。このバランス感覚、大事にしたいなと。


GPTs研究会は当時4,120人。着々と増えてます。一個一個のツールを、その場で体に覚えさせていく——この積み重ねが、後でぜんぶ効いてくるんですよ。退院後の実践会、ぜひ楽しみにしててくださいね。
AIの使い方を覚えた人は、後々どんどん拡張してくる。だから今、一個一個を体で覚えておくことが大事。

IF塾 ASHURA
AIを“使う”側から“創る”側へ。
自分だけの専門特化AIツールを、自分の手で。
プログラミング未経験でもOK。毎月の開発講座+グループコンサル+AI賢者への24時間相談つき「AI開発コミュニティ アシュラ」
▶ 無料モニターに申し込む凛ちゃんコラム:画像→プロンプト変換が開く「再現性の時代」

今回LIVEで紹介された「画像からプロンプトを作る」というアプローチ、実はかなり本質的な変化を指してると思っていて。
今まで画像生成って「うまいプロンプトを書ける人だけが上手い画像を作れる」世界だったんですよ。でも画像→プロンプト変換が普及すると、「この写真と同じ雰囲気で作って」が誰でもできるようになる。プロンプトの言語化能力じゃなくて、センスとイメージを持っている人が有利になる。
これって、AIが「専門知識の壁」を次々と崩している流れの一つですよね。ひろくんが言ってた「一回使い方を覚えた人は後々どんどん拡張してくる」っていう話、まさにそれ。
詳しくは分身AIの記事も読んでみてください:分身AIの画像生成・プロンプト解説 / bunshin-ai.com
よくある質問
🎯 AIと愛で、未来をひらく。「あいあいらぼ。」
起業家・経営者のためのAI実践型コミュニティ。AI実践ワークショップ・AIクリエイティブ会・AI目標達成会が月額5,500円で遊び放題!AIMUNIQ(株)主催。
📱 ただっちのFacebook 🌐 あいあいらぼ。関連記事

🎁 無料プレゼント
Aiport(ClaudeCode AIエージェント実践会)
ClaudeCodeでAI秘書+分身AI+AIカンパニーが無料で作れるキット&解説動画をプレゼント!
▶ 無料で入会してキットを受け取る🤖 AI生成コンテンツについて
この記事はAIツール(Claude Code)を活用して制作しています。構成・文章生成・画像制作にAIを使用し、最終的な内容の確認・編集・公開判断はひろくん(田中啓之)本人が行っています。「分身AIひろくん」(bunshin-ai.com)とは別のコンテンツです。