AIに画像を作らせるときの指示のコツ【入れてはいけない要素】

AIに画像を作らせるときの指示のコツ【入れてはいけない要素】 AI・自動化

結論から書きます。ブログのアイキャッチをAIに作らせるなら、文字と数字は指示から外したほうがいいというのが、私が実際に何度も事故ってたどり着いた結論です。「タイトルを画像に入れて」と頼むと、それっぽいけれど読めない文字が並びます。もっとこわいのは、頼んでもいないのに実在しない数字が画像の中に描かれることです。私はこれを実際にやりました。

私は元調理師で、飲食の現場に10年いました。そこからSNS運用代行のフリーランスとして独立して、いまはAIとツールで自分の作業を自動化しています。画像生成についても専門家ではなく、自分のブログとSNSのために毎回使いながら覚えている側です。この記事は、実際に手を動かして「これは入れないほうがいい」と分かった要素を、順番に並べたものです。

使ったことがあるのはGeminiとhiggsfieldだけなので、書けるのはその範囲の話です。他の画像生成サービスについては私は未検証なので、おすすめとしては出しません。

まず起きたこと:頼んでいない数字が画像に描かれた

自分の自動化の記録をブログとSNSに出していて、そのアイキャッチをAIに作らせようとしたときの話です。プロンプトに「自動投稿の実績をイメージした画像」といった説明を入れました。数字を入れてくれとは一言も書いていません。

出てきた画像には、グラフのようなものと、その横に数字が並んでいました。何の数字なのか私には分かりません。私が実際に持っている数字ではないことだけは確かでした。AIは「実績」という言葉から、実績っぽい見た目を作っただけです。中身の裏取りは当然していません。

これがなぜ危ないかというと、画像は読み飛ばされる前提で置かれるのに、数字だけは目に入るからです。本文には正しい数字を書いていても、アイキャッチに別の数字が乗っていたら、記事全体が嘘になります。文章のほうは自分で読み返して直せますが、画像の中の数字は「デザインの一部」に見えてしまうので、チェックの対象から外れやすい。私は一度出してから気づきました。

実は同じことを文章側でも経験しています。投稿文をAIに書かせていたら、本当は68本なのに62本と書いてきたことがありました。文章として自然なので読んでも気づけません。対策として、実際に起きたことと実測値だけを書いた台帳を作って、そこに載っている数字しか使わせないようにしました。文章では台帳で止められたのに、画像では止められていなかったわけです。

画像の中の数字は、あとから検算できない

テキストなら、数字を書いた箇所を検索して台帳と突き合わせられます。画像はできません。生成された時点で絵の一部になっていて、あとから「この数字はどこから来たのか」を追う手段がない。私が今やっているのは、そもそも数字を描かせないという一点だけです。検算できないものは作らせない、という方針にしました。

入れてはいけない要素その1:文字(日本語はとくに)

アイキャッチにタイトル文字を入れたい、という発想は自然だと思います。私も最初はそうしました。結果は、ほとんどのケースで使えませんでした。

日本語を描かせると、漢字の形が崩れます。パーツの数が合わない、へんとつくりが入れ替わる、存在しない字になる。ぱっと見は日本語に見えるので、縮小表示だと気づかないことすらあります。SNSのタイムラインで小さく表示されているぶんには通ってしまって、拡大した人にだけバレる、という一番よくない状態になります。

英語でも安心はできません。単語の途中の文字が入れ替わったり、同じ文字が二重に出たりします。一般に、画像生成AIは文字を「文字として」ではなく「そういう形の模様」として描いていると言われていて、私の手元で起きたこともその説明と矛盾しませんでした。

私が今やっているのは、画像には文字を入れさせず、文字が必要なら後から自分で乗せるという分け方です。AIには背景と雰囲気だけを作らせて、テキストは別で重ねる。これが一番やり直しが少なかった。

「文字を入れないで」と書いても入ることがある

プロンプトに「文字は入れないでください」と書いても、看板やポスター、ノートの表紙といったモチーフが入ると、そこに勝手に文字らしきものが描かれます。指示を無視しているというより、そのモチーフには文字があるのが自然だとAIが判断しているという感じでした。

なので私は否定形で止めようとするのをやめて、文字が乗りそうなモチーフ自体を指示から外すようにしました。看板、本、画面、書類、標識。このあたりを外すと、文字らしきものが出る頻度が目に見えて下がります。「入れないで」と言うより「そこに置かない」ほうが早い、というのが実感です。

入れてはいけない要素その2:グラフ・チャート・数値表現

これが冒頭の事故の直接の原因です。「グラフ」「データ」「分析」「成長」「実績」といった言葉をプロンプトに入れると、AIはそれっぽい図表を描きます。そして図表には目盛りと数字が付きます。

厄介なのは、言葉として「グラフ」と書いていなくても発火することでした。「伸びている様子」「成果が出たイメージ」みたいな抽象的な言い方でも、右肩上がりの折れ線と数字が出てきます。AIの中で、その概念と図表の見た目が強く結びついているんだと思います。

私の記事は自動化の実測値を扱うことが多いので、この地雷は踏みやすい。今は、記事の主題がデータの話であっても、アイキャッチのプロンプトにはデータを連想させる語を入れないと決めています。画像は雰囲気を担当して、数字は本文が担当する。役割を分けました。

グラフが必要なら、画像生成AIで作らない

そもそも自分の実測値を図にしたいなら、画像生成AIは道具として合っていません。私は週次・月次で自分の投稿を自動集計してDiscordにレポートを飛ばす仕組みを動かしていて、数字はそちらに全部あります。それを図にしたいなら、その数字を使って作るべきで、AIに「それっぽいグラフ」を描かせる場面ではない。

この線引きをしてから、画像生成に対するイライラがかなり減りました。正確さが要るものは渡さない。それだけです。

入れてはいけない要素その3:細かい指定の詰め込み

オンラインで学ぶ様子

最初のころ、私は一つのプロンプトに要素を詰め込みすぎていました。構図、色、被写体、光、質感、雰囲気、時間帯、画角。全部書けば全部反映されると思っていたからです。

実際には、要素が増えるほどどれか一つが必ず無視されるという感触でした。しかも無視される項目が毎回違うので、何が効いている指示なのかも分からなくなる。10個書いて7個しか通らない状態だと、外れた3個を特定する作業のほうが時間を食います。

今は、絶対に守ってほしいことを2つか3つに絞って書き、あとは書かないようにしています。書かなかった部分はAIが埋めますが、そのほうが結果として破綻が少なかった。埋めた部分が気に入らなければ、そこだけ次の指示で足せばいい。

優先順位を先に決めておく

私の場合、アイキャッチで優先するのは「全体の明るさ」と「主役が真ん中に来ていないこと」の2つです。タイトル文字を後から左右どちらかに乗せるので、真ん中に主役があると重なって困る。この2つだけ先に書いて、残りは任せます。

逆に、色の細かい指定はほとんど諦めました。「青系で」くらいは通りますが、それ以上細かく指定しても思った色にはなりません。ここは自分の側で妥協した部分です。

入れてはいけない要素その4:実在するものの固有名詞

これは事故というより、自分で線を引いた話です。実在する人物、ブランド、製品、キャラクター。こういうものを名指しで指示するのはやめました。

理由は単純で、自分のブログのアイキャッチに、権利関係が分からないものを置きたくないからです。似ているだけで問題になるのかどうかを毎回判断する自信がないので、判断が必要な状況を作らないことにしました。

同じ理屈で、実在する場所や建物の名前も避けています。「北欧っぽい部屋」までは書きますが、特定の建物名は書かない。この線引きに絶対の正解があるとは思っていませんが、迷う余地を減らすほうを選んでいます。

じゃあ何を書くのか:私が実際に使っている型

入れないものばかり並べたので、逆側も書きます。私が今アイキャッチで書いているのは、だいたい次のような要素です。

  • 被写体を1つだけ決める(人か、物か、風景か。複数入れない)
  • その被写体が置かれている場所を一言で書く
  • 光の状態を一言で書く(朝の光、曇り、室内の照明など)
  • 全体の明るさの方向を書く(明るめ、落ち着いた感じ、など)
  • 主役を中央に置かない、と書く(後から文字を乗せる余白を残すため)

この5つだけです。スタイルの細かい指定も、カメラの設定風の呪文も、今は書いていません。書いても効いているのか分からなかったからです。効いているか判断できない指示は、書かないほうが検証がラクになります。

一発で決めようとしない

もうひとつ変えたのは、一回のプロンプトで完成させようとしなくなったことです。最初は雑に出して、方向が合っていそうなものを選んで、そこから足りない部分だけ次の指示で足す。この進め方に変えてから、трудかった「何度出しても近づかない」状態がだいぶ減りました。

これは動画のほうで学んだことでもあります。ナレーションを速くしたら、今度は各カットの後ろに無音が残って、かえって間延びしたことがありました。速度だけ変えても尺は直らなかった。一箇所いじって全体が整うことはあまりない、というのは画像でも同じでした。

出したあとのチェック:私が毎回見ている場所

手順を確認する様子

生成した画像をそのまま使うことはありません。必ず自分で見ます。見る場所は決めてあります。

  • 文字らしきものが写り込んでいないか(看板、画面、紙、服のプリント)
  • 数字が写り込んでいないか(時計、メーター、値札、グラフの目盛り)
  • 手や指の本数が破綻していないか
  • 左右のどちらかに、文字を乗せられる余白があるか
  • 縮小したときに何の画像か分かるか

とくに上の2つは、原寸で見ないと気づきません。作業画面のサムネイル表示だけで判断すると通り抜けます。私が数字入りの画像を出しかけたのも、小さい表示で確認したのが原因でした。

この「表示だけ見て安心して、実際は違った」という失敗は、画像に限った話ではありませんでした。Xの自動投稿を組んだとき、タスクは全部「準備完了」と表示されていたのに、実際は一度も動いていなかったことがあります。原因は登録スクリプトで変数名にPowerShellの予約語を使っていて、タスクに渡す引数が丸ごと空になっていたことでした。表示は正常、中身は空。画像も同じで、それっぽく見えることと、中身が正しいことは別です。

エラーが出ない失敗がいちばんこわい

自動化をやっていて一番痛い目を見たのは、エラーが表に出ない失敗でした。日付を整える処理で、パソコンによって使える書き方と使えない書き方があるのを知らずに書いて、機能がまるごと無言でスキップされていたこともあります。

画像生成の「勝手に数字を描く」も、この種類だと思っています。失敗として報告されないので、自分で見に行かないと分からない。だからチェック項目を紙に書き出すように決めておいて、毎回同じ場所を見るようにしています。

GeminiとhiggsfieldでAIに画像を作らせて感じた違い

私が実際に使ったことがあるのはこの2つだけです。使い比べた詳しい話は別の記事に書いたので、ここでは今回のテーマに関係する部分だけ書きます。

どちらを使っても、文字と数字については同じように事故りました。片方なら安全、ということはなかったです。なので「文字を描かせない」という方針は、道具を変えても変わりませんでした。

逆に言うと、道具選びで悩むより先に、何を指示しないかを決めるほうが効きます。私は最初、うまくいかない原因はサービス選びにあると思って比較ばかりしていました。実際には、自分の指示の中に地雷を置いていただけでした。

なぜ「入れない」ほうが速いのか

ここまでずっと「入れるな」という話をしてきました。理由は、やり直しの回数が減るからの一点です。

文字を入れさせると、崩れた文字を直すためにもう一度生成することになります。もう一度生成すると、今度は構図が変わります。構図を戻そうとすると、また文字が崩れる。この往復に一番時間を取られていました。

最初から文字を入れさせなければ、この往復が丸ごと消えます。文字は後から自分で乗せるので、崩れようがない。位置も自分で決められる。AIに任せる範囲を狭くしたほうが、結果的に早く終わったというのが正直なところです。

これは自動化全般でも同じ感覚を持っています。私はThreadsとXに1日5本ずつ自動投稿する仕組みを動かしていますが、AIに任せているのは投稿文の生成までで、実際に投げる部分はスクリプトが決まった手順でやっています。判断が必要な部分と、正確さが必要な部分を分けておかないと、後から検証できなくなるからです。

「AIにやらせない」と決めることも設計のうち

自動化を組み始めたのは2026年6月で、まだ2ヶ月ほどしかやっていません。それでも分かったのは、全部をAIに寄せると、間違いを見つける場所がなくなるということでした。

投稿文で嘘の数字を書かれたときも、対策は「もっと賢く書かせる」ではなく「数字は台帳のものしか使わせない」でした。画像も同じで、「文字をきれいに描かせる」方向ではなく「文字は描かせない」方向に振ったほうが、私の手元では安定しました。

台帳を足しただけでは直らなかった話

これは画像ではなく文章の話ですが、対策の作り方として関係するので書いておきます。

嘘の数字を止めるために台帳を作ったのに、それだけでは直りませんでした。前から書いてあった「毎回、具体的な出来事を必ず入れる」という指示と噛み合わなくて、台帳のネタが尽きるとやっぱり作り話をしたんです。「無ければ書かなくていい」と言い直して、やっと止まりました。

画像でも似たことが起きます。「文字を入れないで」と足しても、他の部分で「看板のある街並み」と書いていれば、指示同士がぶつかります。禁止を足すより、矛盾する指示を消すほうが効く。これは両方でつまずいて分かったことです。

いまの正直なところ

動画編集の作業画面

アイキャッチの作り方は落ち着きましたが、それで記事が読まれるようになったかというと、そこは別です。私の発信はまだ集客がうまくいっていません。Threadsは6月25日から7月27日までに87本を自動投稿して、その間フォロワーは0人のままでした。7月27日時点で数えたとき、7月のビューは527・いいね7・返信0・リポスト0でした。

noteのほうも、7月27日時点で記事27本・フォロワー2人・全記事の合計いいねは45です。アイキャッチの質が全部を決めるなら、もう少し違う数字になっていたはずです。画像を整えることは、届かない問題の解決策ではありませんでした

それでも、間違った数字が乗った画像を出さずに済んでいるという意味では、この整理には価値がありました。読まれないことと、間違ったものを出すことは、別の問題です。前者はまだ解けていませんが、後者は自分で止められます。

手応えが無い期間についても、すぐ失敗とは思わないようにしています。引き継いだクライアントの案件をコンセプトから作り直したとき、伸びるまで手応えは一切ありませんでした。やっている最中は効いているのかどうか分からないままで、しばらく経ってから急に来た。だから今も、反応が無い期間を即座に否定はしないようにしています。

まとめ

  • AIに画像を作らせるとき、文字と数字は指示から外すのが一番やり直しが減った。
  • 頼んでいなくても、AIは「実績」「成長」といった言葉から実在しない数字を描く。私は実際に出しかけた。
  • 画像の中の数字は、あとから検算できない。だから最初から描かせない。
  • 「文字を入れないで」と否定形で足すより、看板・本・画面など文字が乗るモチーフを指示から消すほうが効いた。
  • グラフやチャートを連想させる語も入れない。正確な図が要るなら、実測値から自分で作る。
  • 指示は詰め込まない。守ってほしいことを2〜3個に絞ると、破綻が減った。
  • 実在する人物・ブランド・建物の固有名詞は、判断が必要な状況を作らないために避けている。
  • 生成後は原寸で、文字・数字・手・余白・縮小時の見え方を毎回チェックする。サムネイルだけでは通り抜ける。
  • 禁止を足すだけでは直らないことがある。矛盾する指示を先に消すほうが早い。
  • 使ったことがあるのはGeminiとhiggsfieldだけ。どちらでも文字と数字は同じように事故った。他のサービスは私は未検証。
  • アイキャッチを整えても、届く量は変わらなかった。見られない問題は別に解く必要がある。

コメント

タイトルとURLをコピーしました