生成AIで人物画像を作成すると、「なぜか美男美女になる」「指定した肥満体型や普通の容姿にならない」と感じることがあります。これは生成AIが人間の画像を作れないという意味ではなく、学習データや画像生成モデルの特徴によって起こりやすい現象です。
この記事では、生成AIが人物を生成するときに容姿や体型に偏りが出る理由、指定した外見を反映させるコツ、より現実的な人物画像を作成する方法について詳しく解説します。
生成AIは美男美女しか作れないわけではない
結論から言うと、生成AIは美男美女や細身の人物しか作れないわけではありません。肥満体型の人、高齢者、特徴的な顔立ちの人、一般的な容姿の人など、さまざまな人物画像を生成できます。
ただし、画像生成AIは「現実の人間を無作為に再現する機械」ではなく、大量の画像データから多く使われている特徴を学習して、新しい画像を作り出しています。そのため、学習データ内で頻繁に登場する傾向が結果に反映されます。
例えば、インターネット上の人物写真には、広告やSNS、プロフィール写真などで魅力的に見える人物画像が多く存在します。その影響で、何も指定しない場合は整った顔立ちやスタイルの良い人物が生成されやすくなります。
なぜ肥満体型や普通の人が生成されにくいのか
生成AIが肥満体型や一般的な容姿を作りにくい理由の一つは、学習データの割合です。
AIは「普通の人」を理解していないわけではありません。しかし、画像生成では特徴が強いものほど学習結果として表現されやすい傾向があります。
例えば、「会社員の男性」とだけ入力すると、AIは多くの参考画像から平均的なイメージを作ります。その際、広告やビジネス向け素材でよく使われる、清潔感があり整った外見の人物が選ばれやすくなります。
一方で、「身長170cm、体重100kg程度、腹部が大きく、丸顔で、普通の会社員の男性」のように具体的な条件を追加すると、指定した特徴が反映されやすくなります。
生成AIが人物を美化するように見える理由
画像生成AIには、人間が魅力的だと感じる特徴を含む画像を作りやすい傾向があります。
これはAIが「美しいものを作ろう」と考えているからではありません。学習した画像の中に、明るい照明、整った顔、バランスの良い体型などを持つ画像が多く含まれているためです。
例えば、写真素材サイトで「社会人」と検索すると、笑顔で姿勢が良く、服装も整った人物写真が大量に表示されます。そのようなデータを多く学習したAIは、自然と似た方向の画像を生成しやすくなります。
普通の人や特徴的な体型を生成するためのプロンプトの書き方
生成AIで狙った人物を作るには、単に「太った人」「普通の会社員」と入力するだけではなく、具体的な特徴を書くことが重要です。
例えば以下のような指定をすると、より意図に近づきます。
- 体型:肥満体型、ふくよかな体型、大柄な体格
- 年齢:40代、50代、高齢者
- 顔:丸顔、しわのある顔、特徴的な顔立ち
- 雰囲気:普通の会社員、街中にいる一般的な人物
- 写真風:スマートフォンで撮影した自然な写真
例えば「甚平を着た肥満体型の中年男性」よりも、「体重100kg以上の大柄な中年男性が、夏祭りで甚平を着て立っている。自然な日常写真風」のように指定すると、AIが解釈しやすくなります。
生成AIには苦手な表現もある
現在の画像生成AIは非常に高性能ですが、すべての人物表現が完全に自由に作れるわけではありません。
特に、極端な体型、細かな身体的特徴、特定の文化や地域に関連する外見などは、モデルによって表現が安定しない場合があります。
また、AIは「平均的な人物」という曖昧な指示を苦手とします。人間にとっての普通と、AIが学習した画像データ上の平均は一致しない場合があるためです。
生成AIの人物画像は学習データの影響を強く受ける
画像生成AIの出力は、モデルが学習したデータの特徴を大きく反映します。そのため、特定の外見が多く出力されることは、AIの故障ではなく仕組みによるものです。
例えば、料理AIが人気料理を多く提案するように、画像AIも多く存在する人物表現を優先して出力します。珍しい特徴を持つ人物を作りたい場合は、明確な条件指定が必要になります。
生成AIを上手に使うには、「AIが勝手に理想の人物を作る」と考えるより、「具体的な指示で希望する特徴を伝える」ことが重要です。
まとめ|生成AIは美男美女だけでなく幅広い人物を作成できる
生成AIは美男美女や細身の人物しか作れないわけではありません。肥満体型や普通の容姿の人物も生成できますが、学習データの傾向によって整った人物が出やすくなっています。
特に「一般的な人」「普通の社会人」のような曖昧な指定では、AIが広告や素材写真で多く見る典型的な人物像を作りやすくなります。
作りたい人物の体型、年齢、雰囲気、服装、撮影状況などを具体的に指定することで、より現実に近い多様な人物画像を生成できるようになります。


コメント