プロンプト・トゥ・イメージ(文から画像への変換)
意味・解説
テキストによる指示(プロンプト)を入力することで、AIがそれに応じた画像を自動生成する技術。
くわしく
「AIという『画家』に、言葉で依頼書を渡して絵を描いてもらう技術」です。
1.仕組み:
大量の画像とそれを説明するテキストのペアを学習したモデルが、入力された単語から連想される色や形を組み合わせて新しい画像を構築します。
2.マルチモーダル性:
テキスト(言語)と画像(視覚)という異なる種類のデータ(モード)を橋渡しする技術の代表格です。ポイントは、デザインや広告、素材作成のコストを劇的に下げると同時に、誰もが頭の中のイメージを即座に形にできるクリエイティブの民主化をもたらしたからです。
例文
アプリのアイコンデザインを検討する際、プロンプト・トゥ・イメージ技術を活用して、短時間で数百パターンの候補案を作成した。
同義語: Text-to-Image / T2I / 文から画像生成
分類: 生成AI(Generative AI)