GPT Image
GPT Imageは、テキストの説明から画像を生成・編集する、OpenAIの画像生成モデルのシリーズである。
記事5本
最終言及 GPT Imageは、OpenAIが開発する画像生成モデルのシリーズである。テキストのプロンプトから画像を生成し、既存の画像を編集する。2025年のgpt-image-1に始まり、GPT Image 2などが登場した。ChatGPTとOpenAIのAPIで提供されている。
この説明は、AIPOSTの記事と広く知られた事実をもとにまとめたものです。誤りがあれば訂正依頼でお知らせください。
この項目を扱った記事
アプリ内のテキスト生成、推論、会話機能にはAnthropicとOpenAIが選択肢になり、画像生成にはGeminiとGPT Image 2が選択肢になります。
Nano Banana ProやGPT Imageのようなクローズドソースのサービスは、プロンプトを入れれば結果が出るという手軽さがありますが、モデルの重みは公開されておらず、ローカルでカスタマイズすることはできません。
動きのある映像を生成する前に、HiggsfieldのGPT Image 2で各登場人物のリファレンスシートを16:9、高画質、4K解像度で作成します。
GPT Image 2で作成した4Kの元画像には、夕暮れの屋上でベージュのトレンチコートを着た女性が写っています。