GPT Image
GPT Image是OpenAI的图像生成模型系列,可根据文字描述生成和编辑图像。
5篇文章
最近提及 GPT Image是OpenAI开发的图像生成模型系列,可根据文本提示词生成图像并编辑已有图像。该系列始于2025年的gpt-image-1,之后推出了GPT Image 2等模型,通过ChatGPT和OpenAI API提供。
本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。
涉及该条目的文章
对于应用内的文本生成、推理和对话功能,可以选择Anthropic和OpenAI;对于图像生成,可以选择Gemini和GPT Image 2。
Nano Banana Pro和GPT Image等闭源服务提供更直接的“输入提示词、获得结果”式体验,但其模型权重并未开放,无法在本地定制。
在生成动态视频前,先用 Higgsfield 的 GPT Image 2 为每个角色制作一张参考图,画幅为 16:9,采用高画质和 4K 分辨率。
一张由GPT Image 2生成的4K起始图像显示,黄昏时分,一名身穿棕褐色风衣的女子身处屋顶。