IT之家 12 月 17 日消息,当地时间 12 月 16 日,OpenAI 宣布推出新版 ChatGPT Images 图像生成器。该功能基于最新的旗舰级 AI 生图模型,支持从零开始创作或对已有图片进行编辑,在生成速度、细节保留和指令遵循等方面均有明显提升。

据介绍,新版 ChatGPT Images 的生成速度最高可提升至此前的四倍,并能够在执行编辑指令时更加精准,仅修改用户明确要求的部分,同时保持原有图像的光照、构图以及人物外观等关键细节一致。无论是图片微调、风格化处理,还是概念性重构,输出结果都更贴近用户预期。

该模型即日起向所有 ChatGPT 用户逐步开放,同时也通过 API 提供,名称为 GPT Image 1.5。IT之家注意到,这一功能也已在 ChatGPT 中同步上线,面向大多数用户开放,Business 和 Enterprise 版本将于后续提供支持。

在图片编辑方面,新模型支持多种操作类型,包括添加、删除、合成、融合与替换等,使用户在保留图像核心特征的前提下完成所需修改。
对于创意型应用,新模型在文本、布局及元素重构方面表现更为突出,可在保留原图精髓的同时实现更复杂的创意表达。相关功能可通过 ChatGPT 中新增的 Images 专区使用,该专区内置多种预设风格与灵感模板,用户无需编写复杂提示词即可尝试不同效果。

在指令遵循能力上,新模型相较初代版本更为可靠,能够在复杂构图中准确保持元素之间的关系。同时,其文本渲染能力进一步增强,可处理更密集、更细小的文字内容。此外,在多人面部渲染、整体自然度等方面,也实现了质量改进,使生成结果更具可用性。
除 ChatGPT 内的功能更新外,GPT Image 1.5 在 API 层面同样带来了改进。与 GPT Image 1 相比,新版本在图像保留和编辑一致性方面更强,尤其适合品牌设计、市场营销以及电商场景,例如在保持品牌标识一致的情况下生成多角度、多场景的产品图片。同时,GPT Image 1.5 的图像输入与输出成本较上一代降低约 20%,有助于开发者在相同预算下进行更多迭代。
OpenAI 表示,此次更新是在对初代图像生成示例进行全面复测后推出的。尽管整体表现已有明显提升,但结果仍非完美,未来版本仍有较大改进空间。此前发布的 ChatGPT Images 初代版本也将继续以自定义 GPT 的形式向用户提供。
相关阅读:
广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。