GPT 图2:具有参考编辑功能的下一代AI图像模型

核心要点 (BLUF): GPT Image 2 是下一代 AI 图像模型:更多帧格式、高达 4K 的分辨率以及真正有用的参考处理。上传多达 16 张您自己的照片,用简单的语言描述工作,然后模型会根据您的来源编辑镜头或构建新场景。一切都在浏览器中运行,并具有完整的生成历史记录。

人工智能在从单张照片生成的四种不同设置中呈现相同的产品

新一代改变了什么

升级实际上拓宽了画布:六种长宽比,而不是三种,包括故事的垂直 9:16 和封面的宽 16:9。分辨率现在是一种选择 - 从快速 1K 到密集 4K。自动模式会为您选择比例,这在编辑您自己的照片时是一个安静的救星。

该系列的标志性特征仍然存在:仔细提示阅读。该模型仍然包含具有许多条件的长指令,但以更精细的细节执行它们。如果您使用上一代,诚实的测试是重新运行旧的提示并比较小东西的绘制方式。

参考:编辑和场景组装

最多附加 16 张图像,每张图像 10 MB。一张照片加上一条说明就意味着编辑:删除路人、替换天空、重新粉刷立面。多张照片意味着组装:一张照片中的产品、另一张照片中的内饰以及第三张照片中的情绪在您的指导下合并成一个新的框架。

实用的零售工作流程是为整个目录拍摄一张照片:拍摄一次产品,然后在不同的环境、模型和季节性场景中生成它。对于个人照片,它可以挽救背景不佳的好照片。用言语描述这种变化,就像与修饰师交谈一样——没有遮罩或图层。

以 4K 分辨率渲染的垂直 9:16 帧,为社交故事做好准备

六种帧格式加自动

您可以获得方形 1:1、垂直 9:16 和 3:4、水平 16:9 和 4:3 — 足以涵盖故事、提要、视频缩略图、横幅和打印布局。生成前选择格式;预先选择正确的框架胜过稍后裁剪完成的图像。

自动模式完全消除了这个决定:模型判断哪些比例适合。附上参考资料后,这尤其方便 - 取景遵循源,因此垂直照片永远不会被挤成正方形。当平台需要精确的大小时,只需明确设置即可。

在 1K、2K 和 4K 之间选择

1K 是草稿和想法检查的主力:它生成速度更快,花费的代币更少。 2K 是在屏幕上查看社交信息和网站的全能工具。 4K 通过打印作业、大型横幅和人们会放大或近距离检查的图像来赚取成本。

经济的程序分为两步:在 1K 处寻找正确的构图和措辞,然后使用历史记录中的相同提示在 4K 处重新生成获胜者。您可以避免在实验过程中为高分辨率付费,并在真正重要的地方保持完整的质量。

谁能从中获得最大收益

市场卖家无需工作室即可获得一致的产品卡。社交媒体经理获得的封面和故事完全符合平台的大小。设计师可以快速获得室内设计、包装和海报的概念,其中简短的准确性和输出分辨率都很重要。

初学者在这里很容易被原谅:没有特殊的提示语言需要学习,普通的句子就可以。从一个简单的任务开始 - 交换你自己照片上的背景是一个很好的第一次运行 - 检查历史记录中的结果,然后进行多参考场景组装。

常见问题

GPT图像2与GPT图像1.5有何不同?

较新的型号提供六种帧格式,而不是三种,包括 9:16 和 16:9,添加了自动宽高比模式和三个分辨率等级,最高可达4K。对复杂提示的标志性理解仍然存在,并且细节明显更加精细。

我可以用它编辑自己的照片吗?

是的。上传照片作为参考,并用文字说明变化:删除物体、更换背景、重新为服装着色。不需要遮罩 - 文本说明就足够了,您可以在一次运行中组合最多 16 个图像。

自动纵横比有什么作用?

该模型会选择框架比例以匹配您的提示或上传的参考。编辑照片时,这可以保持原件的自然取景完好无损。如果平台需要精确的尺寸,请手动选择特定的比例。

相似模型