核心要点 (BLUF): GPT Image 2 Pro 是高级图像生成模式:您可以设置精确的画布大小(以像素为单位),而不是近似的宽高比,选择三种渲染级别之一,并在一次运行中获得最多四种变体。添加文件格式选择和最多 16 个参考文献,每个参考文献 50 MB。一切都在浏览器中,从您的代币余额中支付,并具有每一代的完整历史记录。

常规模式是为了速度而构建的:选择宽高比,选择分辨率,然后开始。 Pro 打开快速模式隐藏的控件 - 确切的画布大小、单独的渲染级别、运行产生的变体数量、文件格式和压缩。这是相同的引擎,只是完整的控制面板在您面前。
每当图片进入布局而不是进入提要时,差异就会显现出来:固定尺寸的产品卡、具有严格要求的平台的封面、用于打印的插图标题。当尺寸对像素很重要时,之后必须裁剪近似“大约 3:2”的尺寸,并且裁剪恰好会占用您为其生成的帧的部分。
低层是为了找到想法。它是最快且最便宜的,这使得它非常适合尝试措辞:构图、角度和情绪立即可见,而小东西还不重要。 Medium 是社交媒体和网站的中间地带——细节已经整合在一起,价格也保持平静。高代表最终渲染:细腻的纹理、干净的边缘、可读的第二平面细节。
经济的策略是摄影师的联系表:首先是十几张便宜的草稿,然后是根据最佳提示制作的昂贵的最终稿。该提示保留在您的生成历史记录中,因此只需单击一下即可在高级别重复成功的帧,而不是从头开始重写描述。

提供三种尺寸:1024×1024 正方形、1536×1024 横向和 1024×1536 纵向。这些不是“大约 1:1”的预设,而是模型本身工作的画布 - 您所要求的就是结果,之后无需在编辑器中进行修饰。
方形适合头像、卡片和目录图块。横向框架适用于封面、标题和预览。肖像照片适用于故事、海报和任何在手机上全屏查看的内容。在启动之前选择尺寸:重新裁剪完成的图片几乎总是意味着失去构图的边缘。
同样的措辞可能会产生截然不同的框架——这是生成的正常本质。因此,在 Pro 中,您可以一次请求两个、三个或四个变体:模型在一次运行中渲染它们,您可以从准备好的集合中进行选择,而不是重新启动并逐一等待。
这在低渲染级别上最有帮助:四个便宜的草稿显示模型首先在哪里拉取您的请求,然后您可以从那里故意编辑提示。价格按每张图片计算,因此在跑步前即可查看总价 - 余额不会出现意外。
您最多可以附加 16 张图像,每张图像最多 50 MB。一张照片加上一条指令正在编辑:替换背景,删除妨碍的东西,重新着色对象。有几个镜头正在根据您自己的来源组装一个新场景。没有单独的“编辑模式”开关:附加参考后,模型会自行移入其中。
默认文件格式是JPEG——它更轻,每个平台都毫无疑问地接受它。当图片仍需要在编辑器中处理时,请选择 PNG;当页面重量很重要时,请选择 WebP。对于 JPEG 和 WebP,格式旁边会出现一个压缩滑块:滑块越低,文件越小,平滑渐变上的伪影越明显。
是同型号的高级模式。在常规模式中,您可以选择宽高比和分辨率;在 Pro 中,您可以设置精确的画布大小(以像素为单位)、渲染级别、每次运行的变体数量、文件格式和压缩。对于快速拍照,常规模式更方便;对于布局和打印,Pro。
不 - 该模型不支持透明度。如果您需要一个没有背景的对象,请在平面单色背景上生成它并在任何编辑器中将其剪切,或者选择一个在其功能中列出透明度的模型。
价格取决于渲染级别、画布大小和变体数量:低级别的价格几美分,高级别的价格明显更高,四张图片的价格是一张的四倍。确切的金额会在运行前显示在页面上,根据生成情况收取费用,如果失败则自动退款。