ChatGPT Images 2.5登场 生成延迟大幅降低
「OpenAI正式发布ChatGPT Images 2.5图像生成模型,在保持细节锐度、自然光照和纹理丰富度提升的同时,将生成延迟最高降低五成,并引入Sketch草图参考、模板库、图片内位置标注等新功能,同时推出两款面向不同场景的API模型并公布定价。」
OpenAI近日正式发布其最新的图像生成模型ChatGPT Images 2.5,官方称其为当前最先进的图像生成模型。与上一代Images 2模型相比,新模型在细节锐度、自然光照和纹理丰富度方面均有所提升,同时大幅优化了生成速度,延迟最多可降低百分之五十。这一升级意味着用户在使用对话式图像生成时,能够获得更快速、更高质量的结果。
在功能层面,ChatGPT Images 2.5引入了Sketch草图功能。用户输入“@Sketch”即可调用该能力,在对话中直接绘制草图,再补充风格与细节描述,模型会将草图转化为完整的图像作品。这一功能降低了“从零开始”的创作门槛,使不具备专业绘画技能的用户也能通过简单勾画配合文字描述,得到接近预期的画面。产品同时新增了海报、商品等常见创作格式的模板,进一步方便普通用户快速生成符合使用场景的图像。
针对用户关心的精细修改需求,ChatGPT Images 2.5加入了图片内评论标注功能。用户可以直接在图像上标记具体位置,并发出“删除此区域”或“将此改为蓝色”等指令,模型会只对标注区域进行修改,而不会破坏图像的其他部分。这一设计显著提升了局部编辑的可用性与准确性。此外,在多轮编辑过程中,模型能够更好地保持整体图像的一致性和视觉效果,有效避免反复修改后出现的细节退化问题,让长链路创作过程更加稳定可靠。
在开发者生态层面,OpenAI同步推出了两款API图像生成模型。GPT-Image-2.5 Flare面向大多数API图像生成应用,适合创作者内容、社交平台配图、产品体验设计、视觉搜索、快速原型构建以及高批量生成等任务;GPT-Image-2.5 Sunburst则面向对编辑控制精度要求更高的工作流,更适合成品级营销素材与精修产品图场景,但其生成时间也相对更长。两款模型均支持多种输出分辨率,包括1024×1024、2048×2048以及3840×2160的4K横向规格,单边最长不可超过3840像素,总像素数介于655360至8294400之间,为不同画幅需求提供充足选择。
价格方面,OpenAI公布了GPT-Image-2.5 Flare与GPT-Image-2.5 Sunburst两款模型的定价。不同规格与用途的API调用费用有所区别,开发者和企业可根据自身场景选择合适的模型组合,以平衡成本与生成效果。
安全与合规机制同样得到延续。Images 2.5对提示词和生成图像均实施检查,以防止有害输出。所有由OpenAI工具生成的图像都会嵌入C2PA元数据和隐形水印,便于识别来源,帮助打击未授权复用或深度伪造行为。这些配套措施在提升创意生产力的同时,也为图像内容的透明追溯提供了技术支撑。
来源:Heooo AI工具导航