技术进展

OpenAI新图像模型现身Arena,真实感大幅提升

Heooo 08月11日15时33分 35 阅读

「OpenAI一款代号mona-lisa-1的未发布图像模型悄然出现在Arena竞技场,经网友验证带有SynthID水印,确认为OpenAI出品。实测显示其出图真实感显著增强,“塑料感”明显减弱,细节更丰富,在艺术画作和复杂信息图生成上表现优异。开发者线索显示其训练可能已于去年完成,知识库截止时间与GPT Image 2一致,外界猜测它或是GPT Image 2.5的“中杯”版本。」

近日,一款代号为mona-lisa-1的全新图像模型悄然出现在Arena竞技场上,引发开发者社区广泛关注。经网友验证,该模型生成的作品带有SynthID水印,基本可以确认出自OpenAI之手。由于该模型并未以官方渠道正式发布,其突然现身被视作OpenAI在图像生成领域的一次秘密测试。

从实测反馈来看,新模型的出图真实感相较此前版本有了肉眼可见的提升。过去GPT Image系列生成图像时偶尔出现的“塑料感”——即表面过度光滑、光影失真、材质质感欠佳等问题——在新模型中大幅减弱。画面细节更加丰富,无论是人物的皮肤纹理、衣物质地,还是自然环境中的光影层次,都更接近真实摄影或高质量插画的效果。尤其在艺术画作复刻、复杂信息图生成等对结构与语义理解要求较高的任务上,新模型的表现相当出色,能够更准确地排布文字、图标与数据模块,减少此前常见的元素错乱与排版拥挤现象。

与此同时,开发者社区也翻出了不少值得玩味的线索。有分析指出,该模型的训练可能早在去年就已经完成,其知识库截止时间与现有GPT Image 2完全一致,同为2025年12月。这意味着mona-lisa-1大概率不是从零训练的全新架构,而是在GPT Image 2的地基上生长出的一个新检查点(checkpoint)。这种“同基迭代”的模式在业界并不罕见,通常用于在保持兼容性的前提下快速验证新的训练策略或数据配比。

种种迹象表明,mona-lisa-1很可能就是GPT Image 2.5的“中杯”版本。所谓“中杯”,往往意味着性能介于基础版与完全体之间,模型规模和输出能力可能有所保留,但核心能力的提升已经足以让用户体验到代际差异。如果这一猜测属实,后续OpenAI可能还会推出更多检查点,对应不同尺寸或不同侧重点的版本,最终集成为完整版GPT Image 2.5。

对于AI绘画工具的使用者与开发者而言,这无疑是个积极信号。当前开源图像生成模型与商业闭源模型之间的差距正在逐步缩小,而OpenAI选择以“突袭”方式测试新模型,也反映出其在产品打磨上的谨慎姿态。正式版若能保持并放大mona-lisa-1所展现的真实感优势,同时进一步解决复杂场景下的语义一致性问题,有望再次抬高AI生图的技术天花板,为创意设计、广告营销、内容生产等领域带来更高质量的生成工具。值得注意的是,此次曝光的模型并未通过OpenAI官方渠道发布,因此其最终命名、功能范围以及面向用户的开放形式仍是未知数,市场也在等待官方后续的正式公告。

# OpenAI # 图像生成 # GPT Image # Arena # 模型迭代

来源:Heooo AI工具导航