xAI发布Imagine Image2.0图像模型
「xAI正式上线Imagine Image2.0,作为Grok旗下Web端及移动应用的全新质量模式,支持多参考图融合、智能扩图、精准编辑等功能,在Arena评测中文本生成图像和图像编辑能力均位列全球第二。」
xAI近日正式推出Imagine Image2.0图像生成模型,该模型已作为Grok旗下Web端Imagine服务以及iOS、Android应用中的全新质量模式上线。此次发布重点面向需要可控布局、清晰字体和视觉元素一致性的创意场景,为用户提供更专业的图像生成与编辑能力。目前,该模型的API访问计划正在推进中,但尚未正式向开发者开放。
据xAI介绍,Imagine Image2.0在图像生成方面具备显著提升。它能够理解复杂指令,在密集构图中完成字体与布局规划,同时保持小尺寸文字的清晰度。这一特性对于需要大量文字信息的海报、广告和社交媒体图片尤为重要,突破了以往AI图像生成模型在文字渲染方面的局限。此外,该模型支持多轮生成和编辑,在反复调整过程中能够保留用户指定的视觉元素,确保创作的一致性和连贯性。
在图像编辑功能上,Imagine Image2.0提供了魔棒和分割工具,用户可以精准选择图像中的特定区域进行局部修改,而不影响其他部分。同时,模型支持背景移除和透明图像导出,极大方便了素材处理和二次创作。更值得关注的是,它支持一次生成融合最多5张参考图像,能够将不同图片的元素进行有机整合,显著降低复杂视觉创作中的手动合成成本。
除了生成与编辑,Imagine Image2.0还新增了智能调整大小功能,可将图像扩展至指定画幅,支持从1:2到9:16的比例,以及正方形、横向和2:1等多种格式。这一功能解决了在不同平台发布时图像尺寸适配的问题,提升了工作流效率。xAI还针对重复创作任务推出了模板工作流,覆盖照片编辑、产品颜色调整、电商图片、专业头像、图标、角色精灵、表情符号和商品设计等常见场景。在视频策划场景中,相关模板能够帮助用户分别生成角色、场景和道具,并保持统一的视觉风格,从而构建连续一致的内容世界。
在性能表现上,xAI称Imagine Image2.0在文本生成图像和图像编辑能力评测中均位列全球第二。在Arena测试中,grok-imagine-image-2(low)的文生图得分为1320分,低于gpt-image-2的1380分;图像编辑得分为1439分,低于gpt-image-2的1463分。单独测试的grok-imagine-image-quality两项得分分别为1228分和1390分。xAI表示,其模型在Arena平台上以SpaceXAI名义参与测试。
来源:Heooo AI工具导航