微软发布轻量化图像模型Flash版本
「微软推出MAI-Image-2.6-Flash轻量化图像生成模型,速度达GPT-Image-2-Medium的2.8倍,推理成本降低逾50%。该模型通过Microsoft Foundry公开预览,面向高并发、低延迟应用场景,完整保留主模型核心编辑能力,兼顾性能与性价比。」
微软近日正式推出自主研发图像生成模型的轻量化变体MAI-Image-2.6-Flash,并已通过Microsoft Foundry开启公开预览。该模型是上月登顶技术榜单的MAI-Image-2.6的高效率版本,标志着微软在AI图像生成领域全面展开对高并发、低延迟及成本敏感型工业级应用场景的布局。
测试数据显示,MAI-Image-2.6-Flash的图像生成速度达到GPT-Image-2-Medium的2.8倍,整体综合效率提升达72%。在大幅削减推理延迟与计算开销的同时,该变体完整继承了主模型的核心生成与编辑能力,支持高精度的文本到图像生成以及局部对象级图像编辑,为开发者提供了兼具速度与质量的可靠选择。
此外,MAI-Image-2.6系列整体还带来了多项架构级升级。该系列支持最多5张参考图,以保障多图角色与产品的外观一致性;集成Bing搜索的网络定位功能,可补充现实世界图像信息,增强生成内容的真实性与语境相关性;同时新增对动态宽高比和更高分辨率输出的原生支持,更好地满足多样化的创作需求。
在商业化定价策略上,Flash版本将文本输入、图像输入和图像输出的每百万Token价格分别下探至1.75美元、2.50美元和19美元,较主模型实现了超过50%的显著降本。此举大幅降低了大规模调用的经济门槛,使企业能够以更低的成本将高质量图像生成能力嵌入业务流程。
微软官方建议将主模型应用于对画质和文本渲染要求苛刻的商业设计与最终生产资产,而将Flash版本精确定位于交互式应用、快速创意迭代以及大规模自动化流程。这一兼顾极端性能与极致性价比的多模态模型矩阵,反映出当前生成式AI从单一技术突破向高吞吐量、低成本工程化落地演进的行业趋势。
来源:Heooo AI工具导航