微软在图像生成赛道上亮出了一张新牌。9月4日,微软发布自研图像生成模型MAI-Image-2.6-Flash,并通过Microsoft Foundry平台开放公开预览。这款模型的核心卖点很直接:更快、更便宜。
微软AI负责人穆斯塔法·苏莱曼在推文中给出了具体对比:相比目前世界上最好的GPT Image 2(微软官方博文显示为GPT-Image-2-Medium),MAI-Image-2.6-Flash的生图速度是其2倍,GPU效率提升了72%。这个数字意味着同样的硬件投入,能跑出接近两倍的产出。
![]()
速度与成本,二选一还是全都要?
Flash版与旗舰版MAI-Image-2.6共享核心能力,包括文生图、图生图/图像编辑,覆盖对象移除/替换、局部重绘、属性修改、文字更新等常见操作。区别在于,Flash版把优化重心放在了生成速度和成本上,但微软强调其仍保留了MAI-Image-2.6的核心生成与编辑能力。
换句话说,这不是一个"阉割版",而是针对特定场景做了取舍的版本。微软给出的使用建议也印证了这一点:
- 追求质量:最终生产素材、复杂编辑、商业设计、高图像质量和文字渲染要求的任务,用MAI-Image-2.6
- 追求效率:对延迟、吞吐量和成本更敏感的任务,用MAI-Image-2.6-Flash
API定价已公布,按Token计费
价格方面,MAI-Image-2.6-Flash的API按每100万Token计费。虽然具体价格表未在博文中完整列出,但"Flash"后缀已经暗示了它的定位——用更低的单位成本换取更高的吞吐量,适合批量生成、实时交互这类对响应速度有硬性要求的场景。
这次发布透露出的信号很明确:图像生成模型的竞争,正在从"谁画得更好"转向"谁跑得更快、更省"。当基础质量拉不开绝对差距时,速度和成本就成了决定落地能力的关键变量。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.