0

微软 MAI-Image-2.5 图像模型跻身 Arena 排行榜前三

微软 AI 团队正式发布 MAI-Image-2.5 文本到图像生成模型,该模型在 Arena 最新文本到图像排行榜中位列第三。相比前代版本,新模型在提示词遵循度、文本渲染准确性及图像细节表现方面均有显著提升。

技术性能与排名表现

MAI-Image-2.5 在 Arena 文本到图像排行榜中获得第三名,仅次于 OpenAI 的 gpt-image-2(当前以 1388 分领先)。这是微软自 MAI-Image-1(首次发布时排名第 9)和 MAI-Image-2(排名第 3)以来在图像生成领域的又一重要进展。

核心能力改进

据微软官方介绍,MAI-Image-2.5 在以下方面实现重点突破:

  • 提示词遵循度:更精准理解并执行用户指令
  • 文本渲染能力:生成图像中的文字更清晰锐利
  • 视觉推理能力:更好地理解物体、光照、比例、场景结构及空间关系
  • 风格多样性:覆盖更广泛的图像风格类型

商业应用场景优化

微软强调,该模型在文本渲染风格化插图商业图像三个领域的提升最为显著。用户可利用其生成更高质量的海报、包装样机、品牌概念图及产品摄影图,布局稳定性与品牌视觉表现力均有改善。

获取渠道与上线计划

MAI-Image-2.5 目前已上线 Arena 供公众体验。按照微软此前模型的发布惯例,该模型将在未来两周内登陆 MAI Playground 和 Microsoft Foundry 平台。微软 AI 部门 CEO Mustafa Suleyman 在社交媒体上表示,Build 大会即将到来,AI 团队还将带来更多新进展。

via Neowin

0 评论
最旧
最新 最多投票
0
希望看到您的想法,请您发表评论x