微软正式发布了其最新一代自研文生图模型 MAI-Image-2.6。该模型目前在 Arena 排行榜的 text-to-image 类别中位列第二,仅次于 OpenAI 的 GPT-Image-2,Elo 评分较 MAI-Image-2.5 提升 79 分。

性能排名与代际演进
微软于 2025 年 10 月推出首款自研文生图模型 MAI-Image-1,首次亮相即进入 Arena 排行榜前十。2026 年 3 月发布的 MAI-Image-2 跃升至第三位,紧随谷歌 Gemini 和 OpenAI 的同类产品。此后微软陆续推出 MAI-Image-2.5 和面向高精度场景的 MAI-Image-2.5-Pro。此次 MAI-Image-2.6 的发布标志着微软在该领域的技术迭代进入新阶段,成功超越 Nano Banana、Meta 及 Grok 等竞争对手的对应模型。
核心能力改进
据微软官方介绍,MAI-Image-2.6 在以下方面实现显著突破:
- 文本渲染:图像内文字生成准确性提升
- 人像生成:人物肖像细节表现更为精细
- 3D 图像:立体场景构建能力增强
- 商业与写实风格:产品展示、品牌视觉及电影级画面输出更加精致
此外,新模型在多参考图像融合、语义 grounding 方面表现更优,并提供对推理逻辑、输出格式及分辨率更强的控制能力。
产品落地计划
目前用户已可在 Arena 平台直接体验 MAI-Image-2.6 的图像生成能力。微软计划本周内将该模型部署至 MAI Playground、Microsoft Foundry 及其他微软服务。更多技术细节将在未来数周内公布。
via Neowin