微软推出新一代 MAI-Image-2.6 图像生成模型 跃居Arena榜单第二
微软于近日正式发布了其最新一代文本生成图像模型 MAI-Image-2.6。根据 Arena 排行榜的最新数据,该模型推出后迅速登上了文本生成图像榜单的第二名,超越了来自 Meta、Google、字节跳动以及 xAI 等竞争对手的多款主流模型,目前仅次于 OpenAI 的 GPT-Image-2。

回顾微软在自主图像生成领域的发展历程,其于 2025 年 10 月推出了首款自研文本生成图像模型 MAI-Image-1,首发登榜排名第 9 名;2026 年 3 月,微软人工智能部门推出了第二代升级版本 MAI-Image-2,凭借显著提升的画质与性能跻身榜单第 3 名;随后在同年 5 月发布的 MAI-Image-2.5 继续稳固了前三的位置;而在上个月,微软还推出了面向高精度图像生成、图像编辑以及复杂文字渲染需求的 MAI-Image-2.5-Pro 模型。
最新发布的 MAI-Image-2.6 在 Arena 文本生成图像分类中获得了 1336 分,相较于前代 MAI-Image-2.5 实现约 79 Elo 分数的提升。微软人工智能负责人穆斯塔法·苏莱曼(Mustafa Suleyman)在社交平台上表示,团队通过持续的技术攻坚,使该模型超越了 Nano Banana、Meta 以及 Grok 等同类竞争产品。在榜单表现上,MAI-Image-2.6 目前距离榜首 OpenAI 的 GPT-Image-2(中等版本)仅相差 45 分,同时领先第三名 Grok Imagine Image 2.0(低版本)20 分。

在技术能力方面,微软表示 MAI-Image-2.6 在文本渲染、人像绘制以及 3D 图像生成上做出了重大突破,能够输出更具商业质感与逼真度的画面,在产品展示、品牌推广和电影级画风创作等应用场景中表现尤为突出。此外,新模型极大方便了用户基于多张参考图进行协同创作,具备更强的画面依据性(grounding),并使用户在推理控制、输出格式以及分辨率调节上拥有更高的自主度。
目前,兴趣用户已可在 Arena 平台体验 MAI-Image-2.6 模型。微软计划在未来几周内公布关于该模型的更多技术细节,并于本周内陆续将该模型整合至 MAI Playground、Microsoft Foundry 以及旗下其他产品与服务中。


