城市观察 · 深度阅读

微软发布 MAI-Image-2.6,提升文生图模型性能并位列榜单第二

微软于当地时间 8 月 10 日宣布推出新一代自研文生图模型 MAI-Image-2.6。该版本相较于前代产品在整体 Elo 评分和文本渲染能力上均有显著提升,使其模型排名从之前的第十位跃升至第二位,领先 Meta、谷歌和 xAI 等竞品。新模型增强了多参考图像融合和对输出格式的控制。

微软于当地时间 8 月 10 日宣布推出其新一代自研文生图模型 MAI-Image-2.6。此次发布标志着微软在生成式AI视觉领域持续推进,旨在提升模型的综合能力和市场竞争力。

根据公开资料显示,MAI-Image-2.6 相较于 2.5 版本,整体 Elo 评分提升了 79 分,其中文本渲染能力单项的提升更是达到了 91 分。这一显著的性能飞跃直接体现在模型排名上,使 MAI-Image-2.6 的模型排名从 MAI-Image-2.5 时期的第十位一举跃升至第二位,目前领先 Meta、谷歌和 xAI 等竞品。

在产品能力细节方面,微软官方介绍指出,MAI-Image-2.6 在多个维度实现了能力的增强。这些提升包括更强的文本渲染能力、对人像与 3D 图像生成更精细的控制,以及输出风格上更加成熟的商业和写实风格支持。此外,新模型还具备多参考图像融合的能力,并增强了语义理解能力,同时为用户提供了对推理逻辑、输出格式及分辨率更强的可控性。

回顾微软文生图模型的迭代历程可以构建一个时间线。此前,IT之家曾报道过微软于 2025 年 10 月推出了首款自研文生图模型 MAI-Image-1。随后,在 2026 年 3 月发布的 MAI-Image-2 模型跃升至第三位。紧接着,6 月推出的 MAI-Image-2.5 在文生图类别中获得了第三名的排名。而本次发布的是 MAI-Image-2.6,代表了模型迭代的最新成果。

从背景角度看,AI文生图模型的竞争已进入白热化阶段,各大科技公司都在不断追赶性能前沿。微软通过持续升级其自研模型,展现了其在底层技术积累和快速响应市场需求方面的决心。每一次版本的提升,都旨在解决用户在使用过程中遇到的具体痛点。

对于实际应用场景的考量,MAI-Image-2.6 的能力增强意味着它能更好地服务于需要高精度视觉内容的专业领域。例如,在广告设计、产品概念图生成或需要精确文字展示的界面原型制作中,模型提升的文本渲染和写实风格输出将是关键优势。

从影响分析来看,MAI-Image-2.6 跻身榜单前列,不仅巩固了微软在文生图领域的领先地位,也对行业其他参与者构成了直接的技术压力。这促使整个行业的模型开发节奏和技术标准持续提高。

观察点方面,值得注意的是,本次提升的重点似乎从单纯的“生成数量”转向了“可控性和专业性”。用户不仅关注图片是否能生成,更关注能否精确控制图像中的特定元素、风格和逻辑结构。这反映出市场对AI工具从创意辅助向生产力工具转化的需求。

对于关注前沿AI技术的读者而言,可以留意微软后续是否会公布更多关于模型底层架构的细节,以及 MAI-Image-2.6 在实际商业化产品中的集成时间表。持续关注这些信息,有助于更全面地了解生成式AI技术的发展脉络。

信息来源

本文基于上述公开资料整理,未使用来源页面的图片、视频或嵌入媒体。