推荐Lovart 中文版 - 一站式 AI 设计平台推荐一人企业Vibe Coding社区!热门AI设计工具新品免费AI编程工具 Trae - 智能编码助手Seedance2.5已上线新用户注册即领免费算力
UIED.CN今天偷学哪一招,朋友

微软把生图速度拉到2.8倍:MAI-Image-2.6-Flash上线,价格直接砍掉一半

AI 生图现在已经不只是卷:

谁画得更好看。

真正进入商业生产以后,还有两个特别现实的问题:

image.png

快不快?

以及:

贵不贵?

微软最新推出的 MAI-Image-2.6-Flash,明显就是冲着这两个问题来的。

相比 GPT-Image-2-Medium,微软给出的测试数据显示:

生成速度达到2.8倍。

同时:

效率提升72%。

更关键的是,Flash 并没有因为追求速度把主要能力砍掉。

多图参考、图片编辑、Web信息补充、动态宽高比和高分辨率输出基本都保留了下来。

这意味着微软现在开始把 AI 生图从:

创意工具

继续往:

工业级视觉生产能力

推进。




一、Flash不是缩水版,而是生产力版本

MAI-Image-2.6 系列目前主要分成两个方向。

MAI-Image-2.6

更强调:

最高图像质量;

精确编辑;

文字渲染;

商业设计;

最终成片质量。

MAI-Image-2.6-Flash

则更强调:

低延迟 + 高吞吐 + 低成本。

比较适合:

批量生图;

实时交互;

个性化内容;

自动化工作流;

大规模商业素材生产。

简单理解:

2.6负责最终稿。

2.6-Flash负责疯狂出版本。

对于真正做设计的人来说,这种组合其实很合理。

先用 Flash 快速探索几十种方案。

确定方向以后,再使用旗舰版完成最终输出。




二、速度直接做到GPT-Image-2-Medium的2.8倍

这次最直观的数据就是:

2.8×。

对于普通用户来说,快几秒可能感觉区别不大。

但是到了企业级使用场景就完全不一样。

例如一个跨境电商平台每天需要生成:

10万张商品场景图。

广告平台需要根据不同用户实时生成:

个性化视觉素材。

设计工具需要用户修改 Prompt 后:

立即看到新的结果。

这时候生成延迟从:

几十秒

压缩到:

几秒甚至更短,

直接影响整个产品体验。

所以 MAI-Image-2.6-Flash 真正瞄准的是:

高频、大规模、低延迟生成。




三、价格也直接砍了下来

MAI-Image-2.6-Flash 在 Microsoft Foundry 的价格同样明显更低。

目前公开价格为:

文本输入:1.75美元 / 百万Token

图片输入:2.5美元 / 百万Token

图片输出:19美元 / 百万Token

旗舰 MAI-Image-2.6 则分别为:

5美元

8美元

38美元。

也就是说,Flash 的图片输出成本直接降低:

50%。

文本和图片输入成本下降幅度甚至超过:

60%。

对于每天大量调用 API 的应用来说,这种成本差距会很明显。




四、最多支持5张参考图

Flash 版本并没有只保留最基础的文生图。

它同样支持:

Multi-reference Editing。

一次最多可以输入:

5张参考图片。

比如你可以同时提供:

人物;

产品;

服装;

背景;

视觉风格。

然后让模型把这些信息重新组织到同一张图片中。

这对于:

电商;

品牌广告;

角色设计;

商品营销;

社交媒体素材

特别实用。

真正商业生图很少只靠一句 Prompt。

更多时候都需要:

参考已有品牌资产继续创作。




五、动态宽高比,最高支持1.5K输出

MAI-Image-2.6 系列还加强了输出格式控制。

支持根据不同设计需求使用:

动态宽高比。

例如:

1:1 商品图;

3:4 社交媒体封面;

9:16 竖屏广告;

16:9 Banner。

最高支持:

1.5K 分辨率输出。

这对于真实内容生产非常重要。

因为同一个 Campaign 往往需要同时生成:

Instagram;

小红书;

电商详情页;

网页 Banner;

移动端广告

多个尺寸。

以前可能需要重新裁图。

现在可以直接围绕同一个创意生成不同版式。




六、还能从Web获取最新信息辅助生成

这次还有一个比较特别的能力:

Web Grounding。

普通图片模型主要依赖训练时期学到的知识。

如果你要求生成:

最新产品;

真实地点;

近期事件;

特定现实对象。

模型知道的信息可能已经过时。

MAI-Image-2.6 系列可以进一步结合:

当前Web信息

辅助理解真实世界内容。

这对于:

新闻视觉;

旅游内容;

真实产品;

营销设计

会更加实用。

它的方向其实和现在的大模型搜索很像:

不只是靠模型记忆,而是生成以前先补充最新上下文。




七、真正适合的是“批量生产”

我觉得 MAI-Image-2.6-Flash 最有价值的场景,并不是:

普通用户每天生成三五张图片。

而是:

规模化视觉生产。

比如电商:

1000个商品
×
10种背景
×
5种尺寸
↓
50000张素材

或者广告:

同一个产品根据:

地区;

人群;

语言;

平台

自动生成不同视觉版本。

再或者一个 AI 设计平台:

用户修改一句 Prompt,立即生成多个候选方案。

这种时候:

速度;

价格;

稳定性

往往比单张图片再提升一点美学分数更加重要。




八、微软的路线越来越清楚:一个模型负责质量,一个负责规模

现在 MAI-Image 系列的分工已经非常明显。

MAI-Image-2.6

适合:

最终商业稿;

复杂编辑;

品牌视觉;

高质量文字;

精细摄影。

MAI-Image-2.6-Flash

适合:

快速迭代;

实时应用;

批量生成;

自动化工作流;

个性化内容。

这和现在大语言模型:

旗舰 + Flash

的路线其实越来越像。

最强模型负责:

能力上限。

Flash 模型负责:

真正大规模跑起来。




结语

MAI-Image-2.6-Flash 这次可以记住几个数字:

2.8倍生成速度。

72%效率提升。

图片输出成本降低50%。

最多5张参考图。

最高1.5K分辨率。

再加上:

动态宽高比;

Web Grounding;

多图编辑。

微软显然已经不满足于:

“做一个画质很强的AI图片模型。”

而是在继续解决企业真正使用 AI 生图以后碰到的问题:

一次生成十张很容易。

真正困难的是:

一天稳定生成十万张,而且还得够快、够便宜、质量可控。

这可能才是 Flash 版本真正存在的意义。

AI 图片竞争接下来除了:

谁画得最好。

还会越来越看:

谁真正能跑进生产线。




相关链接

Microsoft AI:MAI-Image-2.6 / Flash 官方发布

https://microsoft.ai/news/pushing-the-quality-cost-frontier-with-mai-image-2-6/

MAI-Image-2.6 官方模型页面

https://microsoft.ai/models/mai-image-2-6/

Microsoft Foundry:MAI-Image模型使用文档

https://learn.microsoft.com/en-us/azure/foundry/foundry-models/how-to/use-foundry-models-mai-image

Microsoft Foundry:MAI-Image-2.6与Flash发布介绍

https://techcommunity.microsoft.com/blog/azure-ai-foundry-blog/mai-image-2-6-and-mai-image-2-6-flash-quality-and-speed-at-production-scale/4550970

Microsoft AI

https://microsoft.ai/





标签

评论 0

最新评论

登录后发布评论并参与互动。

暂无评论,欢迎抢沙发。

推荐阅读

查看更多