微软把生图速度拉到2.8倍:MAI-Image-2.6-Flash上线,价格直接砍掉一半
AI 生图现在已经不只是卷:
谁画得更好看。
真正进入商业生产以后,还有两个特别现实的问题:

快不快?
以及:
贵不贵?
微软最新推出的 MAI-Image-2.6-Flash,明显就是冲着这两个问题来的。
相比 GPT-Image-2-Medium,微软给出的测试数据显示:
生成速度达到2.8倍。
同时:
效率提升72%。
更关键的是,Flash 并没有因为追求速度把主要能力砍掉。
多图参考、图片编辑、Web信息补充、动态宽高比和高分辨率输出基本都保留了下来。
这意味着微软现在开始把 AI 生图从:
创意工具
继续往:
工业级视觉生产能力
推进。
一、Flash不是缩水版,而是生产力版本
MAI-Image-2.6 系列目前主要分成两个方向。
MAI-Image-2.6
更强调:
最高图像质量;
精确编辑;
文字渲染;
商业设计;
最终成片质量。
MAI-Image-2.6-Flash
则更强调:
低延迟 + 高吞吐 + 低成本。
比较适合:
批量生图;
实时交互;
个性化内容;
自动化工作流;
大规模商业素材生产。
简单理解:
2.6负责最终稿。
2.6-Flash负责疯狂出版本。
对于真正做设计的人来说,这种组合其实很合理。
先用 Flash 快速探索几十种方案。
确定方向以后,再使用旗舰版完成最终输出。
二、速度直接做到GPT-Image-2-Medium的2.8倍
这次最直观的数据就是:
2.8×。
对于普通用户来说,快几秒可能感觉区别不大。
但是到了企业级使用场景就完全不一样。
例如一个跨境电商平台每天需要生成:
10万张商品场景图。
广告平台需要根据不同用户实时生成:
个性化视觉素材。
设计工具需要用户修改 Prompt 后:
立即看到新的结果。
这时候生成延迟从:
几十秒
压缩到:
几秒甚至更短,
直接影响整个产品体验。
所以 MAI-Image-2.6-Flash 真正瞄准的是:
高频、大规模、低延迟生成。
三、价格也直接砍了下来
MAI-Image-2.6-Flash 在 Microsoft Foundry 的价格同样明显更低。
目前公开价格为:
文本输入:1.75美元 / 百万Token
图片输入:2.5美元 / 百万Token
图片输出:19美元 / 百万Token
旗舰 MAI-Image-2.6 则分别为:
5美元
8美元
38美元。
也就是说,Flash 的图片输出成本直接降低:
50%。
文本和图片输入成本下降幅度甚至超过:
60%。
对于每天大量调用 API 的应用来说,这种成本差距会很明显。
四、最多支持5张参考图
Flash 版本并没有只保留最基础的文生图。
它同样支持:
Multi-reference Editing。
一次最多可以输入:
5张参考图片。
比如你可以同时提供:
人物;
产品;
服装;
背景;
视觉风格。
然后让模型把这些信息重新组织到同一张图片中。
这对于:
电商;
品牌广告;
角色设计;
商品营销;
社交媒体素材
特别实用。
真正商业生图很少只靠一句 Prompt。
更多时候都需要:
参考已有品牌资产继续创作。
五、动态宽高比,最高支持1.5K输出
MAI-Image-2.6 系列还加强了输出格式控制。
支持根据不同设计需求使用:
动态宽高比。
例如:
1:1 商品图;
3:4 社交媒体封面;
9:16 竖屏广告;
16:9 Banner。
最高支持:
1.5K 分辨率输出。
这对于真实内容生产非常重要。
因为同一个 Campaign 往往需要同时生成:
Instagram;
小红书;
电商详情页;
网页 Banner;
移动端广告
多个尺寸。
以前可能需要重新裁图。
现在可以直接围绕同一个创意生成不同版式。
六、还能从Web获取最新信息辅助生成
这次还有一个比较特别的能力:
Web Grounding。
普通图片模型主要依赖训练时期学到的知识。
如果你要求生成:
最新产品;
真实地点;
近期事件;
特定现实对象。
模型知道的信息可能已经过时。
MAI-Image-2.6 系列可以进一步结合:
当前Web信息
辅助理解真实世界内容。
这对于:
新闻视觉;
旅游内容;
真实产品;
营销设计
会更加实用。
它的方向其实和现在的大模型搜索很像:
不只是靠模型记忆,而是生成以前先补充最新上下文。
七、真正适合的是“批量生产”
我觉得 MAI-Image-2.6-Flash 最有价值的场景,并不是:
普通用户每天生成三五张图片。
而是:
规模化视觉生产。
比如电商:
1000个商品
×
10种背景
×
5种尺寸
↓
50000张素材或者广告:
同一个产品根据:
地区;
人群;
语言;
平台
自动生成不同视觉版本。
再或者一个 AI 设计平台:
用户修改一句 Prompt,立即生成多个候选方案。
这种时候:
速度;
价格;
稳定性
往往比单张图片再提升一点美学分数更加重要。
八、微软的路线越来越清楚:一个模型负责质量,一个负责规模
现在 MAI-Image 系列的分工已经非常明显。
MAI-Image-2.6
适合:
最终商业稿;
复杂编辑;
品牌视觉;
高质量文字;
精细摄影。
MAI-Image-2.6-Flash
适合:
快速迭代;
实时应用;
批量生成;
自动化工作流;
个性化内容。
这和现在大语言模型:
旗舰 + Flash
的路线其实越来越像。
最强模型负责:
能力上限。
Flash 模型负责:
真正大规模跑起来。
结语
MAI-Image-2.6-Flash 这次可以记住几个数字:
2.8倍生成速度。
72%效率提升。
图片输出成本降低50%。
最多5张参考图。
最高1.5K分辨率。
再加上:
动态宽高比;
Web Grounding;
多图编辑。
微软显然已经不满足于:
“做一个画质很强的AI图片模型。”
而是在继续解决企业真正使用 AI 生图以后碰到的问题:
一次生成十张很容易。
真正困难的是:
一天稳定生成十万张,而且还得够快、够便宜、质量可控。
这可能才是 Flash 版本真正存在的意义。
AI 图片竞争接下来除了:
谁画得最好。
还会越来越看:
谁真正能跑进生产线。
相关链接
Microsoft AI:MAI-Image-2.6 / Flash 官方发布
https://microsoft.ai/news/pushing-the-quality-cost-frontier-with-mai-image-2-6/
MAI-Image-2.6 官方模型页面
https://microsoft.ai/models/mai-image-2-6/
Microsoft Foundry:MAI-Image模型使用文档
https://learn.microsoft.com/en-us/azure/foundry/foundry-models/how-to/use-foundry-models-mai-image
Microsoft Foundry:MAI-Image-2.6与Flash发布介绍
Microsoft AI
标签






评论 0
最新评论登录后发布评论并参与互动。
暂无评论,欢迎抢沙发。