
微软于9月正式推出自主研发图像生成模型的轻量化变体MAI-Image-2.6-Flash,并已通过Microsoft Foundry开启公开预览。作为上月登顶技术榜单的MAI-Image-2.6的高效率版本,该模型标志着微软在AI图像生成领域全面布局高并发、低延迟及成本敏感型工业级应用场景。测试数据显示,其图像生成速度达到GPT-Image-2-Medium的2.8倍,综合效率提升72%,在大幅削减推理延迟与计算开销的同时,完整继承了主模型的核心生成与编辑能力,支持高精度文本到图像生成及局部对象级编辑。
在架构升级方面,MAI-Image-2.6系列支持最多5张参考图以保障多图角色与产品一致性,集成Bing搜索的网络定位功能补充现实世界图像信息,并新增对动态宽高比和更高分辨率输出的原生支持。这些改进使得模型在处理复杂创意任务时更加灵活可靠,尤其适用于需要保持视觉连贯性的设计场景。
商业化定价上,Flash版本将文本输入、图像输入和图像输出的每百万Token价格分别下探至1.75美元、2.50美元和19美元,较主模型实现超过50%的显著降本。微软建议将主模型用于对画质和文本渲染要求苛刻的商业设计及最终生产资产,而将Flash版本精确定位于交互式应用、快速创意迭代以及大规模自动化流程。这一兼顾极致性能与高性价比的多模态模型矩阵,折射出生成式AI从单一技术突破向高吞吐量、低成本工程化落地演进的行业趋势,也为开发者提供了更加灵活的选择空间。
原创文章,作者:Microsoft,如若转载,请注明出处:https://www.kejixun.co/article/761337.html