7月24日,微软宣布推出两款新的自研AI模型MAI-Image-2.5-Pro和MAI-Voice-2-Flash,均已进入公开预览阶段。MAI-Image-2.5-Pro专注于高质量图像生成,适用于主视觉图片生成、细节编辑和图像内文字渲染等场景,优化了图像中文字生成准确性,并支持自然语言编辑指令。MAI-Voice-2-Flash针对高频语音应用优化,速度提升约2倍,成本降低32%,适用于客服中心、语音助手等需要快速响应的场景。
微软表示,MAI-Image-2.5-Pro已全面应用于BingImageCreator,成为默认图像生成模型,同时在PowerPoint中用于图像到图像编辑功能,与GPT-Image-2相比,可降低最高84%的GPU成本。MAI-Voice-2-Flash已接入Dynamics365ContactCenter,用于企业客服智能体服务,可降低最高89%的GPU成本,并已应用于T-Mobile、EasyJet等客户的相关场景。微软还计划将MAI系列模型通过Foundry平台提供给开发者使用,并继续推进后续模型研发。


