7月23日,微软宣布推出自研AI模型MAI-Image-2.5-Pro和MAI-Voice-2-Flash,进入公开预览阶段。前者面向高质量图像生成,优化文字渲染与自然语言编辑;后者专注高并发语音交互,速度提升2倍、成本降32%。两款模型均基于微软自有数据训练,不依赖第三方蒸馏。MAI-Image-2.5-Pro已集成至Bing Image Creator、PowerPoint及OneDrive;MAI-Voice-2-Flash已用于Dynamics 365 Contact Center及Azure Voice Live服务。