微软发布自研图像与语音模型,已接入Bing、PowerPoint和Dynamics 365

微软7月23日宣布推出两款自研AI模型MAI-Image-2.5-Pro和MAI-Voice-2-Flash,均进入公开预览。前者面向高质量图像生成、细节编辑和图像内文字渲染,已成为Bing Image Creator默认模型,并接入PowerPoint,较GPT-Image-2最高降低84% GPU成本。后者面向高并发语音交互,速度较上一代提升约2倍、成本降低32%,已用于Dynamics 365 Contact Center并服务T-Mobile、EasyJet等客户。微软称两款模型不依赖第三方蒸馏,MAI系列将继续扩展。

上一篇:

下一篇:

发表回复

登录后才能评论