微软发布三款新基础模型,直面AI竞争

内容管家 AI领域评论23字数 485阅读1分37秒阅读模式
微软发布三款新基础模型,直面AI竞争

微软研究院 Microsoft AI 于周四发布三款基础 AI 模型,涵盖文本、语音和图像生成三大方向。此举标志着微软在持续深化与 OpenAI 合作的同时,正加速构建自有的多模态 AI 模型体系。

三款模型一览

MAI-Transcribe-1 是一款语音转录模型,支持 25 种语言转写为文本,速度是微软 Azure Fast 服务的 2.5 倍,定价 0.36 美元/小时。

MAI-Voice-1 是一款语音生成模型,可实现 1 秒生成 60 秒音频的效果,并支持自定义音色,定价 22 美元/百万字符。

MAI-Image-2 原定于 3 月 19 日在 MAI Playground 首发,此次随另外两款模型一同上线 Microsoft Foundry。文本输入定价 5 美元/百万 Token,图像输出定价 33 美元/百万 Token。

定价策略:用低价撬动市场

微软在博客中明确表示,这三款模型的核心竞争力在于"比 Google 和 OpenAI 更便宜"。相较于竞争对手的同类产品,这一一定价策略意在吸引对成本敏感的企业用户。

团队背景与定位

三款模型均由微软于 2025 年 11 月成立的 MAI 超智能团队(MAI Superintelligence)研发,负责人为微软 AI CEO Mustafa Suleyman。Suleyman 在博客中表示:"微软 AI 正在构建 Humanist AI——以人类为中心,优化人们实际的沟通方式,训练模型服务于真实使用场景。" 尽管推出了自研模型,Suleyman 在接受 VentureBeat 和 The Verge 采访时均重申了与 OpenAI 的合作承诺。微软已向 OpenAI 投入超过 130 亿美元,双方通过多年合作协议将 OpenAI 模型部署在微软各类产品中。

延伸阅读

 
内容管家

发表评论