微软三款自研大模型发布,骨折价安抚OpenAI
2025年4月3日,美国时间周四,微软旗下的研究部门Microsoft AI正式推出三款基础人工智能模型,涵盖文本、语音与图像生成三大领域。这一举措传递出明确信号:在与OpenAI保持深度协作的同时,微软正加速构建自主的多模态AI技术体系,以应对日益激烈的行业竞争。 具体来看,此次发布的三款模型各有
2025年4月3日,美国时间周四,微软旗下的研究部门Microsoft AI正式推出三款基础人工智能模型,涵盖文本、语音与图像生成三大领域。这一举措传递出明确信号:在与OpenAI保持深度协作的同时,微软正加速构建自主的多模态AI技术体系,以应对日益激烈的行业竞争。

具体来看,此次发布的三款模型各有侧重。语音转录模型MAI-Transcribe-1支持25种语言,处理速度达到微软现有Azure Fast服务的2.5倍;音频生成模型MAI-Voice-1可在1秒内生成60秒音频,并支持自定义语音;图像生成模型MAI-Image-2则定位为文本到图像生成工具。目前,这三款模型已上线Microsoft Foundry平台,转录与语音模型也已同步登陆MAI Playground测试平台。值得一提的是,MAI-Image-2早在3月19日就已在测试平台率先亮相。
该系列模型由Microsoft AI首席执行官穆斯塔法·苏莱曼(Mustafa Suleyman)领导的MAI超级智能团队研发。该团队于2025年11月正式组建并对外公布。苏莱曼在最新博客中阐述了团队的核心理念——“人文主义AI”,强调模型开发侧重于优化自然交互体验和实际应用落地。他还透露,未来将在Foundry平台及微软自有产品矩阵中部署更多自主模型。
面对当前大模型市场的白热化竞争,微软此次策略清晰——主打价格优势。官方明确表示,这三款模型的核心竞争优势之一,就是定价远低于谷歌和OpenAI的同类竞品。具体费率方面:MAI-Transcribe-1定价每小时0.36美元起;MAI-Voice-1每百万字符22美元起;MAI-Image-2的文本输入与图像输出成本,分别为每百万词元5美元和33美元起。这一价格策略,意图不言而喻。
一方面加紧自研,另一方面也要安抚外部盟友。苏莱曼在接受VentureBeat采访时重申,微软与OpenAI的合作承诺不会动摇。不过在与The Verge的对谈中,他透露了一个关键细节:正是双方近期重新修订的协议条款,为微软实质性推进自身的超级智能研究扫清了障碍。截至目前,微软已向OpenAI投入超过130亿美元,并通过长效合作机制将后者的模型全面接入自家产品生态。从底层算力到上层模型,微软的战略意图已彻底浮出水面——就像在AI芯片领域采用的“自研+采购”双线布局一样,在基础大模型赛道上,微软同样选择了“两条腿走路”。

