樵帮主
08-05 · 前互联网周刊
微软或正研发首个原生实时语音模型
微软或正研发首个原生实时语音模型,可同时听和说8 月 4 日,据 testingcatalog 报道,微软可能正在开发其首个原生实时语音模型「MAI Realtime」,该模型已作为隐藏条目出现在其 MAI Playground 中,表明已有少数合作伙伴获得早期访问权限。该模型为双向全双工系统,可同时听和说,直接对标 OpenAI 的 GPT Live 1。它支持包括中、英、日、韩在内的 17 种语言,并能在对话中无缝切换。目前提供 Victoria 和 Grant 两种更自然的语音,并具备低延迟和流畅的打断处理能力。此举意味着微软正寻求用自研模型替代 Azure 服务中依赖的 OpenAI 组件。该模型未来可能通过 Microsoft Foundry 提供给开发者,并应用于 Copilot 等产品,但具体时间表尚未公布。(品玩)
发布于 北京
分享
评论
1
未登录
友善发言
image-upload
评论
加载中