Steven张宏伟
07-16 · 险峰长青
阿里发布Qwen-Audio-3.0实时语音交互模型阿里语音交互模型升级为Qwen-Audio-3.0-Realtime,支持音色克隆与情感感知生成,可动态调整语气节奏,告别机械朗读感。内置多模态双工控制模型,具备声纹级背景过滤,嘈杂多人环境下精准锁定主对话者,打断检测与响应时延领先。支持动态工具调用完成路线规划、信息查询等任务,Artificial Analysis语音推理子项综合排名第一,超越GPT-Realtime-2。
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中