茫茫人海中遇见你
08-06·职场领域创作者
字节发布音视频全双工大模型,已上线豆包
今年四月份字节先上线纯语音版本的全双工模型,解决AI乱插话、环境杂音误触发这类烦人的毛病。隔了四个月直接升级成音视频一体架构,抛弃从前语音、画面、文字分开处理的老套路,可以一边接收画面信息、一边听人说话、同步给出回应。很多别家AI助手都是死板的一问一答,必须等用户全部说完之后AI才能够回话。字节这款新模型可以实时捕捉镜头里面的动态,听见环境噪音主动做出反应。放到日常场景来说,平时和AI视频闲聊、咨询生活难题的时候,对话节奏就和跟真人聊天差不多,这也是它和竞品拉开差距的关键点。
发布于 天津
1
评论
1
未登录
友善发言
image-upload
评论
加载中