满眼星河12138
08-05·快手员工
字节发布音视频全双工大模型,已上线豆包
字节发布音视频全双工大模型,已上线豆包
字节SeedRealtime全量上线豆包,最大的突破不是“视频通话”,是“全双工”。以前AI语音是回合制,你说一句,它说一句,谁插话都不行。现在SeedRealtime用统一端到端架构原生融合音频、视频和文本,能在连续的多模态信息流中同步完成感知、理解、决策与表达。全双工意味着AI能同时听和说。你说话的时候它就在听,你还没说完它就开始处理了。它说话的时候你也可以插话打断,它会实时调整回应。一个能跟你正常聊天的AI,确实比一个只会一问一答的AI更像“人”。字节在AI交互体验上确实想得比别人深。别人卷参数,字节卷交互。参数再大,不如用起来顺畅。豆包上线SeedRealtime之后,用户不用打字了,直接视频通话。你拿着手机对准一个东西,问AI“这是什么”,它实时回答。边看边问边答,整个体验确实比打字流畅很多。一个不再需要打字的AI助手,确实比一个需要你一直打字的AI助手更适合日常使用。字节用SeedRealtime证明了AI交互的方向不是“更聪明”,是“更自然”。一个能跟你正常聊天的AI,比一个能写代码的AI更让普通用户有感知。字节在AI交互体验上确实想得比别人深。别人卷参数,字节卷交互。参数再大,不如用起来顺畅。
发布于 中国香港
1
评论
未登录
友善发言
image-upload
评论
加载中