大佬说
08-06 · 南京小马哥文化传媒有限公司
字节发布SeedRealtime双工模型
字节跳动发布SeedRealtime,这是一类原生音视频全双工模型,它可以同时理解用户说话、画面与交互时序,并在对话过程中持续回应,实现“边看、边听、边说”。在过去,语音助手通常采用“语音识别—文本大模型—语音合成”的串行链路,用户说完后系统才开始处理,容易出现等待、打断困难、对环境和画面理解不足等问题。SeedRealtime将这些环节更深地融合,在实时陪伴、智能客服、车载交互、AI硬件和视频互动等场景都具备底层能力升级的意义,交互从“问一句答一句”向更自然的连续协作演进。emoji
发布于 江苏
分享
1
未登录
友善发言
image-upload
评论
加载中