今朝
08-05 · 消费日报社客户端
【#字节跳动发布SeedRealtime音视频全双工大模型#,已在豆包App全量上线】8月5日,字节跳动宣布正式推出原生音视频全双工大模型SeedRealtime。据介绍,SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。字节跳动表示,SeedRealtime的核心突破,在于将声音、画面、时序与表达统一到同一个端到端模型中。具体来看有三方面:一是音视频联合理解,原生支持声音、画面与时序信息的深度融合;二是主动的交互能力,该模型具备持续的环境感知与主动表达能力;三是流畅的交互节奏,该模型能够实时感知用户的对话状态与交流节奏,在适当时机自然接话、停顿与回应,同时具备较强的抗干扰能力,不因干扰误触发,保持沟通的流畅连贯。字节跳动称,SeedRealtime已在豆包App全量上线,在业界率先实现了音视频全双工技术的规模化落地。@消费日报-今朝news
发布于 北京
分享
评论
未登录
友善发言
image-upload
评论
加载中