繁忙的小香梨在做饭
08-05·AI领域创作者
字节发布音视频全双工大模型,已上线豆包
字节发布音视频全双工大模型,已上线豆包
简单说,SeedRealtime用统一架构原生融合音频、视频与文本,能在连续的多模态信息流上实时交互,带来“边看、边听、边说”的全新体验。===抛砖引玉啊!谈谈看法!热烈欢迎【老师们】补充斧正!过去很多多模态产品,大多是文本为主,音视频属于附加功能,很难做到真正同步实时响应。SeedRealtime的核心突破,是实现全双工的原生音视频交互,不再是先录再处理的模式,机器可以同步接收画面、声音,同时给出反馈,这是走向智能体非常关键的一步。===你怎么看?!
发布于 山东
分享
评论
1
未登录
友善发言
image-upload
评论
加载中