财金大咖
08-05·AI领域创作者
字节发布音视频全双工大模型,已上线豆包
传统大模型被动响应的短板,在实景、实时沟通场景下暴露得愈发明显。字节发布音视频全双工大模型并全面上线豆包,支持持续追踪镜头画面变化,识别关键物体后主动输出对应解答与操作指引。不同于行业多数厂商仅聚焦语音全双工,字节叠加视觉同步处理,适配户外、嘈杂线下等复杂真实使用环境,拓宽落地场景边界。技术落地同样存在算力消耗偏高的问题,字节需要持续优化推理压缩方案,平衡交互流畅度与云端服务器运营成本。
发布于 四川
2
评论
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn