島上财经
08-05·银行职员·10年+
字节发布音视频全双工大模型,已上线豆包
豆包这回真“成精”了,能看会听的AI来了!事情是这样的,字节昨天甩出个硬货,SeedRealtime音视频全双工大模型,已经在豆包上线了。啥叫“全双工”?说白了就是AI不再是一问一答的木头人,它能同时看着画面、听着声音,边看边说边琢磨,跟真人聊天一个样!以前那些AI助手,你得先说完,它再琢磨怎么回,中间总有那么一两秒尴尬的沉默。现在好了,你拿手机摄像头对着啥它都能实时唠,看菜谱给你翻译,逛博物馆主动讲解,连你操作咖啡机搞错了它都能当场指出来,这哪还是工具,简直是个随身带着的活导游加小助手!我发现最牛的是它知道什么时候该闭嘴,旁边有人闲聊它不搭茬,画面扫到关键东西它主动开口,节奏拿捏得死死的,AI能做到这个份上,离科幻片里那种帮人干活的智能体,真不远了。
发布于 广东
1
评论
1
未登录
友善发言
image-upload
评论
加载中