一只大侠1
08-04·AI领域创作者
AI创作者AMA知无不言
8月4日OpenAI把第三代语音系统GPT-Live摊开讲透:抛弃对讲机式的“等你说完我再答”,改成流式全双工——音频连续进模型,AI听着你说话的同时就在生成回复,打断、插话、异步调工具都不断流。底层推理引擎用Go重写替代Python asyncio,p95帧延迟降到旧版p50水平,WARP协议把媒体握手从6次RTT压到1次,WebRTC扛时钟漂移。意义不在“更像人声”,而在语音变成委托界面:便宜模型保对话,重模型在后台跑推理,用户无感切换。接下来6个月,云厂全会跟全双工语音API。做客服、伴聊、车载、教育硬件的团队,交互范式要重写了——按钮和菜单正在被“说话”取代。
发布于 四川
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn