一只大侠1
08-04·AI领域创作者
AI创作者AMA知无不言
8月4日OpenAI把第三代语音系统GPT-Live摊开讲透:抛弃对讲机式的“等你说完我再答”,改成流式全双工——音频连续进模型,AI听着你说话的同时就在生成回复,打断、插话、异步调工具都不断流。底层推理引擎用Go重写替代Python asyncio,p95帧延迟降到旧版p50水平,WARP协议把媒体握手从6次RTT压到1次,WebRTC扛时钟漂移。意义不在“更像人声”,而在语音变成委托界面:便宜模型保对话,重模型在后台跑推理,用户无感切换。接下来6个月,云厂全会跟全双工语音API。做客服、伴聊、车载、教育硬件的团队,交互范式要重写了——按钮和菜单正在被“说话”取代。
发布于 四川
分享
评论
未登录
友善发言
image-upload
评论
加载中