综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
在语音交互中,哪怕卡顿零点几秒,也会让人瞬间出戏。为了让AI说话不再“结巴”,OpenAI耗时半年重构了语音系统GPT-Live,让原本最慢的音频帧,跑出了旧系统最快速度的流畅感。它靠什么打破延迟魔咒?
第一,给AI“分工”并“换底座”。过去AI听、想、搜挤在一条道上,容易堵车。现在,GPT-Liv...
原文链接
7月9日,OpenAI正式发布新一代语音模型GPT-Live,让人机对话如真人般自然流畅!该模型打破传统回合制局限,实现“边听边说”,能用“嗯哼”等短回应传递倾听信号,在用户停顿思考时耐心等待,且抗噪音干扰能力显著增强。GPT-Live集成最新GPT-5.5模型,支持网络搜索、深度推理、实时翻译及视觉卡片展示。自本周三起,全球用户可体验GPT-Live-1(Plus/Pro默认)与GPT-Live-1 mini(Free默认)两版本。点击语音按钮即可使用,暂不支持语音通话与屏幕共享。
原文链接
近日,OpenAI正式发布全新语音交互模型GPT-Live,带来媲美真人的对话体验,其“瞬间翻译”能力更让同声传译面临失业挑战。相比以往,GPT-Live采用全双工架构,支持边说边听与随时插话,彻底告别“抢麦”与回合制延迟;同时引入深度任务委托,前台流畅陪聊,后台调用GPT-5.5进行联网搜索与复杂推理。此外,新版语音全面支持可视化卡片弹出、图片识别等功能,在厨房烹饪指导、面试复盘等场景表现出色。此次升级标志着AI交互从“使用工具”向“真人交流”的范式转变,语音通话或将成为未来最核心的交互入口。
原文链接
加载更多
暂无内容