OpenAI正进一步押注语音交互。
美东时间8日周三,OpenAI发布全新的语音模型GPT-Live,同步升级ChatGPT语音模式(ChatGPT Voice)。新模型采用原生实时架构,可实现人类与AI之间更加自然的双向语音交流,不仅支持打断、停顿理解、实时翻译、听写等能力,还能够在后台无缝调用GPT-5.5等模型完成复杂推理和联网搜索,将语音打造为ChatGPT新的统一交互入口。

OpenAI公告称,GPT-Live包括GPT-Live-1和GPT-Live-1 mini两个版本,目前已开始向全球ChatGPT用户陆续开放,覆盖网页版、iOS和安卓平台,并计划未来数周向API开放,开发者和企业用户可提前登记获取通知。
此次发布意味着,OpenAI正进一步押注语音将成为AI时代最重要的人机交互方式。OpenAI在发布新模型时透露,目前每周已有超过1.5亿人使用ChatGPT Voice、Dictation等语音功能与ChatGPT交流。媒体评论认为,OpenAI希望未来用户越来越少依赖键盘输入,而更多直接与AI“说话”。







