Token导航 LogoToken导航TokenDH.com

网易有道段亦涛:AI交互从“轮次对话”走向实时,人机协作进入“双脑”时代

更新时间 2026-09-17来源 亿欧网正文 1366字阅读约 5分钟3 张图片

图片

9月16日,网易有道「NEXT,AGENT|有道AI Open Day」在北京举办。

亿欧现场获悉,网易有道集中展示了覆盖办公、学习、营销等多场景的AI Agent产品矩阵与最新技术成果。

网易有道首席科学家段亦涛在演讲中分享了有道在大模型与AI原生产品领域的最新进展,并重点介绍了网易有道围绕实时语音交互以及深度研究aAgent“有道有据”展开的最新实践。

图片

段亦涛表示,随着大模型能力不断提升,AI交互正在从传统的“轮次式交互”走向更加自然的实时交互。过去人与AI往往是“我说一句、你说一句”,系统能够明确判断何时输入结束、何时开始回答;但在实时语音场景中,模型每时每刻面对的都是不完整的信息,需要持续判断“继续等待还是马上输出”,因此实时交互本质上是一个同时追求低延迟与高质量的问题。

围绕这一方向,网易有道此次带来了两款开源子曰Live模型——流式语音识别模型R2T2和流式同声翻译模型T3PO。其中,R2T2强调“真正的流式”:与部分流式方案先快速输出、随后再回改结果不同,R2T2通过稳定前缀学习,让已经输出的内容保持稳定,做到“只增不改”。段亦涛认为,这种能力对于实时字幕、语音输入以及未来的语音Agent都有重要价值。

而在实时翻译中,最大的技术挑战同样来自“既要又要”:既要足够快,又要保证翻译质量。为此,T3PO采用多目标优化思路,在翻译质量和延迟之间寻找更优平衡。随着多模态、推理、翻译、语音以及实时交互能力不断完善,子曰也正在从单一模型进一步发展为覆盖不同AI能力的模型矩阵

除了模型能力,段亦涛此次还重点谈到了另一个判断:模型并不等于完整的AI产品,Harness决定了模型如何真正进入工作流、产生价值

图片

基于这一思路,有道推出深度研究工具“有道有据”。不同于单纯依靠大模型生成答案,“有道有据”连接了专业论文、文献、专利、法条等专业数据,并重点强化结论与证据之间的核验能力,力求让重要观点能够找到对应的信息和文献支撑。同时,它拥有自己的运行环境,不仅可以完成问答,还可以进一步完成论文、PPT等复杂任务。

在段亦涛看来,更重要的是,“有道有据”背后代表了一种不同的人机协作理念。面对AI,人们真正需要思考的并不只是“哪些职业会不会被AI取代”,而是两个问题:人在完成任务的过程中创造了什么独特价值完成任务之后,人自己有没有获得新的积累和成长?只要人在过程中持续创造价值并形成沉淀,AI就不只是任务的替代者,而会成为放大个人能力的工具。

因此,“有道有据”并没有把人与AI的交互限制在传统的线性对话中,而是允许用户从任意一个思考节点继续追问、发散,并通过项目、笔记、标注等方式不断组织和沉淀信息,让AI能够跟随人的思考过程共同推进研究和创作。

段亦涛将这种关系总结为一句话:‘有据’既是一个模型的Harness,也是一个人脑的Harness。”在他的设想中,未来真正有价值的AI产品,不应该只是一个替人完成任务的Chat,而应该成为一个“工作台+活的助手”——人在使用AI的同时,也不断积累自己的知识、判断和方法,实现“双脑合作,1+1>2”。

从实时语音交互到“有道有据”,背后体现的是同一套AI原生产品思路:模型能力需要进入具体场景和工作流,而AI最终的价值,也不只是帮用户更快完成任务,更在于帮助人与AI一起思考、一起成长

文章标签AI资讯
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多