
9月16日,网易有道「NEXT,AGENT|有道AI Open Day」在北京举办。
亿欧现场获悉,网易有道集中展示了覆盖办公、学习、营销等多场景的AI Agent产品矩阵与最新技术成果。
网易有道首席科学家段亦涛在演讲中分享了有道在大模型与AI原生产品领域的最新进展,并重点介绍了网易有道围绕实时语音交互以及深度研究aAgent“有道有据”展开的最新实践。

段亦涛表示,随着大模型能力不断提升,AI交互正在从传统的“轮次式交互”走向更加自然的实时交互。过去人与AI往往是“我说一句、你说一句”,系统能够明确判断何时输入结束、何时开始回答;但在实时语音场景中,模型每时每刻面对的都是不完整的信息,需要持续判断“继续等待还是马上输出”,因此实时交互本质上是一个同时追求低延迟与高质量的问题。
围绕这一方向,网易有道此次带来了两款开源子曰Live模型——流式语音识别模型R2T2和流式同声翻译模型T3PO。其中,R2T2强调“真正的流式”:与部分流式方案先快速输出、随后再回改结果不同,R2T2通过稳定前缀学习,让已经输出的内容保持稳定,做到“只增不改”。段亦涛认为,这种能力对于实时字幕、语音输入以及未来的语音Agent都有重要价值。
而在实时翻译中,最大的技术挑战同样来自“既要又要”:既要足够快,又要保证翻译质量。为此,T3PO采用多目标优化思路,在翻译质量和延迟之间寻找更优平衡。随着多模态、推理、翻译、语音以及实时交互能力不断完善,子曰也正在从单一模型进一步发展为覆盖不同AI能力的模型矩阵。
除了模型能力,段亦涛此次还重点谈到了另一个判断:模型并不等于完整的AI产品,Harness决定了模型如何真正进入工作流、产生价值。

基于这一思路,有道推出深度研究工具“有道有据”。不同于单纯依靠大模型生成答案,“有道有据”连接了专业论文、文献、专利、法条等专业数据,并重点强化结论与证据之间的核验能力,力求让重要观点能够找到对应的信息和文献支撑。同时,它拥有自己的运行环境,不仅可以完成问答,还可以进一步完成论文、PPT等复杂任务。
在段亦涛看来,更重要的是,“有道有据”背后代表了一种不同的人机协作理念。面对AI,人们真正需要思考的并不只是“哪些职业会不会被AI取代”,而是两个问题:人在完成任务的过程中创造了什么独特价值?完成任务之后,人自己有没有获得新的积累和成长?只要人在过程中持续创造价值并形成沉淀,AI就不只是任务的替代者,而会成为放大个人能力的工具。
因此,“有道有据”并没有把人与AI的交互限制在传统的线性对话中,而是允许用户从任意一个思考节点继续追问、发散,并通过项目、笔记、标注等方式不断组织和沉淀信息,让AI能够跟随人的思考过程共同推进研究和创作。
段亦涛将这种关系总结为一句话:“‘有据’既是一个模型的Harness,也是一个人脑的Harness。”在他的设想中,未来真正有价值的AI产品,不应该只是一个替人完成任务的Chat,而应该成为一个“工作台+活的助手”——人在使用AI的同时,也不断积累自己的知识、判断和方法,实现“双脑合作,1+1>2”。
从实时语音交互到“有道有据”,背后体现的是同一套AI原生产品思路:模型能力需要进入具体场景和工作流,而AI最终的价值,也不只是帮用户更快完成任务,更在于帮助人与AI一起思考、一起成长。







