北京商报讯(记者吴其芸)9月16日 ,网易有道举办发布会,集中展示了覆盖办公、学习 、营销等多场景的AI Agent产品矩阵与最新技术成果 。会上,网易有道首席科学家段亦涛聚焦子曰模型矩阵建设、语音模型能力升级以及 AI 技术发展方向展开分享,重点推出“子曰模型矩阵 ”与“子曰Live同传模型”两大成果。
据了解 ,今年 5 月,有道正式将“子曰”大模型升级到4.0版本,发布多模态推理、跨语种零样本、翻译升级三款模型 ,前两款已开源,均在各自领域同级别 、同规模模型中达到前沿水平。此外,段亦涛宣布发布子曰Live同传模型 ,开源子曰流式 ASR 模型,提供面向语音Agent级别的流式语音识别能力,在保证高质量的同时提供极低时延、高流畅度的实时同传能力。相比过去“你说一句、我说一句”的交互方式 ,新模型支持实时流式输入输出与全双工交互 。
网易有道智能应用事业部负责人张艺分享了有道在声音智能领域的成果与探索。他认为,未来AI需要从“人适应技术 ”转向“技术适应人”,而声音将成为连接用户与AI的重要入口。围绕这一方向 ,有道在今年3月推出的行业首个同传Agent——有道AI同传,近来 已累计服务超2500万用户,使用次数同比接近翻倍;网易叭哥说作为网易首个AI原生语音Agent,依托有道多年沉淀的语音识别和翻译技术 ,跳出传统语音输入 “语音转文字” 的工具定位,把人的自然口语直接转化为结构化 、可直接复用的高质量文本 。
此外,网易有道智能硬件事业部负责人高慧湍还介绍 ,有道AI耳机OpenPods打通了"录音—转写—总结—翻译"的全链路AI能力,覆盖会议沟通场景中"听、记、办"三个环节。在跨语言沟通方面,该产品支持二十余种语言的音视频实时翻译 ,并通过音色克隆技术保留发言者的音色特征;耳机舱可独立完成录音 、翻译与外放,无需依赖手机即可承担翻译任务。
(文章来源:北京商报)




