成本最高降90%!百度发布端到端语音语言大模型
3月31日,在百度AI DAY上,百度发布业界首个基于全新互相关注意力(Cross-Attention)的端到端语音语言大模型,实现超低时延与超低成本,在电话语音频道的语音问答场景中,调用成本较行业均值下降约50%-90%。当日,文小言宣布品牌焕新,率先接入该模型,还带来多模型融合调度、图片问答等功能升级。
接入全新的端到端语音语言大模型后,文小言不仅能支持更拟真的语聊效果,而且支持重庆、广西、河南、广东、山东等特色方言。据介绍,语音大模型具备极低的训练和使用成本,极快的推理响应速度,语音交互时,可将用户等待时长从行业常见的3-5秒降低至1秒左右。
更新后的文小言还支持“多模型融合调度”,通过整合百度自研的文心X1、文心4.5等模型,并接入DeepSeek-R1等第三方优质模型,实现了多模型间的智能协同。用户可以选择“自动模式”,一键调用最优模型组合,也可根据需求灵活选择单一模型完成特定任务,大幅提升响应速度与任务处理能力。
同时,文小言还加强了图片问答功能,用户拍摄或上传图片,以文字或语音提问即可直接获取深度解析。(王静)
延伸 · 阅读
- 2025-04-08南非2024年第四季度失业率降至31.9%
- 2025-04-08匈牙利外长:与中国的合作受益匪浅
- 2025-04-08就岸田文雄遇袭事件 日本法院判处嫌疑人有期徒
- 2025-04-08从保费突破7000亿,看寿险头雁的发展韧性
- 2025-04-08跨大西洋裂痕渐深 欧美已到“脱钩时刻”?
- 2025-04-08比利时与荷兰农场接连暴发禽流感疫情 逾18万只
科创新闻网


