位置:首页 > 产业资讯 > 通义千问升级:实时语音识别模型Fun-ASR-Realtime发布

通义千问升级:实时语音识别模型Fun-ASR-Realtime发布

时间:2026-07-23  |  作者:318050  |  阅读:0

语音交互正在经历一次实质性的跃迁。 就在最近,通义千问大模型正式宣布升级其核心音频能力,带来了全新的实时语音识别模型——Fun-ASR-Realtime

性能突破:快与准兼得

这款模型在性能上真正做到了“快”与“准”兼得。它的首字识别延迟被精准压到了百毫秒级别——换句话说,你这边话音刚落,那边就已经开始响应了。

这种“即说即反馈”的流畅感,对语音助手的交互体验来说是决定性的。而在准确度上,它的表现也相当亮眼,已经逼近行业头部离线识别模型的水准。

能做到实时性和高质量在同一套系统里落地,这本身就是技术的一大突破。

image.png

技术意义与场景拓展

这项升级的意义不止于技术参数。它为语音助手、会议速记这类对延迟极其敏感的场景,提供了更扎实的底层支撑。

更长远来看,它也在拓宽通用大模型在多语言、多方言环境下的应用边界。随着模型正式上线,开发者和企业将能更高效地构建出兼具高灵敏度和高准确率的智能语音应用,让AI交互真正走向自然与人性化

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多