节省近50%GPU计算!通义百聆开源新一代语音交互模型
时间:2025-12-24 | 作者: | 阅读:012月24日消息,阿里通义百聆家族近日开源新一代语音交互模型Fun-Audio-Chat-8B。
新模型兼具高智商和高情商,具备出色的共情能力,与之对话,仿佛与懂你的人聊天。
在OpenAudioBench、VoiceBench、UltraEval-Audio、MMAU、MMSU、SpeechFunctionCall等权威基准测评中,Fun-Audio-Chat-8B斩获SOTA,超过同量级开源模型。
目前,百聆家族成员包括“会说话”的语音转文字模型Fun-ASR、“听得懂”的文字转语音模型Fun-CosyVoice3。
最新开源的模型Fun-Audio-Chat-8B主打语音对语音功能——“能听会说”。
用户可与模型音频对话,适用于语音聊天、情感陪伴、智能设备和语音客服等多种场景。
无任何情绪标签或提示词情况下,它能通过语义、语气、语速、停顿、重音等细微信号,感知对方的情绪状态,并给出恰到好处的关切、安慰或鼓励式回应。
此外,用户可尝试角色扮演,量身定制语音的情绪、说话风格、语速、高低音和音量等。
而模型能保持“原有智商”,主要得益于两个创新的音频模型训练模式。
一是采用Core-Cocktail两阶段训练策略,先快速学新本事,再把“新本事”和“老底子”融合起来,为了避免学新东西把原来的能力忘掉(灾难性遗忘),第一阶段训练得到的模型和原始的纯文本大模型参数合并后,再进行微调。
二是与人类偏好对齐。通过多阶段和多任务的后训练设计,模型在真实对话场景中能更好地理解用户语音内容与情绪线索,作出更自然、更符合人类期望的回应。
值得注意的是,新模型通过压缩-自回归-解压缩的双分辨率端到端设计,音频帧率降到业界最低的5Hz,在保证语音质量的同时节省近50% GPU计算。
目前,用户可在魔搭社区、HuggingFace和GitHub下载模型自行体验。
来源:https://news.mydrivers.com/1/1094/1094368.htm
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。
相关文章
更多-
- 国产GPU公司景嘉微去年亏了1.2-1.8亿:自研GPU可满足云桌面、云游戏等应用
- 时间:2026-01-15
-
- 英伟达官宣新一代GPU 推理算力是Blackwell的5倍
- 时间:2026-01-06
-
- 中国四大GPU公司都完成IPO 围堵英伟达!壁仞科技今日上市 股价涨幅最高超100%
- 时间:2026-01-02
-
- NVIDIA要用上X3D堆叠设计!下代Feynman GPU将引入LPU
- 时间:2025-12-29
-
- 市值2800亿!摩尔线程后 又一国产GPU公司上市:股价暴涨568% 中一签可赚30万元
- 时间:2025-12-17
-
- 国产NVIDIA之后国产AMD也来了 沐曦中签率公布:比摩尔线程难抢
- 时间:2025-12-08
-
- 中一签赚28.69万!摩尔线程市值超2800亿 董事长身家超300亿
- 时间:2025-12-05
-
- 自研7nm GPU就绪!摩尔线程今日正式上市 114.28元/股、中一签能赚多少钱
- 时间:2025-12-05
精选合集
更多大家都在玩
大家都在看
更多-
- 合成神龙小游戏推荐
- 时间:2026-01-15
-
- 傻子网名男生两个字霸气(精选100个)
- 时间:2026-01-15
-
- 千年寻仙追杀仇人攻略
- 时间:2026-01-15
-
- 空灵诗篇商店换购教程
- 时间:2026-01-15
-
- 支付宝怎么发送口令红包?支付宝发送口令红包的方法
- 时间:2026-01-15
-
- 玉茗茶骨第4集剧情介绍
- 时间:2026-01-15
-
- 抖音切片是怎么赚钱的?
- 时间:2026-01-15
-
- 好听昵称唯美男生霸气网名(精选100个)
- 时间:2026-01-15


