英伟达开源双塔AI模型,文本生成速度提升2.42倍画质保留98.7%
时间:2026-07-24 | 作者:318050 | 阅读:0最近,英伟达在7月2日开源了一款有意思的新模型——Nemotron-Labs-TwoTower离散扩散语言模型。目标很明确:解决大模型逐token生成时速度太慢的老大难问题。模型权重已经在Huggingface上开放下载。
更关键的是,它并不是从零开始训练的。而是直接基于现有的Nemotron骨干网络改造,复用预训练权重。开发成本因此大幅降低,可以说是个“站在巨人肩膀上”的方案。
60B 双塔架构,分工并行提升生成效率
这个模型总参数量60B,但拆成了两座各30B的独立神经网络协同工作。每座塔激活3B参数,搭载128个可路由专家模块。
具体分工是怎样的?
- 上下文塔:固定冻结,负责留存全文语义信息。
- 去噪塔:专门训练,依靠扩散机制并行生成文本。
- 两塔之间通过交叉注意力互通数据,相当于一个负责“记笔记”,一个负责“写文章”,各司其职。
传统模型只能逐token串行输出,而双塔架构允许并行写入文本,推理吞吐量自然大幅提升。从多类基准测试的数据来看,模型综合能力保留了原版98.7%的水准,而文本生成吞吐速度直接提升了2.42倍。
当然,没有十全十美的事——代码、数学类任务有小幅下滑。但在大多数场景下,这个速度与质量的平衡已经相当令人满意。
开源落地,适配多场景推理部署
该模型采用英伟达专属开源协议开放权重,开发者可以自由下载测试以及商用部署。
运行配置上,需要两张H100或A100 80GB显卡才能发挥完整双塔推理能力。单卡仅支持纯自回归模式,双塔完整推理必须双卡协同。
测试覆盖了常识、数学、代码、阅读理解等多项任务。多数指标与原版基本持平,可以说在生成速度与内容质量之间找到了一个不错的平衡点。
来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。
相关文章
更多-
- 微软、英伟达、IBM等巨头联合声明力推开放权重AI巩固美国领先地位
- 时间:2026-07-25
-
- 全球首个无英伟达万亿模型海外开发者热抢
- 时间:2026-07-25
-
- 黄仁勋入驻X首条推文:英伟达等25家公司力挺开源AI
- 时间:2026-07-25
-
- 英伟达与AMD双双表态支持AI开源
- 时间:2026-07-25
-
- 吃灰老卡再战三年!大神魔改P100显卡:跑35B大模型提速88%
- 时间:2026-07-24
-
- 等等党输麻了!显存暴涨刚上热搜:厂商连夜撤单改价猛涨千元
- 时间:2026-07-24
-
- 英伟达砸15亿美元!联手Amkor在美国扩产先进封装
- 时间:2026-07-24
-
- AMD挑战英伟达全栈壁垒 一文读懂AAI2026
- 时间:2026-07-24
精选合集
更多大家都在玩
热门话题
大家都在看
更多-
- iOS 13.5.1电池续航差是电池耗电问题吗
- 时间:2026-07-25
-
- 苹果教育优惠开启 附购买攻略
- 时间:2026-07-25
-
- 苹果iOS 14 beta 2 测试版主要更新内容:除细节变化外修复多项Bug
- 时间:2026-07-25
-
- iOS 14 beta 2 是否解决内存占用过多问题?
- 时间:2026-07-25
-
- 受欢迎的奥特曼游戏有哪些
- 时间:2026-07-25
-
- iOS 14信息应用5大更新变化
- 时间:2026-07-25
-
- iOS 14正式版上线时间公布 官方全新介绍
- 时间:2026-07-25
-
- 最新苹果iOS 14 Beta 2版本更新内容全解析与升级教程
- 时间:2026-07-25
