英伟达正在研发新一代开源权重模型Nemotron 4,旨在与全球最优秀的免费模型一较高下。据外媒报道,其参数规模可能达到一万亿,然而这一数字并非业界首创——中国的一些实验室早已在万亿参数级别上有所布局。

发生了什么

据The Decoder报道,英伟达正在推进Nemotron 4项目,这是一个开放权重模型,目标是与当前最顶尖的开源模型竞争。报道指出,Nemotron 4的参数量可能达到一万亿(1 trillion),但并未透露具体发布时间或技术细节。值得注意的是,报道同时强调,这一规模已被中国实验室超越,暗示中国在超大模型领域已先行一步。

为什么重要

万亿参数模型曾是业界公认的“圣杯”,但近年来,随着MoE(混合专家)等架构的兴起,参数规模不再是衡量模型能力的唯一标准。然而,英伟达选择在这一节点上冲击万亿参数,背后有多重考量。首先,英伟达作为AI算力霸主,其GPU在训练超大模型时具有天然优势,推出自研大模型可以展示其硬件生态的完整性和竞争力。其次,开放权重策略有助于英伟达在开源社区中建立影响力,对抗Meta、Mistral等公司的开源模型生态。更重要的是,中国实验室在万亿参数上的先例表明,这一赛道并未冷却,而是进入了更务实的阶段——从单纯追求规模转向效率与实用性。

影响与看点

对于开发者而言,Nemotron 4若真以万亿参数开源,将极大降低使用顶级模型的门槛,但同时也对硬件资源提出更高要求,可能推动量化、蒸馏等技术的普及。对于行业来说,英伟达的入局可能改变开源模型的竞争格局,尤其是与DeepSeek、智谱等中国厂商的模型形成直接对标。值得关注的是,英伟达是否会采用MoE架构来平衡性能与推理成本,以及其训练数据策略是否涉及版权争议。一个独立的判断是:万亿参数不再是技术实力的唯一证明,未来的竞争将更多体现在数据质量、训练效率和实际应用效果上,英伟达的Nemotron 4能否在这一维度上带来惊喜,仍需观察。