❯ 英伟达被曝研发万亿参数Nemotron 4,规模翻倍仍小于中国头部开源模型
规模翻一倍据 The Information 援引知情人士报道,英伟达正在研发新一代开源模型家族 Nemotron 4,旗舰版参数量将超过 1 万亿,约为现有最大模型 Nemotron 3 Ultra(5500 亿参数,今年 6 月发布)的两倍,但仍小于目前领先的几个中国开源模型。
时间表未定英伟达没有给出发布日期,训练也尚未完成,公司员工称最快今年深秋可能就绪。这条消息恰好压在 Nemotron 3.5 Lightning 发布的第二天——那是个 300 亿总参数、30 亿激活的小模型,独立评测机构 Artificial Analysis 测出其智能体能力已超过 gpt-oss-120b,而参数量只有后者的四分之一。一大一小两条线同时推进,意图很清楚。
卖芯片的逻辑英伟达做开源模型并不指望靠模型赚钱,目的是让为自家硬件优化过的高质量模型足够多、足够好,从而拉动 GPU 需求。真正要盯的是它给中国开源阵营留下的位置:万亿参数这个数字被特意拿来和中国模型对比,说明英伟达清楚开源生态的话语权眼下不在美国手里。受影响最直接的是开发者的默认底模选择:深秋这个时间点若兑现不了,云厂商和开源社区的迁移成本只会越垒越高,竞争窗口继续留在中国模型那边。
▪ SIGNAL芯片厂自己下场做开源模型,本质是在给硬件铺一条不依赖任何一家实验室的需求通道。