03 MODEL
❯ 阿里计划训练 5 万亿至 10 万亿参数模型,并发布真武 V900 芯片
模型路线阿里巴巴首席执行官吴泳铭 9 月 22 日在杭州 2026 云栖大会上宣布,公司计划训练 5 万亿至 10 万亿参数规模的模型。据会上披露,下一代 Qwen 4 正在训练中,此后的 Qwen 4.5 与 Qwen 5 系列将扩展到这一区间;阿里当前旗舰约 2.4 万亿参数,规划中的继任者大两到四倍。
芯片同步发布同场发布的是平头哥新一代 AI 加速器真武 V900,吴泳铭称其为”目前中国最强的 AI 芯片”。据阿里公布,V900 性能是前代真武 M890 的 3 倍,单个集群可扩展至 50 万张卡,用于前沿模型的训练与推理,预计 2027 年一季度量产并商用。此前一周,平头哥与寒武纪正在测试长鑫科技的国产 HBM3E,两条线恰好在”国产算力能否撑起万亿级模型”这个问题上交汇。
全栈的账这是阿里第一次把模型、芯片与数据中心放进同一张路线图里讲。10 万亿参数的目标,只有在自有芯片与自有集群撑得住时才算数,V900 那句”50 万卡集群”就是在回答这个前提。中国大模型厂商的算力采购策略会被这套全栈打法推着走:要么跟进自研,要么接受在别人的芯片上训练。量产时间在 2027 年,这张路线图至少还要靠现有算力撑一年。
▪ SIGNAL10 万亿参数是给外界看的目标,50 万卡集群才是它成立的前提,阿里这次把两者绑在了一起讲。