❯ 英伟达蒸馏模型登顶开源图生视频榜,谷歌拿下视频编辑第一
两张榜同日更新英伟达的 Cosmos3-Super-4Step 蒸馏模型在 Artificial Analysis 榜单上拿下开源图生视频第一、文生图第三,成绩超过被它蒸馏的原始模型;同一天,谷歌 Gemini Omni Flash 登上视频编辑榜首位,几乎横扫该机构的视频类榜单。
快在哪Cosmos3-Super-4Step 的关键是把采样步数从 50 步压到 4 步,并去掉无分类器引导,推理速度最高提升约 25 倍,生成质量几乎没有损失——蒸馏版反超原版,说明这一代视频模型的冗余还相当可观。Gemini Omni Flash 走的是另一条路:除了生成视频,它支持对话式视频编辑,用一句话替换画面里的背景或元素,把编辑动作并进了同一个模型。
成本和交互一起变视频类应用的定价模型会被 4 步采样直接改写,单条生成的算力成本降一个数量级之后,按次收费的产品逻辑就站不住了。创作工具厂商要面对的则是交互层的挤压,当替换背景这类操作能用一句话完成,围绕时间轴和图层建立起来的专业工具,护城河窄了一截。
▪ SIGNAL蒸馏版打赢原版,说明这一代视频模型贵在冗余而不是能力。