2026-08-04-星期二 · Qwen38Max · MiniMax

收录于 第 52 期(2026-08-04) · 本期共 10 条

❯ MiniMax 开源 33B 视频模型 H3,单张 RTX 5090 可跑

消费级门槛MiniMax 把 330 亿参数的全模态视频模型 H3 权重放上了 Hugging Face,官方说明称模型可生成最长 15 秒、2K 分辨率、24 帧的视频,并原生输出 32kHz 立体声,一张 RTX 5090 就能跑。它与阿里 Qwen3.8-Max 在同一天相隔数小时发布,Simon Willison 特意点名了这个撞车。

能跑不等于好跑这一版于 7 月 31 日上线,消费级可运行这件事有具体代价。据官方与社区说明,ComfyUI 提供首日支持,但优化后的整套栈约 40GB,靠内存与固态硬盘之间的动态卸载才塞进消费级显卡;早期在 5090 上的实测是生成 5 秒 768p 级画面耗时约 5.5 分钟。此前 MiniMax 的视频模型只走 API,这次开源程度仍需打个折扣:上下文编排、2K 重生成和稀疏注意力等几块核心仍留在服务端,本地拿到的并不是完整能力。此外这份社区许可限制在美国、欧盟、英国和韩国的公开使用,理由是版权诉讼——这在开放权重模型里是个不常见的条款。

拿到手的是谁权重落地最实际的影响在独立创作者和小团队的成本结构上:过去做带声音的短片必须走 API,现在一张显卡加一夜时间就能出片,代价是等待。被这条挤压的是按秒计价的视频生成服务——当基础能力可以本地跑,云端要卖的就只剩速度、分辨率和那几块没开源的模块。而对企业用户,那份地区限制条款比参数量更需要先让法务看一眼。

▪ SIGNAL权重放出来了,能力却留了一半在服务端,开源这两个字正在被拆开使用。