❯ MiniMax 多模态生成模型 H3 亮相世界人工智能大会,官方标注即将上线
全模态一锅MiniMax 在 7 月 17 日开幕的 2026 世界人工智能大会上发布新一代多模态生成模型 H3,与旗舰模型 M3 同场亮相。展台信息显示 H3 当时标注为”即将上线”,据腾讯新闻报道,内部人士称”很快会上”。
把单任务合起来H3 的思路是把切开的模型重新拼成一个:不再让图像、视频、声音各做各的生成与编辑,而是把文字、图像、视频、声音放进同一个上下文,统一理解创作意图后再输出。此前 MiniMax 的产品线正是按模态切开的,视频、语音、音乐各走各的模型。目前官方尚未公布 H3 的参数规模、权重开放方式与定价,公开信息有限,能力细节仍需以正式发布为准。同场的 M3 已于 6 月开源,428B 总参数、1M 上下文。
接口形态要变创作工具厂商先要盯的是调用形态,一次请求就能同时吃进图、声、视频的话,围绕单模态搭起来的工作流得推倒重做。国内多模态的竞争位置也会跟着挪,谷歌当天刚把视频编辑榜首收走,走的正是对话式编辑这条同路。在 H3 真正上线之前,这些都还只是展台上的说法。
▪ SIGNAL从各做各的模型走到一个模型接住整段创作,H3 把话说在了东西交付之前。