❯ 阿里开源 Qwen-Image-2.1,70 亿参数支持原生透明与十张参考图
权重开放阿里通义千问团队开源 Qwen-Image-2.1,70 亿参数,生成与编辑统一在一个模型里,官方称是该系列中最均衡、最具性价比的一款,并宣称性能超过大多数闭源模型。模型已上架 Hugging Face、GitHub 与魔搭,ComfyUI 与 vLLM 均给了首日支持。
两处硬功能与前代拉开差距的是两个具体能力:一是原生四通道 RGBA 输出,透明度由模型直接产出,不再需要额外跑一遍抠图;二是单次最多接受 10 张参考图,多图输入的推理速度据官方说明被大幅加速。另有原生 2K 输出与更好的文字渲染,官方给的例子是丢进一张三视图角色参考、直接生成完整分镜。此前该系列的透明底一直要靠后处理补。
消费级门槛70 亿参数这个体量是关键:它能在消费级显卡上跑起来,把「生成加编辑加透明底」三件事压进一张卡。此前想同时拿到这三样,要么串联多个开源模型,要么走闭源接口按张付费。对做设计工具与内容流水线的团队来说,这次开放动的是他们的成本结构,而不是画质上限。
▪ SIGNAL70 亿参数、原生透明、十图输入,这三项凑在一张消费级显卡上,闭源图像接口的定价第一次有了实质压力。