阿里通义千问开源图像模型 Qwen-Image-2.1 发布,70 亿参数消费显卡即可本地跑

阿里通义千问团队近期发布开源图像生成编辑模型 Qwen-Image-2.1,一经推出就在开源 AI 绘图社区引发不小讨论。这款模型最亮眼的地方在于轻量化设计,视觉生成模块仅 70 亿参数,官方自测结果显示,图像生成效果对标不少主流闭源文生图模型,当然相关性能还等待第三方独立评测进一步验证。
硬件适配可以说是它一大加分项,不用昂贵的专业算力卡,RTX3090 这类消费级独显,就能本地部署运行,普通开发者、AI 爱好者都有机会上手体验。
在图像能力上,Qwen-Image-2.1 主打多图融合合成。官方演示案例中,可以提取多张单人照片里的人脸,自然合成一张多人合照。核心依托原生 RGBA 透明通道支持,模型可以直接输出带透明背景的图片,省去手动抠图步骤。不管是提取图像素材,还是在透明图层修改文字、调整排版,后期处理都省事很多。
参考图支持上限提升到 10 张,适用场景覆盖多人肖像合成、虚拟穿搭设计、室内空间方案改造等。局部修图同样方便,只需绘制遮罩、圈选需要改动的区域,模型只会修改标记部分,不用整张图重绘。架构优化搭配 KV 缓存复用技术,在加载多张参考图时,推理速度提升会更加直观。
目前 Qwen-Image-2.1 已经同步上架 Hugging Face、GitHub 以及魔搭 ModelScope 平台,配套在线 Demo,大家可以直接在线试用。
不过需要重点留意授权规则:当前模型采用研究许可协议,禁止直接商用。个人学习、学术研究不受限制;企业想要将模型用于商业化项目,需要单独向通义千问团队申请商业授权。
以上关于阿里通义千问开源图像模型 Qwen-Image-2.1 发布,70 亿参数消费显卡即可本地跑的文章就介绍到这了,更多相关内容请搜索码云笔记以前的文章或继续浏览下面的相关文章,希望大家以后多多支持码云笔记。
如若内容造成侵权/违法违规/事实不符,请将相关资料发送至 admin@mybj123.com 进行投诉反馈,一经查实,立即处理!
重要:如软件存在付费、会员、充值等,均属软件开发者或所属公司行为,与本站无关,网友需自行判断
码云笔记 » 阿里通义千问开源图像模型 Qwen-Image-2.1 发布,70 亿参数消费显卡即可本地跑
微信
支付宝