导语:
Qwen-Image 2.1刚刚开源,RunningHub已经完成首发接入。
现在,创作者打开RunningHub,选择模型,输入提示词或上传参考图,就可以直接开始生成和编辑。开发者也可以直接围绕具体场景搭建、测试和发布工作流,通过与其他节点组合,将Qwen-Image 2.1的单次生成能力变成一条完整流程,并进一步封装成面向具体场景的应用。
这次更新不只是画质上的提升。
Qwen-Image 2.1把文生图、图片编辑、多图参考和透明背景生成放进同一套模型里。对于创作者来说,一张图片从无到有,再到修改和交付,可以少换几次工具,也少走几遍流程,对于开发者来说,也有了一个可以继续搭建工作流和应用的新基础。
不只是生成一张图,而是把图片继续做下去
很多图像模型擅长从零生成,但生成之后要修改,往往又要切换到另一个模型。
Qwen-Image 2.1把生成和编辑放进了同一套模型。
没有参考图时,可以根据提示词从零生成;上传已有图片后,又可以继续更换背景、调整配色、增删元素或修改文字。
真正经历过创作的人都清楚,耗时间的,往往不是从零生成一张图,而是:
头发换个颜色;
衣服换成绿色;
包去掉,其他都别动。
这类任务看起来简单,实际上很考验模型。因为每一次重新生成,都可能让人物的脸、姿势、背景和原本正确的细节发生变化。
Qwen-Image 2.1支持指定编辑区域。用户可以明确告诉它哪里要删除、哪里要替换,其他区域尽量保持不动。
(一次指定多个编辑区域,修改人物发型和外套,并移除背包;人物五官、姿势、丝巾、车辆与背景保持一致。)
透明背景,可以直接生成
Qwen-Image 2.1这次新增了一项很实用的能力:原生生成透明背景图片。
传统做法通常是先生成一张带背景的图片,再交给抠图工具处理。如果主体带有发丝、玻璃、烟雾、薄纱或半透明光效,边缘还需要继续修整。
Qwen-Image 2.1采用RGBA图像结构,可以直接输出带透明通道的图片。
它不是生成一张白底图,再把白色背景删除,而是在生成过程中直接判断哪些区域应该显示、哪些区域应该透明,透明素材生成后,还能继续修改表情、颜色和局部细节。
(从复杂场景中提取带卷毛、透明雨衣、牵引绳和花朵遮挡的主体,并在保持轮廓与细节的情况下,继续修改表情和雨衣颜色。)
这项能力可以直接用于:
电商商品和模特素材
表情包、贴纸和头像挂件
海报中的装饰元素
游戏角色、道具和界面素材
需要继续排版的设计组件
对创作者来说,流程可以从“生成—导出—抠图—修边—再编辑”,缩短为“生成或提取—直接使用—继续修改”。
10张参考图,可以一起交给模型
多参考图并不是把几张图片简单拼在一起。
例如,一次输入人物、外套、鞋子、包、耳饰、香水、椅子、宠物、室内环境和日落光线,模型需要完成三件事:
识别每张图中真正需要保留的对象
把不同对象放到正确的位置,并处理比例、遮挡和光线
让最终画面看起来像一次完成的拍摄,而不是后期拼贴
过去输入两三张参考图并不新鲜。但参考图增加到10张后,能不能把所有对象安排正确,能不能保住人物和商品的特征,才是真正的难点。
(同时输入人物、服装、商品、场景和光线等10张参考图,模型识别每张图片的作用,并将不同元素组合进同一张完整画面。)
中文、海报和复杂排版,依然是Qwen-Image的长项
图像模型越来越会画,但一遇到文字,仍然容易出现错字、漏字和排版混乱。
文字生成一直是Qwen-Image系列重点优化的能力。此前的Qwen-Image已经能够处理中文、英文、多行文字和复杂图文布局;Qwen-Image 2.0又进一步支持长提示词、专业海报、信息图和PPT式排版。
Qwen-Image 2.1延续了这套生成与编辑能力。
它不只适合生成风景、人物和插画,也适合处理带有实际信息的图片,例如商品海报、活动KV、知识卡片、公众号配图和社交媒体封面。
如果第一次生成的文字、位置或颜色不合适,还可以直接上传结果继续修改,不需要把整张图片推倒重来。
(在同一画面中完成标题、材质、风格、关键词等多层级排版。)
模型刚开源,RunningHub已经可以直接用
从文生图、图片编辑,到多图参考和透明背景输出,Qwen-Image 2.1把更多图片任务放进了同一套模型。
RunningHub则把模型、算力和使用入口准备好了。创作者可以直接开始生成和修改图片,开发者也可以围绕实际需求验证场景、发布工作流和开发应用。
模型开源只是第一步。当这些能力被做成可以直接使用的工作流和应用,才会真正进入电商、设计、营销和游戏等生产场景。
现在打开RunningHub,即可直接体验Qwen-Image 2.1。

扫一扫,或长按识别二维码
关注艾瑞网官方微信公众号