Qwen-Image-Edit发布,图像编辑强调语义与外观双重控制
8月19日,通义千问团队发布Qwen-Image-Edit。该模型建立在Qwen-Image基础上,将输入图片同时交给视觉语言模型与图像编码器处理,以兼顾语义理解和外观细节。
模型支持两类编辑:一类是添加、删除或替换局部元素,同时尽量保持其他区域不变;另一类是视角旋转、角色延展和风格转换等整体语义调整。官方还重点展示了中英文文字的新增、删除和修改。
对于电商和品牌内容,精准编辑比从头生成更接近真实工作流程。团队可以保留产品主体,只更换背景、场景或局部文案,减少重新设计带来的结构偏差。
但多轮编辑仍可能逐渐改变产品比例、标签和材质。需要保留的细节应在提示中明确标注,并在每次修改后进行对照检查。
*本文为基于官方发布信息的中文摘要,详情以原文链接为准。