与阿里云一起

轻松实现数智化

让算力成为公共服务:用大规模的通用计算,帮助客户做从前不能做的事情,做从前做不到的规模。让数据成为生产资料:用数据的实时在线,帮助客户以数据为中心改变生产生活方式创造新的价值。

图像编辑大模型特性介绍

Qwen-Image-Edit 成功将 Qwen-Image 独特的文本渲染能力扩展到图像编辑任务中,实现了精确的文本编辑。此外,Qwen-Image-Edit 同时将输入图像送入 Qwen2.5-VL(用于视觉语义控制)和 VAE 编码器(用于视觉外观控制),从而在语义和外观编辑方面都具备了能力。

语义和外观编辑:Qwen-Image-Edit 支持低级视觉外观编辑(例如添加、删除或修改元素,要求图像的其他区域保持完全不变)和高级视觉语义编辑(例如 IP 创建、对象旋转和风格转换,允许整体像素变化同时保持语义一致性)。

精确的文本编辑:Qwen-Image-Edit 支持双语(中文和英文)文本编辑,可以直接在图像中添加、删除和修改文本,同时保留原始字体、大小和样式。

强大的基准性能:在多个公开基准上的评估表明,Qwen-Image-Edit 在图像编辑任务中达到了最先进的(SOTA)性能,确立了其作为强大基础模型的地位。

快速安装命令行

在ModelScope开源社区提供的大模型运行环境中,使用以下命令行执行安装:

代码使用示例

从ModelScope开源社区的大模型库,下载阿里云图像编辑大模型Qwen-Image-Edit到本地开发环境中,导入大模型开发依赖库,初始化图像编辑处理器:

设置图像编辑处理器的基本属性参数、设置需要编辑处理的图片输入参数、设置编辑处理图片的提示词需求输入参数:

使用图像编辑处理器执行对图片的编辑处理,输出已编辑完成的图片:

模型部署

在阿里云人工智能业务平台PAI中,查找对应规格的图像编辑大模型:

在图像编辑大模型的详情页面中,点击部署按钮,开始设置部署的属性参数:

在图像编辑大模型的部署的属性参数设置页面中,设置完成,点击部署按钮,开始执行模型部署:

Logo

码道开发者社区,聚焦华为云码道 CodeArts 代码智能体,沉淀 Agent、Skill、鸿蒙开发实战内容,供开发者查阅资料、交流技术、分享工程实践

更多推荐