新闻详情

新闻详情

首页 / 资讯中心 / 详情

OOTDiffusion:一条命令试穿衣服,一次跑出 4 张候选图

发布时间:2026/9/24 23:19:37来源:尧图网络
OOTDiffusion:一条命令试穿衣服,一次跑出 4 张候选图
OOTDiffusion一条命令试穿衣服一次跑出 4 张候选图【免费下载链接】OOTDiffusion[AAAI 2025] Official implementation of OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on项目地址: https://gitcode.com/GitHub_Trending/oo/OOTDiffusion网购下单前你总得在脑子里想象衣服上身后的样子OOTDiffusion 用生成的虚拟试穿图像替代这种想象。它只需一张模特图和一张服装图一次运行就能输出 4 张候选试穿图默认 20 步去噪。这是 AAAI 2025 论文 Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on 的官方开源实现半身与全身两套模型权重均已放出。下面是使用教程从克隆仓库到看到图像只需跑通 4 行命令。一句话定位OOTDiffusion 是基于服装融合Outfitting Fusion的潜空间扩散虚拟试穿模型给定人物照片和服装图片生成该人物穿上该服装的照片。先看效果OOTDiffusion 试衣结果图中同一模特穿上不同服装全部由项目生成服装的颜色、图案、领型跟随服装图人物的姿态与面貌来自模特图。跑起来 OOTDiffusion最小命令集环境要求一行带过Linux官方仅在 Ubuntu 22.04 测试过、NVIDIA GPU、Python 3.10。git clone https://gitcode.com/GitHub_Trending/oo/OOTDiffusion conda create -n ootd python3.10 conda activate ootd pip install torch2.0.1 torchvision0.15.2 torchaudio2.0.2 pip install -r requirements.txt cd OOTDiffusion/run python run_ootd.py --model_path examples/model/01008_00.jpg --cloth_path examples/garment/00055_00.jpg --scale 2.0 --sample 4运行前需先把 ootd、humanparsing、openpose、clip-vit-large-patch14 四组权重放进checkpoints/目录说明见 checkpoints/README.txt。预期输出run_ootd.py 会在run/images_output/写出out_hd_0.png到out_hd_3.png四张 PNG外加一张展示换衣区域的mask.jpg。命令中的两张示例图就在仓库run/examples/里可直接照跑。两个 checkpoint 怎么选hd 与 dc半身模型hd默认不用加参数在 VITON-HD 数据集上训练只支持上衣类服装--category必须为 0脚本会直接报错拦截其他取值。全身模型dc在 Dress Code 数据集上训练支持上衣、下装、连衣裙三类运行时加--model_type dc --category 0/1/20上衣1下装2连衣裙。README 明确要求类别必须与服装实际类型配对否则换衣区域会错。不想记参数的话可以起本地网页界面 gradio_ootd.pypython gradio_ootd.py浏览器打开http://127.0.0.1:7865上下两个区域分别对应 hd 与 dc 模型每侧都提供了仓库自带的示例图可点选也可上传自己的图dc 区域有一个服装类别下拉框是必填项。该脚本会在 GPU 0 与 GPU 1 上各加载一套模型。影响出图的 4 个参数run_ootd.py暴露的四个参数各有明确作用--scale是服装特征引导强度默认 2.0网页界面给出的可调范围是 1.0–5.0--step是去噪步数默认 20界面范围 20–40--sample是每次运行的候选图数量1–4--seed是随机种子-1表示每次不同。要对比同一输入在不同参数下的差异时固定--seed即可保证可比。OOTDiffusion 管线从解析到去噪生成图像前两个预处理器先把人物标出来OpenPose 检测姿态关键点人体解析preprocess/humanparsing/下的 onnx 模型把人物分成上衣、手臂、腿等 18 个类别utils_ootd.py 把两者结合算出待换装的区域掩码并盖在原图上。生成阶段CLIP 视觉编码器CLIP 是一种同时理解图像与语义的预训练编码器提取服装图特征作为引导定制的 OotdPipeline 用两个 UNetunet_garm 处理服装、unet_vton 处理人物在去噪过程中完成服装融合最后由 VAE 把潜码解码回图像。常见坑与调优权重没放对位置模型加载路径硬编码在../checkpoints/...克隆后第一件事就是把 ootd、humanparsing、openpose、clip-vit-large-patch14 放进checkpoints/缺一项首次启动就会失败。服装类别没配对dc模型要求--category与图片类型一致0 上衣 / 1 下装 / 2 连衣裙给连衣裙传 0 会导致换衣区域错误网页界面里这一项也被标注为重要选项。单卡跑不了网页版gradio_ootd.py需要两块卡同时加载 hd 与 dc 模型只有一张卡时用命令行模式分别跑hd或dc即可。调参入口想让颜色、图案更贴服装动--scale1.0–5.0默认 2.0想更充分地还原细节把--step提到 20–40一次要多看几种效果用--sample 4。适合谁与局限适合购买前想看自己照片上特定服装效果的用户Linux NVIDIA GPU 环境官方测试环境为 Ubuntu 22.04想快速接入虚拟试穿功能的开发者推理代码模块化可直接引用 ootd/inference_ootd.py不适合不想碰 WSL 的 Windows 用户期望试穿鞋、帽、配饰的场景仅支持上衣、下装、连衣裙三类商业集成项目采用 CC BY-NC-SA 4.0 许可证不允许商业用途需要用自有数据继续训练的场景README 的 TODO 显示训练代码尚未放出下一步README.md安装步骤与两种推理命令checkpoints/README.txt需要下载的四组权重清单run/示例图片与运行目录全部脚本OOTDiffusion 目前提供的是从人物图 服装图到试穿图的完整推理链路第一步是把四组权重下全用仓库自带示例图跑通一次。【免费下载链接】OOTDiffusion[AAAI 2025] Official implementation of OOTDiffusion: Outfitting Fusion based Latent Diffusion for Controllable Virtual Try-on项目地址: https://gitcode.com/GitHub_Trending/oo/OOTDiffusion创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
网站建设高端定制企业官网
RELATED

相关资讯

更多精彩内容,欢迎继续阅读

较早相关资讯

最新相关资讯

汽车电子底层软件开发:AUTOSAR与CAN总线实战解析 2026/9/24 23:59:54

汽车电子底层软件开发:AUTOSAR与CAN总线实战解析

1. 这门“汽车电子底层软件开发就业课”到底在教什么?——不是写个LED闪烁就能上岗的很多人看到“汽车电子底层软件开发就业课”这个标题,第一反应是:不就是嵌入式C语言单片机CAN通信?刷几道LeetCode、调通一个STM32 CAN收发例程&…

阅读更多 →
Vim基础操作全攻略:保存退出、模式切换与高频命令实战 2026/9/24 23:59:54

Vim基础操作全攻略:保存退出、模式切换与高频命令实战

1. 项目概述1.1 核心需求解析今天聊聊Vim。写这个题目的原因是:几乎每个后端开发者、运维人员、数据工程师某天都会遇到一个场景——深夜加班,服务器登录界面只有黑底白字,编辑器只有vi/vim,你必须在五分钟内完成一次配置修改并保…

阅读更多 →
Python+CNN车牌识别实战:从数据预处理到模型训练与部署 2026/9/24 23:59:54

Python+CNN车牌识别实战:从数据预处理到模型训练与部署

简介:基于Python与卷积神经网络的车牌识别项目,面向计算机视觉初学者及智能交通开发者,目标是帮助用户掌握从数据预处理、模型构建到实际部署的完整流程。压缩包共25个文件,包含jpg/png图像样本、py训练脚本、md说明文档、dat数据…

阅读更多 →
AI元人文:从工具使用到思维重构的深度探索 2026/9/24 23:59:54

AI元人文:从工具使用到思维重构的深度探索

最近半年我一直在琢磨一件事:AI元人文到底是什么?说白了,就是“用元视角重新审视人与AI的关系”,也在“探索AI如何反向逼着我们发现自己的思考边界”。标题里的“元探索”,在我看就是一层套一层的追问——当你用AI解决…

阅读更多 →
《AI Agent 场景应用 - MobileOpenClaw》第5-9节:会话上下文细化处理实战指南 2026/9/24 23:59:47

《AI Agent 场景应用 - MobileOpenClaw》第5-9节:会话上下文细化处理实战指南

文档教程后端 【免费下载链接】CodeGuide :books: 本代码库是作者小傅哥多年从事一线互联网 Java 开发的学习历程技术汇总,旨在为大家提供一个清晰详细的学习教程,侧重点更倾向编写Java核心内容。如果本仓库能为您提供帮助,请给予支持(关注、…

阅读更多 →
写出来的,和没写的——七个模块,一副骨头 2026/9/24 23:59:47

写出来的,和没写的——七个模块,一副骨头

「合金日记」第 85 篇 「小艾说」第 34 期 幕后弧(换弧开篇) 从「写谁」转向「怎么写」 专栏连载中 前篇:《听漏了,还是听深了——一个 a,一句禅》 模块 骨架 沉默 对位 骨头 没看过前篇也能读 没看过前八十…

阅读更多 →

今日资讯

本周资讯

本月资讯

看完文章仍有疑问?

联系尧图顾问,获取一对一建站咨询

立即免费咨询 📞 400-888-8888
📞