Comfyui-Qwen-Image-2.1-MultiAngle-T8
Interactive 3D camera and pose studio for Qwen Image 2.1, with TripoSplat reconstruction, DWPose, Depth Anything 3 and Canny guides.

原模型:lilylilith / QI_2.1_AnyAngle · 基础工作流 · 进阶工作流 · English README
效果与定位
| 原创参考图 · image_1 | 新机位粗图 · image_2 | AnyAngle 最终生成图 |
|:---:|:---:|:---:|
| <img src="docs/images/demo-reference.png" width="220" alt="用于演示的原创虚构人物参考图"> | <img src="docs/images/demo-guide.png" width="220" alt="节点实际导出的新机位粗图"> | <img src="docs/images/demo-final-qwen.png" width="220" alt="Qwen Image 2.1 AnyAngle 使用原图与粗图生成的最终图"> |
中图由本节点实际导出,用作 AnyAngle 的机位条件;右图是示例工作流使用原图、中图及 AnyAngle LoRA 实际生成的结果(seed 42、20 步、CFG 3)。示例人物为原创生成的虚构角色。单图重建会推测未见过的侧面与背面,不能保证与原图完全一致。
- 参考图直接连线:左侧
reference_image接收 ComfyUI IMAGE,也支持在工作台上传。 - 原图对应主体:本地 TripoSplat 重建后,拖动相机探索视角;调整机位时保持重建姿势。
- 真正可交互:环绕、中键或 Shift+左键平移、滚轮缩放、精确角度、构图、机位收藏、撤销与重做。
- 三种场景来源:原图重建、带材质 GLB、内置 MakeHuman 手动人偶。人偶资源随仓库安装,无需 Fisher 插件。
- 统一的引导策略:右侧选择粗图、POSE、Depth 或 Canny。DWPose 与 DA3 直接提取原图,Canny 可选原图或三维机位;也支持导入与连线。关闭 AnyAngle 后,底模使用所选结构图与对应提示词。
- 可复用输出:
guide_image_2、prompt、scene_json、anyangle_lora_strength;应用后可直接运行已保存的工作流。
原图重建的 TripoSplat 主体没有可编辑骨架,所以该模式只能调整相机;需要手动摆姿时请选择独立的人偶模式。
三维相机工作台

拖动环绕,中键或 Shift+左键平移,滚轮缩放。重建完成后保持三维交互;点击“预览当前机位粗图”查看无网格的输出。截图展示三维场景模式,四种引导方式统一在右侧选择。
手动人偶工作台

内置人偶支持姿势预设、手势、体型和关节编辑。POSE → 从原图提取姿势默认直接输出照片骨架;全身骨架可再点击“用三维人偶调整姿势”。截图为独立预览页面;从节点打开时,右上角为“应用到节点”。
底模与结构图
在右侧“引导策略”选择 Qwen 底模,节点将 anyangle_lora_strength 输出为 0;切回 AnyAngle LoRA 时输出 1。新版基础和进阶工作流使用随节点提供的“AnyAngle 可选 LoRA”加载器,已把该输出接到 strength_model:强度为 0 时直接透传底模,无需安装 AnyAngle 权重。旧工作流需替换加载器并补上强度连线,或移除 LoRA 加载器;仅切换工作台按钮不会改写旧工作流中固定的强度。
| 底模引导图 | 来源及行为 |
|---|---|
| 三维粗渲染 | 点击“从原图重建 3D”运行 TripoSplat,再预览当前机位的无网格粗图;已有 GLB 或人偶可直接渲染。 |
| POSE 姿势 | DWPose 直接输出原图可见身体、手部和面部骨架,保留原构图;也可导入 Fisher 兼容骨架图。全身骨架可选择三维人偶编辑,输出调整后的机位骨架。 |
| Depth Anything 深度 | 点击“从原图估计深度”运行内置 Depth Anything 3 Small;也可将其他深度节点接到 structure_image,或上传深度 PNG。原图深度属于原机位,不会随相机旋转自动生成新视角深度。 |
| Canny 轮廓 | 默认从原图提取边缘;也可明确选择“从三维机位生成 Canny”,或接入、导入现成轮廓图。 |
原图提取用法:连接 reference_image → 选择 Qwen 底模 → 选择 POSE / Depth / Canny → 点击该模式的原图提取按钮 → 检查中央引导图 → 应用到节点。导出 PNG、输出尺寸和对应提示词均使用当前选中的引导图。
查看原始示例输出:POSE · Depth · Canny。这些是结构条件图,底模的最终生成效果还取决于提示词和采样设置。
重建完成后默认进入可旋转的“3D 工作台”。点击“预览当前机位粗图”查看实际 image_2 输出,也可切回工作台继续调整。原图骨架和深度图直接显示在中央“引导图预览”,保留原机位;半身照片不会自动变成人偶的完整姿势。
reference_image 仍接原图并另接编码器 image_1;guide_image_2 接编码器 image_2。各引导方式会自动生成相应编辑提示词。DWPose 提取的是二维关节位置,遮挡处和肢体前后深度仍需在工作台检查。底模把结构图作为图像参考理解,没有独立的 ControlNet 控制端口;姿势、深度和轮廓的遵循程度取决于底模与提示词,不能保证像专用控制模型一样严格。导入图会按输出尺寸等比留黑边,不会被拉伸。
快速开始
- 按下方说明安装节点与所需模型,重启 ComfyUI,导入 基础工作流。
- 把原图同时接入 Studio 的
reference_image和编码器的image_1。Studio 的guide_image_2接编码器image_2,prompt接prompt,anyangle_lora_strength接“AnyAngle 可选 LoRA”的strength_model。结构图可接structure_image。 - 在 Comfyui-Qwen-Image-2.1-MultiAngle-T8 节点中打开 AnyAngle Studio,等待原图重建;拖动选角,检查右侧粗图,点击 应用到节点,再运行工作流。
Load Image 连线会自动读取;连接其他上游图像节点时,点击“读取上游图像”。批量输入使用第一张。原图重建模式的 0° 是模型预测的原图机位。网格、控制器和取景线不会进入粗图。
基础工作流的起始参数:AnyAngle 模式 LoRA 1 · CFG 3 · 20 步 · euler / simple。默认提示词为:
Change the camera angle from <image2> to <image1>.
进阶工作流包含优化链、提示词拼接和三图拼接,采样设置为 LoRA 1 · CFG 1 · 40 步。它还依赖另外安装的 QwenImage21SpectrumT8、QwenImage21SageAttentionT8、QwenImage21BlockCacheT8、KJNodes、Easy Use 和 Comfyroll;缺少这些节点时请使用基础版。模板不含特定电脑的原图和快照,使用前选择原图并重新应用机位。
安装
在 ComfyUI Manager 中搜索 Comfyui-Qwen-Image-2.1-MultiAngle-T8,选择正式版本安装;Registry 节点 ID 为 qwen-image-21-multiangle-t8。也可使用下方 Git 安装。内置人偶、前端资源与示例工作流随节点分发,模型权重按所用功能另行准备。
Registry 上传成功不等于安全审核通过;查看实时版本状态。管理器中未显示正式版本时,请先使用下方 Git 安装。
需要包含 Qwen Image 2.1、TripoSplat、BiRefNet、DINOv3 原生节点的 ComfyUI;已验证版本为 0.36.0。浏览器需开启 WebGL 硬件加速。在 ComfyUI 目录运行:
cd custom_nodes
git clone https://github.com/T8mars/Comfyui-Qwen-Image-2.1-MultiAngle-T8.git ComfyUI-AnyAngle-Studio-T8
cd ComfyUI-AnyAngle-Studio-T8
python -m pip install -r requirements.txt
python install_assets.py --download-lora
python install_reconstruction.py
节点标题显示完整的 GitHub 仓库名。节点上方的黑色来源标签由 ComfyUI 根据安装目录生成;若直接用含 2.1 的仓库名作文件夹名,当前前端会在小数点处截断为 Comfyui-Qwen-Image-2。使用上面的无点目录名;旧安装可将节点文件夹重命名为 ComfyUI-AnyAngle-Studio-T8,重启 ComfyUI 后来源标签将显示 AnyAngle-Studio-T8。节点类型与工作流连线不变。
仓库已包含 MakeHuman 人偶资源及贴图。install_assets.py --download-lora 会校验资源并下载 AnyAngle LoRA;只用底模时可运行 python install_assets.py,无需下载 LoRA。install_reconstruction.py 下载约 3.78 GB 的重建权重;只用内置人偶或外部结构图时可跳过。DWPose 的两份 ONNX 权重在首次点击“从原图提取姿势”时下载到节点 .local/dwpose/(约 351 MB);若已安装 comfyui_controlnet_aux 及相同权重,会直接复用。Depth Anything 3 Small 在首次点击“从原图估计深度”时下载约 137 MB,可复用已安装在 models/geometry_estimation/ 的相同模型。请使用 ComfyUI 的 Python 环境;整合包用户将 python 换成内置 Python 路径。
按功能准备模型
下表路径相对于 ComfyUI/,<节点目录> 表示实际安装的节点文件夹。
| 功能 | 文件与位置 | 来源 |
|---|---|---|
| AnyAngle 换机位(可选) | models/loras/QI2.1_AnyAngle.safetensors | 原模型 |
| POSE 原图提取 | yolox_l.onnx、dw-ll_ucoco_384.onnx,首次下载至 <节点目录>/.local/dwpose/ | DWPose ONNX 权重 |
| Depth 原图提取 | depth_anything_3_small.safetensors,推荐放入 models/geometry_estimation/ | ComfyUI 适配权重 · DA3 原项目 |
| Canny 轮廓 / 手动人偶 | 无需新增模型权重;Canny 在浏览器计算,人偶资源已包含 | 轮廓实现 · 人偶来源与许可 |
| Qwen Image 2.1 主模型 / Qwen3-VL 8B / VAE | 自行准备,分别放入 models/diffusion_models、models/text_encoders、models/vae | 使用与工作流兼容的底模权重 |
DWPose 优先复用 custom_nodes/comfyui_controlnet_aux/ckpts/yzd-v/DWPose/ 中的上述两个文件;否则使用节点自身缓存。DA3 优先读取 models/geometry_estimation/;若未放置权重,首次点击会下载到 <节点目录>/.local/da3/geometry_estimation/depth_anything_3_small.safetensors。内置深度提取使用 Small;其他 DA3 变体可在外部节点生成后接入 structure_image。
原图三维重建还需下列 5 个文件,均来自 TripoSplat 官方权重包,python install_reconstruction.py 会下载到对应位置:
| 文件 | ComfyUI 目录 |
|---|---|
| triposplat_fp16.safetensors | models/diffusion_models/ |
| birefnet.safetensors | models/background_removal/ |
| dino_v3_vit_h.safetensors | models/clip_vision/ |
| flux2-vae.safetensors | models/vae/ |
| triposplat_vae_decoder_fp16.safetensors | models/vae/ |
示例工作流中的模型名需替换为本机已有的兼容权重。AnyAngle 和 TripoSplat 权重由安装命令下载;DWPose 与 Depth Anything 3 仅在点击对应功能时下载。姿势与深度推理、重建和渲染在本地完成。
若旧版安装提示 MakeHuman asset: HTTP 404,在节点目录执行 git pull,确认 web/vendor/assets/pose_studio_makehuman.v2.bin 与 web/vendor/textures/skin.png 存在,重启 ComfyUI 并强制刷新浏览器。文件缺失时运行 python install_assets.py 补齐。
保存、迁移与限制
- 场景、粗图和资产保存在
ComfyUI/input/anyangle_studio/。迁移工作流时需一同复制相关资产;API 工作流 需填入已应用的快照。 - 本机缺少工作流中的快照时,工作台会恢复为空白场景,仍可读取原图、重建或导入主体。重新应用后再运行工作流;权限或服务器错误会单独显示。
- GLB 需内嵌纹理;不支持 Draco、Meshopt、KTX2 压缩。GLB 正面校准只用于导入的 GLB,原图重建模式请使用相机角度与构图控制。
- 单图重建无法精确恢复遮挡、画外身体或完整背景。粗图尺寸与下游生成分辨率分别设置。
- 已在 RTX 5090 Laptop 24 GB 上验证;其他硬件需按本机模型及分辨率调整。
网络访问
节点接口使用 ComfyUI 服务器的访问边界,没有独立登录功能。本机使用 ComfyUI 默认的 --listen 127.0.0.1;局域网或云端使用需通过受信网络、VPN 或带身份验证的反向代理访问,并保护整个 ComfyUI 服务(包含 /anyangle-studio/*)。请勿直接将未经身份验证的端口暴露到公网;仅限制客户端 IP 为回环地址不能替代登录验证。
致谢与许可
感谢 AnyAngle、TripoSplat、Fisher Pose、VNCCS 与 GaussianSplats3D。本项目为独立集成,并非原模型官方插件。
项目代码采用 MIT 许可;第三方代码、资产与模型遵循各自许可,详见 来源说明。
T8 链接
B站 · YouTube · Hugging Face
API 服务 · 免费画廊 · 在线 AI 应用 · ComfyUI 整合包