场景转视角安装指南

让同一个场景能生成真正换机位的画面(比如圆桌对面的反打),而不只是同一面墙换取景。

这是可选的进阶功能,不装也能正常用 Octopus。 默认的 Seedream 方案零配置、开箱即用,只是做不出真 180° 反打。

一、先想清楚要不要装

方案效果要求
Seedream(默认)同一空间换取景、机位高度,但朝向同一面墙零配置
Qwen 多角度(本文)真 180° 反打 / 换机位本地 N 卡 + ComfyUI + 约 30GB 模型

建议:只想出片 → 不用装;要拍对话戏、需要正反打,且有 12GB 以上显存的 N 卡 → 值得装。

硬件底线:NVIDIA 显卡,显存 12GB 起(16GB+ 更稳,24GB 最舒服)。 A 卡 / 核显 / Mac 暂不支持。

二、装 ComfyUI

去官网下 Windows 一键包:comfy.org/download

装完先启动一次,确认浏览器能打开 http://127.0.0.1:8188,然后关掉去下模型。

显存不足 16GB 的话等下要用 GGUF 版模型,需要在 ComfyUI 里装个插件: Manager → Custom Nodes → 搜 ComfyUI-GGUF → 安装 → 重启

三、下模型

点下面的链接直接去下载页。务必按表放进对应文件夹 —— 放错目录是最常见的失败原因。 国内下载慢可以把网址里的 huggingface.co 换成 hf-mirror.com

必装(4 个)

文件下载放到 ComfyUI 的大小
qwen_image_edit_2511_fp8mixed.safetensors Comfy-Org/Qwen-Image-Edit_ComfyUI ↗ models/diffusion_models/~20GB
qwen_2.5_vl_7b_fp8_scaled.safetensors Comfy-Org/Qwen-Image_ComfyUI ↗ models/text_encoders/~8GB
qwen_image_vae.safetensors 同上 · vae ↗ models/vae/~250MB
qwen-image-edit-2511-multiple-angles-lora.safetensors fal/…Multiple-Angles-LoRA ↗ models/loras/295MB
最后那个多角度 LoRA 是关键,没它就没有“换机位”的能力。

强烈推荐:提速 3–5 倍

文件下载放到大小
Qwen-Image-Edit-2511-Lightning-8steps-V1.0-bf16.safetensors lightx2v/…Lightning ↗ models/loras/850MB

不加:一张图 40–70 秒。加了:10–20 秒

显存不够 20GB:换 GGUF 量化版

不下上面第一个 20GB 的 fp8,改下量化版(其余 3 个照下):

显存文件放到大小
16GBqwen-image-edit-2511-Q5_K_M.ggufmodels/unet/14.9GB
12GBqwen-image-edit-2511-Q4_K_S.ggufmodels/unet/12.1GB

下载:QuantStack/Qwen-Image-Edit-GGUF ↗unsloth/…GGUF ↗

GGUF 必须放 models/unet/(不是 diffusion_models),且要先装 ComfyUI-GGUF 插件。
别选 Q8_0(21.8GB)—— 它和文本编码器挤不下,反而更慢。

四、在 Octopus 里打开

模型下完、ComfyUI 保持运行(http://127.0.0.1:8188 能打开),然后:

  1. 系统设置 → 本地 ComfyUI ——「ComfyUI 地址」保持 http://127.0.0.1:8188, 点 「测试 ComfyUI 连接」,显示已连接 + 你的显卡型号 = 通了。
  2. 系统设置 → 图片生成 ——「场景机位板生成器」选 「Qwen 多角度(本地 ComfyUI·真换机位)」
  3. 重跑美术(老项目要重跑才生效)。

五、常见问题

测试连接失败

确认 ComfyUI 正在运行、浏览器能打开 http://127.0.0.1:8188。 如果 ComfyUI 装在 WSL 或另一台机器,把设置里的地址改成对应 IP。

生成很慢,一张要好几分钟

八成是没装 Lightning LoRA,或显存不够在跑 lowvram。装上 Lightning、或换更小的 GGUF 量化版。

出来的图还是没换机位

Octopus 有兜底:Qwen 失败会自动回退 Seedream,不会卡住出片。所以看到“没换机位”通常是回退了 —— 去 ComfyUI 那边看有没有报错(缺模型、显存不够)。

反打的画面细节不对

反打属于“新视角合成”,模型看不见的地方靠脑补,空场景、简单构图效果最好。 Octopus 正是先出空场景机位板、再把角色融进去,就是为了避开这个问题。人多、遮挡重的镜头容易露馅。

能同时跑视频生成吗

尽量别 —— 两个都吃显存会互相挤。出机位板时先别跑本地视频。

不想用了怎么关

系统设置 → 图片生成 → 场景机位板生成器 → 切回 Seedream

六、进阶:用自己的工作流

Octopus 自带了一份转视角工作流,一般不用管。想自己调质量/步数/LoRA 强度的话: 在 ComfyUI 里改好参数 → 导出为 API 格式(保存(API格式))→ Octopus 系统设置 → 本地 ComfyUI → 转视角工作流(.json) 填你的文件路径。

Octopus 是运行时读这个文件的,所以在 ComfyUI 调完重新导出,下次生成就用新参数,不用重启。

工作流里必须有 LoadImage(喂原图)、KSampler、 正向 CLIPTextEncode(写角度提示词)这几个节点,Octopus 按节点类型自动定位并填参数。