Qwen-Image-2.1 本機部署:顯存需求與 ComfyUI、Unsloth 設定
Qwen-Image-2.1 的視覺生成主體是 7B,但推論還會載入 Qwen3-VL 8B 編碼器、VAE 和影像工作空間;「7B」不是實際顯存需求。想在本機出第一張圖,先看顯卡記憶體,再選量化版本和工作流程。
快速選擇: Unsloth 官方列出的起點是 12–16GB VRAM 使用 GGUF Q4_K_M、1024×1024、batch 1;24GB VRAM 可從 INT8/FP8 的 512×512 開始,或用 Q4_K_M 跑 1024×1024。6GB VRAM 也有 FP8 加 CPU offload 的配置,但需要更多系統記憶體,而且會變慢。這些是估算,不是保證可用的最低規格。
先依硬體選量化版本
下表整理自 Unsloth 的 Qwen-Image-2.1 本機執行指南。記憶體會隨解析度和 offload 設定改變,先用小圖、單張生成確認,再逐步提高畫質設定。
| 可用硬體 | 建議起點 | 使用時要知道的事 |
|---|---|---|
| 12–16GB 顯卡記憶體 | GGUF Q4_K_M、1024×1024、batch 1 | Unsloth 文件提供的入門組合;GGUF 同時需要文字編碼器和 VAE。 |
| 24GB 顯卡記憶體 | INT8/FP8 從 512×512 開始;或 Q4_K_M 使用 1024×1024 | FP8/INT8 佔用記憶體較多;先用較小畫布確認載入成功。 |
| 6GB 顯卡記憶體 | FP8 搭配 CPU offload | 文件列出這種低顯存跑法,但 offload 會用系統 RAM、降低速度;不要把它當成 6GB 顯卡一定能順跑的承諾。 |
| Apple Silicon 12–16GB 以上統一記憶體 | GGUF 與相容的原生後端 | 先確認所用應用程式支援該模型格式;統一記憶體不代表任何工作流程都能直接載入。 |
| CPU、12–16GB RAM | GGUF Q4_K_M 搭配 Q4_K_XL 文字編碼器 | 可作為測試起點,速度和實際可用性依 CPU、RAM 與解析度而變。 |
量化檔的容量不是執行時所需記憶體。生成解析度會增加暫存需求,CPU offload 會把部分計算移到系統記憶體;硬碟也要預留模型與輸出圖片空間。官方特別註明表格是估算值,並非經所有硬體測得的最低門檻。
用 Unsloth Desktop 快速生成文字圖片
如果目標是先試文生圖,Unsloth 的介面流程比手動拼模型檔簡單。官方指南目前在 Qwen-Image-2.1 的快速設定段落列出文字生成圖片流程:
- 從 Unsloth 官方下載頁安裝桌面版,依作業系統選擇 macOS、Windows 或 Linux。
- 開啟 Images,選 Create,再從模型選擇器搜尋 Qwen-Image-2.1。
- 依前面的硬體表選 GGUF 或 FP8 量化版本,等待模型下載完成。
- 第一次先用 1024×1024、單張輸出和預設設定生成;第一張圖會多花時間下載與載入模型。
模型下載完後,生成會在本機執行。若載入失敗,先檢查硬碟空間、網路是否中斷,以及模型是否需要在 Hugging Face 接受授權;如果是記憶體不足,降低解析度、改用較小量化版本或啟用 CPU offload。
需要圖片編輯時改用 ComfyUI 官方工作流
Qwen 官方倉庫提供 ComfyUI 文生圖範本和圖片編輯範本。如果你要用參考圖片做局部修改、多張參考圖,或自行調整生成節點,這條路比較合適。
先更新 ComfyUI,從範本瀏覽器載入官方 Qwen-Image-2.1 工作流。再從 Comfy-Org 的模型倉庫下載範本指定的檔案,放到對應目錄:
models/diffusion_models/:qwen_image_2.1_int8_convrot.safetensorsmodels/text_encoders/:qwen3vl_8b_int8_convrot.safetensorsmodels/vae/:qwen_image_2.1_vae_bf16.safetensors
範本也列出 BF16 版本的 diffusion model 和文字編碼器;下載前先對照工作流內的模型檔名,避免 INT8 工作流卻載入 BF16 權重。檔案放好後重新啟動或重新掃描模型,再載入範本。Qwen 官方說明模型原生支援 2K 輸出、透明背景和最多 10 張參考圖片;透明背景要確認工作流保留 RGBA alpha channel,支援 2K 也不代表低記憶體顯卡適合一開始就用 2K。
OOM 時先降解析度,不要只減少步數
顯存不足時可以依序檢查:
- 把畫布降到 1024×1024 或更小,並將 batch 設為 1。
- 確認 diffusion model、文字編碼器和 VAE 的檔名及資料夾都符合工作流。
- 若仍然 OOM,改用較小的量化版本,或啟用 CPU offload 並確認系統 RAM 足夠。
減少生成步數主要是縮短等待時間,不一定能解決模型載入或高解析度造成的記憶體不足。ComfyUI 官方範本的 CFG 預設為 1;在這個設定下,negative prompt 不會生效,初次測試先保留範本預設值,避免同時改動太多變數。
本文依 Qwen、Unsloth 與 ComfyUI 官方文件整理,查核日期為 2026-09-24;沒有在本機 GPU 上下載權重或執行推論,因此文中的硬體組合是官方估算與工作流設定,不是作者實測結果。若你要在商用專案使用權重,請先讀 Qwen Research License Agreement。
參考資料: