Model
Trends
.ai
Model
Trends
.ai
những mô hình AI mã nguồn mở tốt nhất

Lỗi ComfyUI và cách sửa: nút đỏ, thiếu mô hình, hết bộ nhớ CUDA

Chủ đề: Lỗi và cách khắc phục
Bởi Captain
Đăng ngày 2026-05-12
Share

Tổng quan

ComfyUI
báo lỗi ở hai chỗ: nút đỏ trên canvas trước khi bạn nhấn Run, và hộp thoại lỗi đỏ (có traceback dài trong terminal) khi một nút bị lỗi trong lúc chạy. Nút đỏ thường là do thiếu nút tùy chỉnh hoặc thiếu file. Lỗi khi chạy thường là do bộ nhớ, mô hình đặt sai bộ tải, hoặc gói Python không khớp với torch đã cài. Hướng dẫn này liệt kê các thông báo theo thứ tự mọi người gặp, kèm nguyên nhân và cách sửa nhanh nhất.
Mọi cách sửa dưới đây đều giả định bạn dùng bản Windows portable hoặc cài chuẩn qua git với ComfyUI Manager. Nếu bước nào nói "update", dùng nút Update All trong Manager, hoặc git pull trong thư mục ComfyUI rồi chạy pip install -r requirements.txt trong môi trường Python mà ComfyUI đang chạy (python_embeded\python.exe -m pip với bản portable).
Khi workflow cần GPU nhiều hơn bạn có, thay vì cố gắng sửa lỗi, bạn có thể chạy cùng đồ thị trên GPU được host:
BitVector
có sẵn hàng trăm workflow ComfyUI với mô hình và nút đã cài,
PirateDiffusion
chạy workflow host từ Telegram với lệnh /wf /run:name. Cả hai đều được liệt kê trên trang Apps của site này.

Tham khảo

Tên
Kiểu
Ý nghĩa
Nút đỏ với tiêu đề màu đỏ
symptom
Một nút tùy chỉnh mà workflow dùng chưa được cài. Manager > Install Missing Custom Nodes sẽ tìm và cài từ file JSON của workflow.
Prompt outputs failed validation
error
Một bộ tải trỏ tới file không có trong thư mục models của bạn, hoặc giá trị widget vượt phạm vi. Mở nút được nhắc trong thông báo và chọn file trong danh sách.
torch.cuda.OutOfMemoryError / Allocation on device
error
Mô hình, latent và activations không vừa
VRAM
. Giảm độ phân giải hoặc batch, dùng độ chính xác nhỏ hơn (fp8, GGUF) hoặc thêm --lowvram.
mat1 and mat2 shapes cannot be multiplied
error
Sai loại mô hình trong bộ tải:
LoRA
SDXL
trên
checkpoint
SD 1.5
,
Flux
VAE trên đồ thị SDXL, hoặc bộ mã hóa văn bản không cùng dòng.
Error while deserializing header: HeaderTooLarge / MetadataIncompleteBuffer
error
File .safetensors bị thiếu hoặc hỏng. Tải lại và so sánh kích thước hoặc hash với trang nguồn.
ERROR: Could not detect model type
error
Một LoRA, VAE hoặc
ControlNet
được tải bằng Load Checkpoint, hoặc file không phải mô hình diffusion. Dùng bộ tải phù hợp với loại file.
xformers / torch version mismatch, DLL load failed
error
Gói cài cho bản torch khác. Cài lại torch, torchvision và xformers cùng phiên bản CUDA, hoặc gỡ xformers.
CLIPTextEncode: expected ... got ...
error
Bộ mã hóa văn bản không khớp mô hình (Flux cần clip_l và t5xxl, SDXL có hai bộ riêng,
Qwen
và
Wan
có bộ riêng).
Value not in list: ckpt_name
error
Workflow lưu với tên file của người khác. Chọn file của bạn trong danh sách; Manager cũng có thể ánh xạ tên phổ biến.
Server disconnected / reconnecting
symptom
Quá trình Python bị crash, thường do hết RAM hệ thống khi tải mô hình lớn. Xem terminal và theo dõi Task Manager lúc tải.
AD
Không cần cài đặt – chạy mô hình AI trên đám mây
BitVector Prism là cách dễ nhất để bắt đầu: chọn một mô hình, nhập prompt và tạo ảnh trong một ứng dụng web gọn gàng, không cần cấu hình gì. BitVector cũng có trên Discord và trên web (SpyGlass).

Từng bước

  1. Đọc terminal, không chỉ hộp thoại. Dòng cuối trước Traceback cho biết nút và file; dòng đầu traceback có thư mục custom_nodes cho biết phần mở rộng bị lỗi.
  2. Xử lý nút đỏ trước: mở Manager, nhấn Install Missing Custom Nodes, cài hết, rồi Restart. Sau khi khởi động lại, làm mới tab trình duyệt.
  3. Xử lý thiếu file: với mỗi bộ tải có viền đỏ hoặc thông báo "Value not in list", mở danh sách chọn file bạn có, hoặc tải file workflow yêu cầu vào đúng thư mục (models/checkpoints, models/loras, models/vae, models/clip, models/unet hoặc diffusion_models, models/controlnet).
  4. Kiểm tra dòng của mỗi file trong đồ thị: checkpoint, LoRA, VAE, bộ mã hóa văn bản và ControlNet phải cùng dòng. Trang mô hình trên site này ghi rõ dòng ở đầu; trộn lẫn gây lỗi hình dạng.
  5. Lỗi bộ nhớ: giảm batch size một nửa, hạ độ phân giải về kích thước gốc của dòng (512 cho SD 1.5, 1024 cho SDXL và Flux), chuyển mô hình sang phiên bản fp8 hoặc GGUF, và khởi động ComfyUI với --lowvram hoặc --novram nếu vẫn lỗi. VAE Decode Tiled thay cho decode bình thường với ảnh lớn.
  6. Lỗi gói: chạy script cập nhật của bản bạn dùng (update_comfyui_and_python_dependencies.bat với bản portable), hoặc pip install -r requirements.txt trong môi trường đúng. Nếu có xformers, gỡ nó; ComfyUI dùng PyTorch attention không cần xformers.
  7. Vẫn lỗi: khởi động ComfyUI với --disable-all-custom-nodes. Nếu workflow chạy được, bật lại phần mở rộng từng nửa trong Manager để tìm phần xung đột.
  8. Khi phần cứng là giới hạn, chạy workflow host thay vì local: mở workflow đó trên BitVector, hoặc PirateDiffusion với /workflow /show:name và /wf /run:name, giữ setup local cho những gì vừa.

Ví dụ

Khởi động với VRAM thấp trên bản portable

.\python_embeded\python.exe -s ComfyUI\main.py --windows-standalone-build --lowvram --use-pytorch-cross-attention

Cài lại torch cho CUDA 12.4 trong Python nhúng

.\python_embeded\python.exe -m pip uninstall -y torch torchvision torchaudio xformers
.\python_embeded\python.exe -m pip install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu124

Tìm phần mở rộng gây crash

python main.py --disable-all-custom-nodes
# runs? then re-enable extensions in Manager, half at a time

Mẹo

  • Giữ một thư mục chứa mô hình và trỏ mọi UI tới đó bằng extra_model_paths.yaml, để ComfyUI,
    Forge
    và A1111 dùng chung file và bạn chỉ tải mỗi checkpoint một lần.
  • Đặt tên file theo dòng khi lưu (flux-, sdxl-, sd15-) để dễ nhận biết khi chọn file không khớp.
  • Chức năng "Fix node (recreate)" của Manager trên nút đỏ thường sửa workflow lưu từ phiên bản cũ của phần mở rộng.
  • Phiên bản GGUF của Flux, Wan hoặc Qwen (bộ tải Unet từ ComfyUI-GGUF) chạy trên card 8 đến 12 GB gần như không mất chất lượng ở Q8 và mất ít ở Q5.
  • Đặt file trang của Windows thành quản lý hệ thống trên SSD còn trống 40 GB: tải mô hình lớn làm RAM hệ thống tăng cao, file trang nhỏ gây crash server không báo.
  • Cập nhật ComfyUI trước rồi mới cập nhật nút tùy chỉnh, không làm ngược lại; lõi thay đổi trước rồi phần mở rộng theo sau.
  • Workflow từ hướng dẫn trên site này liệt kê file cần trong Inputs; tải trước khi mở file JSON.

Khắc phục sự cố

Nhiều hộp đỏ sau khi tải workflow tải về

Vì sao xảy ra
Workflow dùng nút tùy chỉnh bạn chưa có.

Cách sửa
Manager > Install Missing Custom Nodes, cài hết, Restart, tải lại tab trình duyệt.

Prompt outputs failed validation: ckpt_name không có trong danh sách

Vì sao xảy ra
Tên file checkpoint trong workflow không có trong thư mục của bạn.

Cách sửa
Chọn file của bạn trong Load Checkpoint, hoặc tải file hướng dẫn chỉ vào models/checkpoints rồi nhấn R để làm mới danh sách.

Hết bộ nhớ CUDA tại KSampler

Vì sao xảy ra
Độ phân giải, batch size hoặc độ chính xác mô hình vượt quá card.

Cách sửa
Độ phân giải gốc, batch 1, trọng số fp8 hoặc GGUF, --lowvram. Với video, giảm số khung hình trước, rồi tăng bước.

Hết bộ nhớ CUDA tại VAE Decode

Vì sao xảy ra
Giải mã latent lớn cần bộ nhớ nhiều hơn lúc lấy mẫu.

Cách sửa
Thay VAE Decode bằng VAE Decode (Tiled), kích thước ô 512, hoặc thêm --fp16-vae / --bf16-vae.

mat1 và mat2 shapes không thể nhân (2x2048 và 768x320)

Vì sao xảy ra
LoRA hoặc bộ mã hóa SDXL trong đồ thị SD 1.5, hoặc ngược lại.

Cách sửa
Đảm bảo mọi LoRA, VAE và bộ mã hóa cùng dòng với checkpoint. Kiểm tra dòng trên trang mô hình trước khi tải.

Lỗi khi giải tuần tự header

Vì sao xảy ra
Tải xuống bị dừng sớm hoặc file không phải
safetensors
.

Cách sửa
Xóa và tải lại; so sánh kích thước file với trang nguồn. Dùng trình quản lý tải cho file trên 5 GB.

ImportError / DLL load failed sau cập nhật

Vì sao xảy ra
torch, torchvision hoặc xformers được cập nhật không khớp.

Cách sửa
Gỡ ba gói rồi cài lại cùng lúc từ chỉ mục PyTorch cho phiên bản CUDA của bạn; bỏ xformers nếu lỗi tiếp.

Flux hoặc Wan tải lâu rồi server chết

Vì sao xảy ra
RAM hệ thống, không phải VRAM, hết khi đọc trọng số.

Cách sửa
Đóng chương trình khác, tăng file trang, tải phiên bản fp8 hoặc GGUF, hoặc dùng bản host trên BitVector hoặc PirateDiffusion.

AD
PirateDiffusion
Không cần cài đặt – chạy mô hình AI trên đám mây
PirateDiffusion chỉ có trên Telegram và dành cho người dùng chuyên nghiệp: hàng nghìn mô hình, LoRA và workflow điều khiển bằng lệnh chat, tạo không giới hạn với gói giá cố định.

Câu hỏi

File nào vào thư mục nào?

Checkpoint vào models/checkpoints, LoRA vào models/loras, VAE vào models/vae, bộ mã hóa văn bản vào models/clip (hoặc models/text_encoders), mô hình diffusion trần như
Flux dev
vào models/unet hoặc models/diffusion_models, ControlNet vào models/controlnet, bộ phóng to vào models/upscale_models.

Cần bao nhiêu VRAM?

SD 1.5 chạy trên 4 GB, SDXL trên 8 GB, Flux dev fp8 trên 12 GB (GGUF Q5 trên 8 GB),
Qwen-Image
và
Wan 2.2
14B trên 16 đến 24 GB với fp8 hoặc GGUF,
HunyuanVideo
trên 24 GB. Bảng VRAM có trên site này.

Có chạy workflow không GPU được không?

Có, trên dịch vụ host: BitVector chạy workflow ComfyUI của site này trên GPU đám mây, PirateDiffusion chạy workflow host từ Telegram. Không cần cài gì.

Tại sao workflow giống nhau lại chạy được trên máy người khác?

Tên file khác, phiên bản nút tùy chỉnh khác, hoặc card mạnh hơn. So sánh danh sách Inputs của hướng dẫn với thư mục của bạn trước tiên.

--lowvram có làm chậm không?

Có, vừa phải: nó chuyển phần mô hình giữa RAM hệ thống và VRAM. Vẫn nhanh hơn crash. --novram chậm hơn nữa, dành cho card 4 GB.

Cập nhật an toàn thế nào?

Sao lưu thư mục custom_nodes, cập nhật ComfyUI trước, rồi Update All trong Manager. Nếu lỗi, đổi lại thư mục cũ.

Liên kết và nguồn

Mô hình trong hướng dẫn này

Người viết
Captain

Hướng dẫn liên quan

Lỗi và cách khắc phục
Lỗi và cách sửa Automatic1111 (Stable Diffusion WebUI)
Cách sửa các lỗi Stable Diffusion WebUI thường gặp khiến nhiều lần cài đặt bị dừng: "Torch không thể dùng GPU", NansException, CUDA hết bộ nhớ, "Không thể cài torch", xformers, "Không tải được mô hình Stable diffusion", các tiện ích mở rộng bị lỗi sau khi cập nhật, và các vấn đề riêng với SDXL.
Bởi Captain
2026-05-14
Lỗi và cách khắc phục
Lỗi và cách sửa Stable Diffusion WebUI Forge (Flux, SDXL, VRAM thấp)
Các vấn đề riêng của Forge và cách khắc phục: Flux không tải được hoặc ra nhiễu, chuyển đổi kiểu giao diện (sd / xl / flux), thanh trượt "GPU Weights" và lỗi hết bộ nhớ, thiếu bộ mã hóa văn bản và VAE cho Flux, lỗi ControlNet và các extension, và sự khác biệt so với Automatic1111 gây khó hiểu cho người dùng.
Bởi Captain
2026-05-16
Lỗi và cách khắc phục
CUDA hết bộ nhớ: mỗi mô hình AI cần bao nhiêu VRAM và cách để vừa vặn
Bảng VRAM cho SD 1.5, SDXL, Flux, FLUX.2, Qwen-Image, Z-Image, Wan 2.2 và HunyuanVideo, cùng các kỹ thuật giúp mô hình vừa vặn: lượng tử hóa fp8 và GGUF, chuyển tải CPU, VAE chia ô, giới hạn độ phân giải và số khung hình, và khi nào nên ngừng cố gắng và chạy trên dịch vụ lưu trữ.
Bởi Captain
2026-05-18
ComfyUI
Các nút ComfyUI: tài liệu và khắc phục sự cố
Tài liệu bằng ngôn ngữ đơn giản cho các nút ComfyUI mà mọi người dùng nhiều nhất: mỗi nút làm gì, mọi đầu vào và đầu ra, cách kết nối, các cài đặt quan trọng, và các lỗi nó gây ra cùng cách sửa từng lỗi.
Bởi Captain
2026-06-02
Ứng dụng
BitVector: Vector cho Discord, Spyglass trên web và Prism chat
Cách chạy các mô hình được lưu trữ và các workflow ComfyUI từ Discord với bot Vector, từ bất kỳ trình duyệt nào với Spyglass, và bằng cách chat với Prism: liên kết tài khoản, /ai render và /ai workflow, media ban đầu cho image-to-image và image-to-video, kỹ năng, và cách sửa các lỗi thường gặp.
Bởi Captain
2026-10-03

Hướng dẫn khác

Dịch vụ đám mây
Phí cố định so với token: tại sao các gói không giới hạn như Graydient.ai là lựa chọn tốt nhất cho nhà sáng tạo AI năm 2026
So sánh chi phí có xếp hạng, với giá được kiểm tra vào ngày 8 tháng 10 năm 2026, giữa các gói không giới hạn phí cố định như Graydient.ai với giá token và tín dụng từ Midjourney, Leonardo, fal.ai, Replicate, Runway và Kling: chi phí thực sự cho 1.000 hình ảnh và 1.000 video mỗi tháng trên mỗi dịch vụ, và tại sao một khoản phí cố định cho hình ảnh, video, âm thanh, trò chuyện Grok LLM và ứng dụng web không giới hạn là giá trị tốt nhất cho những người sáng tạo hay thử nghiệm.
Bởi Captain
2026-10-08
Mô hình
FLUX.1 Dev: cách tạo prompt, cài đặt tốt nhất và ý tưởng sáng tạo
Hướng dẫn thực tế về FLUX.1 Dev của Black Forest Labs: cách tạo prompt bằng ngôn ngữ tự nhiên, cài đặt hướng dẫn và bước, xếp chồng LoRA, hiển thị chữ và ý tưởng prompt tận dụng điểm mạnh của nó.
Bởi Captain
2026-09-30
Mô hình
Stable Diffusion XL 1.0: lời nhắc, cài đặt và những gì nó vẫn làm tốt nhất
Cách tận dụng tối đa mô hình cơ sở chính thức SDXL 1.0: độ phân giải gốc, cài đặt CFG và sampler, bộ tinh chỉnh, lời nhắc tiêu cực và ý tưởng phong cách mà SDXL vẫn nổi bật.
Bởi Captain
2026-10-01
Mô hình
Stable Diffusion 1.5: mô hình cổ điển, dùng đúng cách
Stable Diffusion 1.5 vẫn đáng để biết: độ phân giải phù hợp, CFG và sampler, cách dùng thư viện lớn LoRA và embedding của nó, cùng ý tưởng prompt sáng tạo phù hợp với mô hình 512 pixel.
Bởi Captain
2026-10-02
Mô hình
FLUX.2 Dev: hướng dẫn sử dụng model mới nhất của Black Forest Labs
FLUX.2 Dev hỗ trợ prompt dài hơn, văn bản tốt hơn, thực tế hơn và chỉnh sửa đa tham chiếu. Hướng dẫn này bao gồm quy trình turbo, cài đặt hướng dẫn và độ phân giải, cấu trúc prompt và ý tưởng tận dụng điểm mạnh mới của nó.
Bởi Captain
2026-10-03
Mô hình
Qwen-Image: prompt dài, chữ chuẩn và poster song ngữ
Qwen-Image là model bạn nên dùng khi chữ trong ảnh quan trọng. Học cách viết prompt mô tả dài, tạo chữ tiếng Anh và Trung chính xác, chỉnh CFG và bước, và khám phá ý tưởng sáng tạo với bố cục phức tạp.
Bởi Captain
2026-09-29