Chạy Stable Diffusion, SDXL và Flux trên Mac (Apple Silicon): Draw Things, ComfyUI và những gì mong đợi
Chủ đề: Ứng dụng
Bởi Captain
Đăng ngày 2026-01-21
Tổng quan
Mac Apple Silicon chạy mô hình hình ảnh qua Metal (MPS trong PyTorch, hoặc đường CoreML riêng của Apple trong Draw Things). Không có CUDA, nên số bộ nhớ quan trọng là RAM hợp nhất của Mac, chia sẻ giữa CPU và GPU: MacBook Air 16 GB có thể chạy
SDXL
, máy 32 GB chạy
Flux
ở fp8 và các mô hình video nhỏ, Mac Studio 64 hoặc 128 GB có thể tải gần như mọi thứ, nhưng chậm. Tốc độ là điểm đánh đổi: M2 Max mất 30 đến 60 giây cho ảnh SDXL mà RTX 4070 làm trong 6 giây.
Ba công cụ quan trọng. Draw Things là app gốc miễn phí (Mac, iPhone, iPad) có thư viện mô hình, nhập
LoRA
,
ControlNet
,
inpainting
và hiệu năng Mac tốt nhất vì nó chuyển mô hình sang CoreML; đây là lựa chọn đầu tiên phù hợp cho đa số người dùng Mac.
ComfyUI
chạy trên Mac từ mã nguồn với PyTorch MPS; nó hỗ trợ mọi thứ ComfyUI có, một số node cần fp32 và một vài node tùy chỉnh không chạy được trên phần cứng không có CUDA. DiffusionBee là app đơn giản nhất, một cú nhấp, giới hạn ở các mô hình cũ hơn.
Vì tốc độ là nút thắt, người dùng Mac thường dùng đám mây nhiều hơn PC: tạo bản nháp trên các đối tác đám mây, mang bản giữ lại về Draw Things để inpainting và LoRA cá nhân, hoặc làm mọi việc nặng (Flux độ chính xác đầy đủ, video) trên
PirateDiffusion
hoặc
BitVector
và giữ Mac để duyệt web và chỉnh sửa.
Tham khảo
Tên | Kiểu | Ý nghĩa |
|---|---|---|
8 GB Mac | SD 1.5 only | |
16 GB Mac | SDXL ở 1024x1024 trong Draw Things (CoreML 8-bit) hoặc ComfyUI với --force-fp16; Flux qua Draw Things 8-bit chạy được nhưng chậm. | |
32 GB Mac | ||
64-128 GB Mac Studio / MacBook Pro Max | ||
Draw Things | app | Miễn phí, App Store. Quản lý mô hình, nhập LoRA/ControlNet, inpainting, nâng cấp ảnh, script. CoreML tăng tốc các lần chạy lặp sau khi biên dịch lần đầu. |
ComfyUI on MPS | from source | Python 3.12, PyTorch nightly hoặc stable với MPS. Các cờ: --force-fp16 (M1/M2) hoặc mặc định; --use-split-cross-attention giúp bộ nhớ. |
DiffusionBee | app | Một cú nhấp, SD 1.5/SDXL, thiết lập giới hạn. Phù hợp để thử lần đầu. |
iogpu.wired_limit_mb | sysctl | Tăng bộ nhớ macOS cho phép GPU cấp phát (mặc định ~70% RAM). Đặt bằng RAM trừ 8 GB cho mô hình lớn. |
AD

Flux tốc độ đầy đủ từ Mac của bạn
BitVector Prism chạy trên Safari: các mô hình Flux, FLUX.2 và Qwen mà chạy chậm trên Apple Silicon được render trong vài giây trên GPU của nó. Giữ Mac cho Draw Things và chỉnh sửa; gửi prompt nặng ở đây.
Từng bước
- Kiểm tra chip và bộ nhớ: menu Apple > Giới thiệu về máy Mac này. Tìm cấp của bạn trong bảng.
- Cài Draw Things từ App Store. Mở app, chọn mô hình trong thư viện (SDXL base hoặc DreamShaper XL cho Mac 16 GB), để nó tải và chuyển đổi.
- Tạo ảnh đầu tiên ở 1024x1024, 20 bước, DPM++ 2M Karras,CFG6. Lần chạy đầu biên dịch mô hình CoreML nên chậm; các lần sau nhanh hơn.
- Nhập LoRA từ trang này: Models > LoRA > Import, chọn file .safetensors; Draw Things chuyển đổi nó. Thêm từ kích hoạt vào prompt.
- Với ComfyUI: cài Homebrew, Python 3.12 và git; git clone ComfyUI; pip install -r requirements.txt với PyTorch bật MPS; chạy python main.py; tải workflow mặc định theo hướng dẫn ComfyUI cho người mới.
- Trong ComfyUI trên Mac 16 GB thêm --force-fp16 và giữ batch size 1; dùng VAE Decode (Tiled) cho kích thước trên 1024.
- Với Flux trên Mac 32 GB+ dùng bản fp8 hoặc GGUF Q8, bộ mã hóa fp8 T5 và chuẩn bị mất vài phút cho mỗi ảnh; tăng wired limit nếu gặp lỗi bộ nhớ.
- Giữ các tác vụ nặng cho đám mây: mở trang mô hình bất kỳ, nhấn nút PirateDiffusion hoặc BitVector và chạy prompt đó trên đó trong vài giây.
Ví dụ
Lệnh khởi động ComfyUI trên Mac
brew install python@3.12 git
git clone https://github.com/comfyanonymous/ComfyUI && cd ComfyUI && pip3 install -r requirements.txt
python3 main.py --force-fp16 --use-split-cross-attention
Tăng giới hạn bộ nhớ GPU (Mac 64 GB)
sudo sysctl iogpu.wired_limit_mb=57344
Cùng prompt trên đám mây từ Mac
/render <flux-dev> a quiet harbour at dawn, fishing boats, mist, 35mm film look /size:1216x832 /steps:24
Mẹo
- Draw Things trên iPhone 15 Pro hoặc mới hơn chạy SD 1.5 và các biến thể nhỏ SDXL tại chỗ; tiện khi đi lại, không phù hợp làm nhiều.
- Ảnh đen hoặc trắng trên MPS thường do tràn fp16: dùng --force-fp32 cho mô hình đó hoặc VAE SDXL sửa lỗi fp16.
- Đóng các app ngốn bộ nhớ (trình duyệt nhiều tab) trước khi tạo ảnh; bộ nhớ hợp nhất nghĩa là Safari và mô hình cạnh tranh.
- Draw Things hỗ trợ nhiều mô hình thời ComfyUI (Flux,Z-Image,Qwen Image,Wan) sớm hơn bạn nghĩ; kiểm tra danh sách mô hình trước khi thiết lập ComfyUI.
- Node tùy chỉnh nhập thư viện chỉ cho CUDA (xformers, một số công cụ mặt) không chạy trên Mac; hướng dẫn node ComfyUI đánh dấu các node phổ biến.
- Tham khảo tốc độ để biết kỳ vọng: SDXL 1024x1024, 25 bước: M1 Pro 90-120 s, M2 Max 35-50 s, M3 Max 25-35 s, M4 Max 18-25 s.
Khắc phục sự cố
Ảnh đen hoặc xám
Vì sao xảy ra
Tràn độ chính xác fp16 trên MPS.
Cách sửa
Thêm --force-fp32 cho mô hình đó, hoặc dùng VAE SDXL sửa lỗi fp16; trong Draw Things chuyển mô hình sang bản 8-bit hoặc fp32.
"MPS backend out of memory"
Vì sao xảy ra
Giới hạn cấp phát GPU macOS đạt trước khi RAM đầy.
Cách sửa
Tăng iogpu.wired_limit_mb, giảm độ phân giải, dùng trọng số lượng tử hóa.
Node tùy chỉnh không nhập được
Vì sao xảy ra
Phụ thuộc gói chỉ cho CUDA.
Cách sửa
Xóa node hoặc tìm thay thế tương thích Mac; các node cốt lõi đều chạy được.
Lần tạo đầu rất chậm trong Draw Things
Vì sao xảy ra
Biên dịch CoreML mô hình lần đầu.
Cách sửa
Chờ một lần; các lần sau nhanh hơn. Giữ mô hình tải giữa các lần chạy.
Flux mất 10 phút cho mỗi ảnh
Vì sao xảy ra
Chuyển đổi trọng số độ chính xác đầy đủ, hoặc chip M1/M2 cơ bản.
Cách sửa
Dùng bản 8-bit với 20 bước, hoặc chạy Flux trên đám mây và SDXL trên máy.
AD

Video từ MacBook Air
PirateDiffusion tạo clip Wan 2.2, LTX-2 và H3 trên server của họ và gửi về Telegram trên Mac hoặc iPhone của bạn. Hàng nghìn mô hình, render không giới hạn, giá cố định hàng tháng.
Câu hỏi
Tôi có nên mua Mac để làm ảnh AI không?
Mua Mac vì lý do khác và tận hưởng việc nó chạy được SDXL; mua PC NVIDIA nếu ảnh AI hoặc video là mục đích chính. Bộ nhớ hợp nhất tốt, tốc độ thì không.
Automatic1111 hoặc Forge chạy trên Mac không?
A1111 chạy trên MPS với cờ --skip-torch-cuda-test và chậm hơn ComfyUI;
Forge
hỗ trợ Mac hạn chế. Draw Things hoặc ComfyUI là lựa chọn thực tế.
Tôi có thể train LoRA trên Mac không?
LoRA SD 1.5 và SDXL train trong Draw Things và kohya với MPS, chậm hơn NVIDIA nhiều. Flux và LoRA video: dùng máy train đám mây.
Có làm video được trên Mac không?
Wan 2.2 5B và các biến thể nhỏ
LTX-2
trên Mac 32 GB+, mất vài phút cho clip. Với thứ lớn hơn, dùng đám mây.
Mô hình nào đáng dùng trên Mac?
Tinh chỉnh SDXL, Illustrious/Pony cho anime,
Z-Image Turbo
cho bản nháp nhanh, SD 1.5 inpainting. Còn lại chạy tốt hơn trên đám mây.
Liên kết và nguồn
- Draw Things
- PyTorch on Apple Silicon (MPS)
- ComfyUI on GitHub
- DiffusionBee
- SDXL family page
- PirateDiffusion
Mô hình trong hướng dẫn này
Người viết
Captain
Hướng dẫn liên quan
Lỗi và cách khắc phục
Hướng dẫn GPU và VRAM cho hình ảnh và video AI: mỗi model cần gì và nên mua (hoặc không)
Mỗi dòng model thực sự cần bao nhiêu bộ nhớ đồ họa để chạy mượt (SD 1.5, SDXL, Flux, FLUX.2, Qwen Image, Z-Image, Wan 2.2, LTX-2, H3), fp8 và GGUF quantisation giúp gì, tại sao RAM hệ thống và ổ đĩa cũng quan trọng, bảng xếp hạng card từ 8 đến 32 GB, lưu ý về Mac và AMD, và khi nào thuê rẻ hơn mua.
Bởi Quartermaster
2026-01-07
ComfyUI
ComfyUI là gì? Hướng dẫn cho người mới về các node, quy trình làm việc và biểu đồ đầu tiên
Giải thích ComfyUI cho những người đã dùng Automatic1111, Fooocus hoặc ứng dụng web: tại sao nó là một biểu đồ, bảy node trong quy trình mặc định và chức năng của từng node, cách tải quy trình từ một hình ảnh, nơi đặt mô hình, Trình Quản Lý cho các node thiếu, và khi nào nên dùng công cụ đơn giản hơn hoặc dịch vụ đám mây.
Bởi Lookout
2025-12-17
Ứng dụng
Cách cài đặt LoRA: thư mục, kiểm tra file và sử dụng lần đầu trong ComfyUI, Forge, Automatic1111 và Draw Things
Hướng dẫn cài đặt thực tế: tải LoRA ở đâu, kiểm tra mã băm file với trang model, thư mục đặt file cho từng giao diện phổ biến, cách làm mới danh sách, cách tải lần đầu và ba cách dùng LoRA trên đám mây mà không cần cài gì.
Bởi Lookout
2025-09-24
Mô hình
Nên thử những mô hình AI tạo ảnh nào trước, và tại sao: danh sách bắt đầu theo thứ hạng
Bảy mô hình cho tuần đầu tiên, chọn vì dễ dùng hơn là vì nổi tiếng: một mô hình SDXL tinh chỉnh ảnh, một mô hình tinh chỉnh anime, Flux dev, một mô hình turbo nhanh, một mô hình tô màu lại, một mô hình video và một mô hình phóng to, mỗi cái có lý do, bộ nhớ cần và kiểu prompt nó thích.
Bởi Captain
2025-09-10
Hướng dẫn khác
Dịch vụ đám mây
Phí cố định so với token: tại sao các gói không giới hạn như Graydient.ai là lựa chọn tốt nhất cho nhà sáng tạo AI năm 2026
So sánh chi phí có xếp hạng, với giá được kiểm tra vào ngày 8 tháng 10 năm 2026, giữa các gói không giới hạn phí cố định như Graydient.ai với giá token và tín dụng từ Midjourney, Leonardo, fal.ai, Replicate, Runway và Kling: chi phí thực sự cho 1.000 hình ảnh và 1.000 video mỗi tháng trên mỗi dịch vụ, và tại sao một khoản phí cố định cho hình ảnh, video, âm thanh, trò chuyện Grok LLM và ứng dụng web không giới hạn là giá trị tốt nhất cho những người sáng tạo hay thử nghiệm.
Bởi Captain
2026-10-08
Mô hình
FLUX.1 Dev: cách tạo prompt, cài đặt tốt nhất và ý tưởng sáng tạo
Hướng dẫn thực tế về FLUX.1 Dev của Black Forest Labs: cách tạo prompt bằng ngôn ngữ tự nhiên, cài đặt hướng dẫn và bước, xếp chồng LoRA, hiển thị chữ và ý tưởng prompt tận dụng điểm mạnh của nó.
Bởi Captain
2026-09-30
Mô hình
Stable Diffusion XL 1.0: lời nhắc, cài đặt và những gì nó vẫn làm tốt nhất
Cách tận dụng tối đa mô hình cơ sở chính thức SDXL 1.0: độ phân giải gốc, cài đặt CFG và sampler, bộ tinh chỉnh, lời nhắc tiêu cực và ý tưởng phong cách mà SDXL vẫn nổi bật.
Bởi Captain
2026-10-01
Mô hình
Stable Diffusion 1.5: mô hình cổ điển, dùng đúng cách
Stable Diffusion 1.5 vẫn đáng để biết: độ phân giải phù hợp, CFG và sampler, cách dùng thư viện lớn LoRA và embedding của nó, cùng ý tưởng prompt sáng tạo phù hợp với mô hình 512 pixel.
Bởi Captain
2026-10-02
Mô hình
FLUX.2 Dev: hướng dẫn sử dụng model mới nhất của Black Forest Labs
FLUX.2 Dev hỗ trợ prompt dài hơn, văn bản tốt hơn, thực tế hơn và chỉnh sửa đa tham chiếu. Hướng dẫn này bao gồm quy trình turbo, cài đặt hướng dẫn và độ phân giải, cấu trúc prompt và ý tưởng tận dụng điểm mạnh mới của nó.
Bởi Captain
2026-10-03
Mô hình
Qwen-Image: prompt dài, chữ chuẩn và poster song ngữ
Qwen-Image là model bạn nên dùng khi chữ trong ảnh quan trọng. Học cách viết prompt mô tả dài, tạo chữ tiếng Anh và Trung chính xác, chỉnh CFG và bước, và khám phá ý tưởng sáng tạo với bố cục phức tạp.
Bởi Captain
2026-09-29

Model
Trends
.ai
© ModelTrends.ai
|
© 2026
|
Mọi quyền được bảo lưu