Model
Trends
.ai
Model
Trends
.ai
những mô hình AI mã nguồn mở tốt nhất

Stable Diffusion XL 1.0: lời nhắc, cài đặt và những gì nó vẫn làm tốt nhất

Chủ đề: Mô hình
Bởi Captain
Đăng ngày 2026-10-01
Cách tận dụng tối đa mô hình cơ sở chính thức SDXL 1.0: độ phân giải gốc, cài đặt CFG và sampler, bộ tinh chỉnh, lời nhắc tiêu cực và ý tưởng phong cách mà SDXL vẫn nổi bật.

Tổng quan

Stable Diffusion XL
1.0 là mô hình khuếch tán tiềm ẩn hàng đầu của Stability AI năm 2023. Nó dùng hai bộ mã hóa văn bản (OpenCLIP ViT-G và CLIP ViT-L), tạo ảnh gốc ở 1024x1024 và đi kèm bộ tinh chỉnh tùy chọn giúp làm mịn các bước khử nhiễu cuối cùng. Nó vẫn là nền tảng của hệ sinh thái tinh chỉnh lớn nhất trong danh mục:
Pony
, Illustrious, NoobAI và hàng nghìn điểm kiểm tra thực tế đều phát triển từ nó.
Mô hình cơ sở có xu hướng mềm mại, như tranh sơn dầu và hiểu biết rộng về các phong cách nghệ thuật. Nó ít theo nghĩa đen hơn
Flux
, nên phù hợp với ảnh không gian rộng, có không khí và khám phá phong cách nhanh.

Tham khảo

Tên
Kiểu
Ý nghĩa
Prompt
text
Các cụm từ hoặc câu ngắn cách nhau bằng dấu phẩy. Các từ mô tả chất lượng (chi tiết cao, nét rõ) vẫn giúp với mô hình cơ sở.
Negative prompt
text
mờ, độ phân giải thấp, watermark, chữ, tay biến dạng. Giữ ngắn gọn.
CFG
5-8
7 là giá trị cổ điển. Thấp hơn cho kiểu tranh sơn dầu, cao hơn cho lời nhắc theo nghĩa đen.
Steps
25-40
30 với DPM++ 2M Karras là mặc định đáng tin cậy.
Resolution
1 MP
1024x1024, 1152x896, 896x1152, 1216x832, 832x1216, 1344x768, 768x1344.
AD
Không cần cài đặt – chạy mô hình AI trên đám mây
BitVector Prism là cách dễ nhất để bắt đầu: chọn một mô hình, nhập prompt và tạo ảnh trong một ứng dụng web gọn gàng, không cần cấu hình gì. BitVector cũng có trên Discord và trên web (SpyGlass).

Từng bước

  1. Bắt đầu ở 1024x1024,
    CFG
    7, 30 bước, DPM++ 2M Karras.
  2. Đặt chủ thể trước, rồi phong cách, rồi từ về ánh sáng và bố cục.
  3. Thêm lời nhắc tiêu cực ngắn và giữ ổn định trong khi bạn thử nghiệm lời nhắc tích cực.
  4. Nếu mặt hoặc tay trông sai, chạy lại
    img2img
    với mức khử nhiễu 0.3-0.4 hoặc dùng bộ tinh chỉnh cho 20% bước cuối.
  5. Chuyển sang khung không vuông (1216x832 cho phong cảnh) khi chủ thể đã ổn.

Ví dụ

Phong cảnh tranh sơn dầu

a vast misty fjord at dawn, tiny red fishing boat, oil painting, impasto brushwork, soft pink and slate palette, wide composition
Negative: blurry, lowres, watermark, text

Ý tưởng nghệ thuật

concept art of a nomad caravan crossing a salt flat, giant tortoise carrying a wooden house, dramatic clouds, matte painting style, cinematic lighting, highly detailed

Ý tưởng sáng tạo: mô hình giấy

a layered paper-cut diorama of a night market, warm lanterns made of tissue paper, miniature paper people, macro photography, shallow depth of field

Mẹo

  • SDXL phản hồi mạnh với tên nghệ sĩ và chất liệu. Hai hoặc ba từ phong cách hiệu quả hơn mười tính từ.
  • Không tạo ảnh dưới 1024 ở cạnh dài; mô hình cơ sở sẽ bị hỏng dưới 768.
  • Trọng số lời nhắc như (word:1.2) dùng được ở đây, khác với Flux.
  • Nếu muốn ảnh thực, điểm kiểm tra SDXL thực tế riêng biệt trong danh mục này sẽ tốt hơn mô hình cơ sở; dùng mô hình cơ sở cho tranh sơn dầu và ý tưởng.

Khắc phục sự cố

Mặt bị nhòe ở 1024

Vì sao xảy ra
Mô hình cơ sở có chi tiết mặt hạn chế so với các bản tinh chỉnh.

Cách sửa
Dùng bộ tinh chỉnh hoặc chạy img2img với mức khử nhiễu 0.35, hoặc tô lại mặt ở độ phân giải cao hơn.

Lời nhắc bị bỏ qua, ưu tiên phong cách chung

Vì sao xảy ra
CFG quá thấp hoặc quá nhiều từ phong cách cạnh tranh.

Cách sửa
Tăng CFG lên 8 và giảm danh sách phong cách còn hai hoặc ba từ.

AD
PirateDiffusion
Không cần cài đặt – chạy mô hình AI trên đám mây
PirateDiffusion chỉ có trên Telegram và dành cho người dùng chuyên nghiệp: hàng nghìn mô hình, LoRA và workflow điều khiển bằng lệnh chat, tạo không giới hạn với gói giá cố định.

Câu hỏi

Tôi có cần bộ tinh chỉnh không?

Không. Mô hình cơ sở hoạt động độc lập. Bộ tinh chỉnh thêm chi tiết nhỏ ở các bước cuối và hữu ích nhất với lời nhắc kiểu ảnh chụp.

Tôi có thể dùng LoRA và embedding của SD 1.5 không?

Không. SDXL có kiến trúc khác; dùng
LoRA
và
embedding
được huấn luyện cho SDXL.

Liên kết và nguồn

Mô hình trong hướng dẫn này

Người viết
Captain

Hướng dẫn liên quan

Mô hình
SDXL-Lightning: tạo ảnh nhanh trong bốn bước trên mọi checkpoint SDXL
LoRA SDXL-Lightning của ByteDance biến một lần render SDXL 30 bước thành chỉ 4 bước. Tìm hiểu số bước, CFG bạn cần dùng, sampler, và cách kết hợp với các checkpoint và LoRA phong cách bạn thích.
Bởi Captain
2026-09-30
Mô hình
Hyper-SD XL: SDXL một đến tám bước với LoRA linh hoạt
Hyper-SD từ ByteDance tăng tốc các checkpoint SDXL xuống còn chỉ một bước. Tìm hiểu biến thể nào nên chọn, quy tắc CFG và sampler, và cách kết hợp với checkpoint và LoRA mà không mất chất lượng.
Bởi Captain
2026-10-02
Mô hình
Smooth Detail Booster: làm bóng mượt hơn và chi tiết hơn trên Illustrious và Pony
Smooth Detail Booster LoRA của DigitalPastel thêm chi tiết và làm bóng mượt cho các checkpoint anime mà không làm thay đổi phong cách nghệ thuật. Tìm hiểu phạm vi trọng số, các prompt hỗ trợ và cách kết hợp với các tag chất lượng.
Bởi Captain
2026-09-29
Mô hình
Playground v2 1024 Aesthetic: một lựa chọn khác cho SDXL
Playground v2 là một mô hình kiến trúc SDXL được đào tạo từ đầu cho mục đích thẩm mỹ. Tìm hiểu cách nó khác với SDXL, sở thích về CFG và bước, cùng các prompt phong cách tranh vẽ và thực tế mà nó làm tốt hơn bản gốc.
Bởi Captain
2026-10-02

Hướng dẫn khác

Mô hình
FLUX.1 Dev: cách tạo prompt, cài đặt tốt nhất và ý tưởng sáng tạo
Hướng dẫn thực tế về FLUX.1 Dev của Black Forest Labs: cách tạo prompt bằng ngôn ngữ tự nhiên, cài đặt hướng dẫn và bước, xếp chồng LoRA, hiển thị chữ và ý tưởng prompt tận dụng điểm mạnh của nó.
Bởi Captain
2026-09-30
Mô hình
Stable Diffusion 1.5: mô hình cổ điển, dùng đúng cách
Stable Diffusion 1.5 vẫn đáng để biết: độ phân giải phù hợp, CFG và sampler, cách dùng thư viện lớn LoRA và embedding của nó, cùng ý tưởng prompt sáng tạo phù hợp với mô hình 512 pixel.
Bởi Captain
2026-10-02
Mô hình
FLUX.2 Dev: hướng dẫn sử dụng model mới nhất của Black Forest Labs
FLUX.2 Dev hỗ trợ prompt dài hơn, văn bản tốt hơn, thực tế hơn và chỉnh sửa đa tham chiếu. Hướng dẫn này bao gồm quy trình turbo, cài đặt hướng dẫn và độ phân giải, cấu trúc prompt và ý tưởng tận dụng điểm mạnh mới của nó.
Bởi Captain
2026-10-03
Mô hình
Qwen-Image: prompt dài, chữ chuẩn và poster song ngữ
Qwen-Image là model bạn nên dùng khi chữ trong ảnh quan trọng. Học cách viết prompt mô tả dài, tạo chữ tiếng Anh và Trung chính xác, chỉnh CFG và bước, và khám phá ý tưởng sáng tạo với bố cục phức tạp.
Bởi Captain
2026-09-29
ComfyUI
Các nút ComfyUI: tài liệu và khắc phục sự cố
Tài liệu bằng ngôn ngữ đơn giản cho các nút ComfyUI mà mọi người dùng nhiều nhất: mỗi nút làm gì, mọi đầu vào và đầu ra, cách kết nối, các cài đặt quan trọng, và các lỗi nó gây ra cùng cách sửa từng lỗi.
Bởi Captain
2026-06-02
Mô hình
Waifu Diffusion: Gợi ý tag Danbooru cho mô hình anime cổ điển
Waifu Diffusion là mô hình anime cơ bản đã dạy một thế hệ cách gợi ý bằng tag Danbooru. Hướng dẫn này bao gồm thứ tự tag, tag chất lượng, tag tiêu cực, độ phân giải phù hợp và ý tưởng cho tranh anime sạch sẽ.
Bởi Captain
2026-10-01