Model
Trends
.ai
Model
Trends
.ai
những mô hình AI mã nguồn mở tốt nhất

Stable Diffusion 1.5: mô hình cổ điển, dùng đúng cách

Chủ đề: Mô hình
Bởi Captain
Đăng ngày 2026-10-02
Stable Diffusion 1.5 vẫn đáng để biết: độ phân giải phù hợp, CFG và sampler, cách dùng thư viện lớn LoRA và embedding của nó, cùng ý tưởng prompt sáng tạo phù hợp với mô hình 512 pixel.

Tổng quan

Stable Diffusion 1.5
được RunwayML và Stability AI phát hành cuối năm 2022, được huấn luyện ở độ phân giải 512x512. Nó nhỏ, nhanh và nằm ở trung tâm bộ sưu tập lớn nhất các
LoRA
,
embedding
,
ControlNet
và fine-tune từng được tạo ra, hàng nghìn trong số đó có trong danh mục này.
Kết quả thô của nó thô hơn so với các mô hình mới hơn, nhưng với một
negative prompt
tốt, một checkpoint fine-tune hoặc vài embedding, nó tạo ra hình ảnh đặc trưng nhanh chóng, và chạy được trên hầu hết GPU.

Tham khảo

Tên
Kiểu
Ý nghĩa
Prompt
tags
Các mô tả cách nhau bằng dấu phẩy. Hỗ trợ tốt trọng số (word:1.3) và nhấn mạnh.
Negative prompt
text
Cần thiết. lowres, bad anatomy, bad hands, text, watermark, blurry; hoặc một embedding như easynegative.
CFG
6-9
7 là chuẩn; giảm xuống 5 để có kết quả mềm mại như tranh sơn dầu.
Steps
20-30
Euler a ở 25 hoặc DPM++ 2M Karras ở 20-25.
Resolution
512-768
512x512, 512x768 hoặc 768x512. Kích thước lớn hơn sẽ nhân đôi chủ thể trừ khi dùng hires fix.
AD
Không cần cài đặt – chạy mô hình AI trên đám mây
BitVector Prism là cách dễ nhất để bắt đầu: chọn một mô hình, nhập prompt và tạo ảnh trong một ứng dụng web gọn gàng, không cần cấu hình gì. BitVector cũng có trên Discord và trên web (SpyGlass).

Từng bước

  1. Tạo ảnh ở 512x768 (chân dung) hoặc 768x512 (phong cảnh),
    CFG
    7, 25 bước.
  2. Viết negative prompt trước và dùng lại; nó quan trọng với 1.5 hơn các mô hình sau.
  3. Thêm một style LoRA ở 0.7 hoặc một style embedding; 1.5 rất hợp với LoRA.
  4. Bật hires fix (1.5x-2x, denoise 0.4-0.5) cho ảnh cuối cùng đạt 1024 cạnh dài mà không bị nhân đôi đầu.
  5. Giữ danh sách các seed bạn thích; 1.5 nhạy với seed và cùng seed với chỉnh sửa prompt nhỏ là cách tốt để thử nghiệm.

Ví dụ

Prompt cổ điển

portrait of an old lighthouse keeper, weathered face, wool sweater, stormy sky behind, oil painting, dramatic rim light, (highly detailed:1.2)
Negative: lowres, bad anatomy, bad hands, text, watermark, blurry, cropped

Minh họa cổ điển

1950s travel poster of a mountain railway, flat colors, screen print texture, bold typography space at the bottom, teal and orange

Ý tưởng sáng tạo: thế giới tí hon

macro photo of a snail shell that is a spiral staircase for tiny glowing people, moss, dew drops, tilt-shift, soft morning light

Mẹo

  • Từ liên quan máy ảnh (85mm, f/1.8, bokeh) và từ liên quan chất liệu (watercolor, linocut) ảnh hưởng mạnh đến 1.5.
  • Nếu giải phẫu sai, giảm CFG một bậc và thêm embedding sửa tay thay vì thêm nhiều từ negative.
  • ControlNet (openpose, canny, depth) hoạt động tốt nhất trên 1.5 trong tất cả các dòng; dùng khi cần tư thế hoặc bố cục cụ thể.
  • Để
    inpainting
    , chọn một trong các checkpoint inpainting 1.5 chuyên dụng trong danh mục này thay vì dùng mô hình gốc.

Khắc phục sự cố

Hai đầu hoặc thân nhân đôi

Vì sao xảy ra
Tạo ảnh lớn hơn 512 ở một chiều.

Cách sửa
Tạo ở 512x768 rồi phóng to bằng hires fix thay vì yêu cầu 1024 trực tiếp.

Ảnh nhạt, xám

Vì sao xảy ra
Thiếu hoặc VAE yếu ở một số checkpoint.

Cách sửa
Dùng checkpoint có VAE tích hợp, hoặc tải VAE chuẩn SD 1.5; tăng CFG lên một bậc.

AD
PirateDiffusion
Không cần cài đặt – chạy mô hình AI trên đám mây
PirateDiffusion chỉ có trên Telegram và dành cho người dùng chuyên nghiệp: hàng nghìn mô hình, LoRA và workflow điều khiển bằng lệnh chat, tạo không giới hạn với gói giá cố định.

Câu hỏi

SD 1.5 còn đáng dùng không?

Có, vì tốc độ, khả năng dùng ControlNet, và thư viện phong cách khổng lồ chỉ được huấn luyện cho nó.

Tại sao ảnh mình tạo trông kém hơn ví dụ trên mạng?

Hầu hết ví dụ trên mạng dùng checkpoint 1.5 fine-tune kèm embedding negative và hires fix. Mô hình gốc chỉ là điểm bắt đầu.

Liên kết và nguồn

Mô hình trong hướng dẫn này

Người viết
Captain

Hướng dẫn liên quan

Mô hình
Waifu Diffusion: Gợi ý tag Danbooru cho mô hình anime cổ điển
Waifu Diffusion là mô hình anime cơ bản đã dạy một thế hệ cách gợi ý bằng tag Danbooru. Hướng dẫn này bao gồm thứ tự tag, tag chất lượng, tag tiêu cực, độ phân giải phù hợp và ý tưởng cho tranh anime sạch sẽ.
Bởi Captain
2026-10-01
Mô hình
Ghibli Diffusion: token phong cách ghibli và cách sử dụng
Ghibli Diffusion của Nitrosocke là một trong những model phong cách đầu tiên cho Stable Diffusion. Tìm hiểu câu kích hoạt, cài đặt, cách mô tả cảnh nó có thể vẽ, và ý tưởng sáng tạo cho phong cảnh kiểu hoạt hình vẽ tay.
Bởi Captain
2026-09-30
Mô hình
DreamShaper 8 Inpainting: sửa và thay đổi các phần của hình ảnh
Checkpoint DreamShaper 8 inpainting của Lykon thay thế vùng được che phủ một cách sạch sẽ với phong cách bán thực tế đa dụng. Tìm hiểu chiến lược dùng mặt nạ, giá trị khử nhiễu, cách gợi ý cho vùng được che và ý tưởng cho các chỉnh sửa sáng tạo.
Bởi Captain
2026-10-01
Mô hình
Stable Diffusion v1.1: phiên bản gốc, dùng sáng tạo
Stable Diffusion v1.1 là checkpoint Stable Diffusion công khai đầu tiên, được huấn luyện ở 256 rồi 512 pixel. Hướng dẫn này cho thấy nó phù hợp với gì ngày nay: kết cấu mơ màng, bố cục trừu tượng và phong cách thô sơ, kiểu AI đầu tiên.
Bởi Captain
2026-09-29

Hướng dẫn khác

Mô hình
FLUX.1 Dev: cách tạo prompt, cài đặt tốt nhất và ý tưởng sáng tạo
Hướng dẫn thực tế về FLUX.1 Dev của Black Forest Labs: cách tạo prompt bằng ngôn ngữ tự nhiên, cài đặt hướng dẫn và bước, xếp chồng LoRA, hiển thị chữ và ý tưởng prompt tận dụng điểm mạnh của nó.
Bởi Captain
2026-09-30
Mô hình
Stable Diffusion XL 1.0: lời nhắc, cài đặt và những gì nó vẫn làm tốt nhất
Cách tận dụng tối đa mô hình cơ sở chính thức SDXL 1.0: độ phân giải gốc, cài đặt CFG và sampler, bộ tinh chỉnh, lời nhắc tiêu cực và ý tưởng phong cách mà SDXL vẫn nổi bật.
Bởi Captain
2026-10-01
Mô hình
FLUX.2 Dev: hướng dẫn sử dụng model mới nhất của Black Forest Labs
FLUX.2 Dev hỗ trợ prompt dài hơn, văn bản tốt hơn, thực tế hơn và chỉnh sửa đa tham chiếu. Hướng dẫn này bao gồm quy trình turbo, cài đặt hướng dẫn và độ phân giải, cấu trúc prompt và ý tưởng tận dụng điểm mạnh mới của nó.
Bởi Captain
2026-10-03
Mô hình
Qwen-Image: prompt dài, chữ chuẩn và poster song ngữ
Qwen-Image là model bạn nên dùng khi chữ trong ảnh quan trọng. Học cách viết prompt mô tả dài, tạo chữ tiếng Anh và Trung chính xác, chỉnh CFG và bước, và khám phá ý tưởng sáng tạo với bố cục phức tạp.
Bởi Captain
2026-09-29
Mô hình
SDXL-Lightning: tạo ảnh nhanh trong bốn bước trên mọi checkpoint SDXL
LoRA SDXL-Lightning của ByteDance biến một lần render SDXL 30 bước thành chỉ 4 bước. Tìm hiểu số bước, CFG bạn cần dùng, sampler, và cách kết hợp với các checkpoint và LoRA phong cách bạn thích.
Bởi Captain
2026-09-30
ComfyUI
Các nút ComfyUI: tài liệu và khắc phục sự cố
Tài liệu bằng ngôn ngữ đơn giản cho các nút ComfyUI mà mọi người dùng nhiều nhất: mỗi nút làm gì, mọi đầu vào và đầu ra, cách kết nối, các cài đặt quan trọng, và các lỗi nó gây ra cùng cách sửa từng lỗi.
Bởi Captain
2026-06-02