Model
Trends
.ai
Model
Trends
.ai
những mô hình AI mã nguồn mở tốt nhất

Waifu Diffusion: Gợi ý tag Danbooru cho mô hình anime cổ điển

Chủ đề: Mô hình
Bởi Captain
Đăng ngày 2026-10-01
Waifu Diffusion là mô hình anime cơ bản đã dạy một thế hệ cách gợi ý bằng tag Danbooru. Hướng dẫn này bao gồm thứ tự tag, tag chất lượng, tag tiêu cực, độ phân giải phù hợp và ý tưởng cho tranh anime sạch sẽ.

Tổng quan

Waifu
Diffusion của hakurei là một fine-tune lâu dài của Stable Diffusion 1.x trên tranh anime có tag. Nó dùng tag kiểu Danbooru thay vì câu văn và tạo ra nét vẽ anime sắc nét, nhất quán cùng màu sắc.
Nó khá toàn diện chứ không chuyên sâu: tốt cho chân dung, phong cảnh và cảnh đơn giản, không sắc nét bằng dòng
Illustrious
mới hơn, nhưng nhẹ, nhanh và tương thích với toàn bộ thư viện
LoRA
SD 1.5
.

Tham khảo

Tên
Kiểu
Ý nghĩa
Prompt
tags
Tag Danbooru cách nhau bằng dấu phẩy: số lượng, chủ thể, ngoại hình, trang phục, tư thế, bối cảnh, phong cách.
Negative prompt
tags
lowres, bad anatomy, bad hands, text, error, missing fingers, cropped, worst quality, low quality, jpeg artifacts, signature, watermark, blurry
CFG
7-11
Cao hơn mô hình thực tế; 9 là mức trung bình tốt.
Steps
25-30
Euler a hoặc DPM++ 2M Karras.
Resolution
512-768
512x768 cho chân dung; dùng hires fix cho kích thước lớn hơn.
AD
Không cần cài đặt – chạy mô hình AI trên đám mây
BitVector Prism là cách dễ nhất để bắt đầu: chọn một mô hình, nhập prompt và tạo ảnh trong một ứng dụng web gọn gàng, không cần cấu hình gì. BitVector cũng có trên Discord và trên web (SpyGlass).

Từng bước

  1. Bắt đầu với masterpiece, best quality, rồi đến tag chủ thể (1girl, solo), tiếp theo ngoại hình (long black hair, green eyes).
  2. Thêm tag trang phục và tư thế, rồi bối cảnh (classroom, rainy street), cuối cùng là tag ánh sáng hoặc phong cách.
  3. Dán prompt tiêu cực chuẩn và để nguyên.
  4. Tạo ảnh ở 512x768,
    CFG
    9, 28 bước với Euler a.
  5. Phóng to bằng hires fix với mức khử nhiễu 0.5 và dùng anime
    upscaler
    để nét vẽ sạch.

Ví dụ

Chân dung

masterpiece, best quality, 1woman, solo, short silver hair, blue eyes, knit cardigan, looking at viewer, cherry blossoms, wind, soft lighting, detailed background

Phong cảnh

masterpiece, best quality, no humans, scenery, mountain village, rice terraces, morning mist, wooden houses, wide shot, detailed

Ý tưởng sáng tạo: tĩnh vật ấm cúng

masterpiece, best quality, no humans, still life, kotatsu, mandarin oranges, sleeping cat, winter window, warm indoor light, soft shading

Mẹo

  • Dùng dấu gạch dưới hoặc dấu cách nhất quán; Waifu Diffusion được huấn luyện với dấu cách thay cho dấu gạch dưới.
  • Thứ tự tag quan trọng: vài tag đầu chi phối bố cục.
  • Prompt phong cảnh (không người, scenery, sunset, torii) tạo ra tranh nền đẹp.
  • Kết hợp với LoRA phong cách SD 1.5 ở 0.6 để làm mới hình ảnh mà không thay đổi cách dùng tag.

Khắc phục sự cố

Tay bị chảy và thừa ngón

Vì sao xảy ra
Giới hạn của SD 1.x càng tệ hơn với độ phân giải thấp.

Cách sửa
Thêm bad hands và missing fingers vào prompt tiêu cực, tạo ảnh ở 512x768, rồi vẽ lại tay ở độ phân giải cao hơn.

Màu xám, tương phản thấp

Vì sao xảy ra
VAE mặc định trong một số thiết lập.

Cách sửa
Tải VAE chuẩn SD 1.5 hoặc anime kl-f8 VAE và tăng CFG lên 9-10.

AD
PirateDiffusion
Không cần cài đặt – chạy mô hình AI trên đám mây
PirateDiffusion chỉ có trên Telegram và dành cho người dùng chuyên nghiệp: hàng nghìn mô hình, LoRA và workflow điều khiển bằng lệnh chat, tạo không giới hạn với gói giá cố định.

Câu hỏi

Prompt ngôn ngữ tự nhiên có dùng được không?

Dùng được một phần, nhưng tag kiểm soát tốt hơn nhiều. Có thể kết hợp vài cụm ngắn với tag nếu cần chi tiết cụ thể.

Upscaler nào phù hợp?

Mô hình ESRGAN hướng anime giữ nét vẽ sắc nét; upscaler ảnh chung làm mềm nét.

Liên kết và nguồn

Mô hình trong hướng dẫn này

Người viết
Captain

Hướng dẫn liên quan

Mô hình
Stable Diffusion 1.5: mô hình cổ điển, dùng đúng cách
Stable Diffusion 1.5 vẫn đáng để biết: độ phân giải phù hợp, CFG và sampler, cách dùng thư viện lớn LoRA và embedding của nó, cùng ý tưởng prompt sáng tạo phù hợp với mô hình 512 pixel.
Bởi Captain
2026-10-02
Mô hình
Ghibli Diffusion: token phong cách ghibli và cách sử dụng
Ghibli Diffusion của Nitrosocke là một trong những model phong cách đầu tiên cho Stable Diffusion. Tìm hiểu câu kích hoạt, cài đặt, cách mô tả cảnh nó có thể vẽ, và ý tưởng sáng tạo cho phong cảnh kiểu hoạt hình vẽ tay.
Bởi Captain
2026-09-30
Mô hình
DreamShaper 8 Inpainting: sửa và thay đổi các phần của hình ảnh
Checkpoint DreamShaper 8 inpainting của Lykon thay thế vùng được che phủ một cách sạch sẽ với phong cách bán thực tế đa dụng. Tìm hiểu chiến lược dùng mặt nạ, giá trị khử nhiễu, cách gợi ý cho vùng được che và ý tưởng cho các chỉnh sửa sáng tạo.
Bởi Captain
2026-10-01
Mô hình
Stable Diffusion v1.1: phiên bản gốc, dùng sáng tạo
Stable Diffusion v1.1 là checkpoint Stable Diffusion công khai đầu tiên, được huấn luyện ở 256 rồi 512 pixel. Hướng dẫn này cho thấy nó phù hợp với gì ngày nay: kết cấu mơ màng, bố cục trừu tượng và phong cách thô sơ, kiểu AI đầu tiên.
Bởi Captain
2026-09-29

Hướng dẫn khác

Mô hình
FLUX.1 Dev: cách tạo prompt, cài đặt tốt nhất và ý tưởng sáng tạo
Hướng dẫn thực tế về FLUX.1 Dev của Black Forest Labs: cách tạo prompt bằng ngôn ngữ tự nhiên, cài đặt hướng dẫn và bước, xếp chồng LoRA, hiển thị chữ và ý tưởng prompt tận dụng điểm mạnh của nó.
Bởi Captain
2026-09-30
Mô hình
Stable Diffusion XL 1.0: lời nhắc, cài đặt và những gì nó vẫn làm tốt nhất
Cách tận dụng tối đa mô hình cơ sở chính thức SDXL 1.0: độ phân giải gốc, cài đặt CFG và sampler, bộ tinh chỉnh, lời nhắc tiêu cực và ý tưởng phong cách mà SDXL vẫn nổi bật.
Bởi Captain
2026-10-01
Mô hình
FLUX.2 Dev: hướng dẫn sử dụng model mới nhất của Black Forest Labs
FLUX.2 Dev hỗ trợ prompt dài hơn, văn bản tốt hơn, thực tế hơn và chỉnh sửa đa tham chiếu. Hướng dẫn này bao gồm quy trình turbo, cài đặt hướng dẫn và độ phân giải, cấu trúc prompt và ý tưởng tận dụng điểm mạnh mới của nó.
Bởi Captain
2026-10-03
Mô hình
Qwen-Image: prompt dài, chữ chuẩn và poster song ngữ
Qwen-Image là model bạn nên dùng khi chữ trong ảnh quan trọng. Học cách viết prompt mô tả dài, tạo chữ tiếng Anh và Trung chính xác, chỉnh CFG và bước, và khám phá ý tưởng sáng tạo với bố cục phức tạp.
Bởi Captain
2026-09-29
Mô hình
SDXL-Lightning: tạo ảnh nhanh trong bốn bước trên mọi checkpoint SDXL
LoRA SDXL-Lightning của ByteDance biến một lần render SDXL 30 bước thành chỉ 4 bước. Tìm hiểu số bước, CFG bạn cần dùng, sampler, và cách kết hợp với các checkpoint và LoRA phong cách bạn thích.
Bởi Captain
2026-09-30
ComfyUI
Các nút ComfyUI: tài liệu và khắc phục sự cố
Tài liệu bằng ngôn ngữ đơn giản cho các nút ComfyUI mà mọi người dùng nhiều nhất: mỗi nút làm gì, mọi đầu vào và đầu ra, cách kết nối, các cài đặt quan trọng, và các lỗi nó gây ra cùng cách sửa từng lỗi.
Bởi Captain
2026-06-02