Model
Trends
.ai
Model
Trends
.ai
những mô hình AI mã nguồn mở tốt nhất

Bắt đầu với tạo hình ảnh AI: bức ảnh đầu tiên trong mười phút

Chủ đề: Dịch vụ đám mây
Bởi Captain
Đăng ngày 2025-08-14
Share

Tổng quan

Tạo hình ảnh AI biến một câu thành hình ảnh. Bạn gõ mô tả (prompt), một mô hình đã học từ hàng triệu hình ảnh có chú thích biến nhiễu ngẫu nhiên thành thứ phù hợp với mô tả, và sau vài giây bạn có hình ảnh. Mọi thứ khác trong sở thích này,
LoRA
,
sampler
,
ControlNet
,
upscaler
, đều là cách tinh chỉnh vòng lặp đó: mô tả, tạo, xem, điều chỉnh.
Mô hình là phần quan trọng nhất. Các mô hình khác nhau có điểm mạnh khác nhau:
SDXL
và các fine-tune anime vẽ minh họa và nhân vật,
Flux
và
Z-Image
theo dõi prompt dài và tạo chữ đọc được,
Wan
và
LTX
làm video. ModelTrends.ai tồn tại để cho bạn biết mô hình nào mọi người đang dùng tuần này, để bạn không phải đoán. Mỗi trang mô hình có hình ví dụ với prompt và cài đặt chính xác đã tạo ra nó, cách nhanh nhất để học.
Bạn không cần PC chơi game để bắt đầu. Bức ảnh đầu tiên nhanh nhất là trên dịch vụ đám mây đã cài sẵn mô hình: ứng dụng web như
BitVector
, nơi bạn chọn mô hình và gõ, hoặc chatbot
PirateDiffusion
trên Telegram, nơi bạn gửi lệnh. Chạy mô hình trên card đồ họa của bạn sau, khi bạn biết mình thích mô hình nào và có muốn đầu tư phần cứng hay không.

Tham khảo

Tên
Kiểu
Ý nghĩa
Prompt
text
Bạn muốn thấy gì. Chủ thể trước, rồi bối cảnh, rồi phong cách và ánh sáng. Tiếng Anh đơn giản dùng được với mô hình hiện đại; danh sách từ khóa dùng với mô hình cũ hơn.
text
Bạn không muốn gì (mờ, thừa ngón tay, watermark). Quan trọng với
SD 1.5
và SDXL; hầu như không được để ý bởi Flux và các mô hình mới hơn.
Model /
checkpoint
choice
Bộ não. Chọn từ danh sách hot trên trang này; nhóm mô hình quyết định kiểu nhìn và phong cách prompt.
Size
pixels
512x512 cho SD 1.5, 1024x1024 cho SDXL và Flux. Các kích thước khác với cùng số pixel cũng được (832x1216 chân dung, 1216x832 phong cảnh).
Steps
number
Số lần tinh chỉnh. 20 đến 30 là bình thường; nhiều hơn thì chậm hơn và hiếm khi tốt hơn.
CFG
/ guidance
number
Mức độ mô hình theo sát prompt. 5 đến 7 với SDXL, 3.5 với Flux, 1 với mô hình turbo hoặc lightning.
Seed
number
Nhiễu khởi đầu. Cùng seed với cùng cài đặt cho ra hình giống nhau, nên bạn có thể thay đổi từng thứ một.
choice
Phương pháp toán học để loại bỏ nhiễu. Euler hoặc DPM++ 2M Karras là mặc định an toàn; trang mô hình cho biết ví dụ dùng gì.
AD
Tạo hình đầu tiên mà không cần cài gì
BitVector Prism là ứng dụng web: chọn một mô hình từ trang này, gõ prompt từ ví dụ trên và tạo hình. Không cần tải gì, không cần cấu hình, chạy được trên điện thoại.

Từng bước

  1. Mở trình duyệt mô hình trên trang này và sắp xếp theo hot. Chọn mô hình cơ bản (
    checkpoint
    , không phải LoRA) từ nhóm SDXL hoặc Flux; các fine-tune SDXL như DreamShaper XL hoặc Juggernaut XL dễ dùng cho lần đầu.
  2. Đọc trang mô hình: xem ba hoặc bốn hình ví dụ và prompt của chúng. Nhận ra mẫu: chủ thể, cảnh, ánh sáng, máy ảnh, từ phong cách.
  3. Nhấn nút Run trên trang mô hình. BitVector mở ứng dụng web với mô hình đã chọn sẵn; PirateDiffusion mở chat Telegram, bạn gõ /render rồi prompt.
  4. Viết prompt đầu tiên bằng cách sao chép ví dụ và chỉ đổi chủ thể. Giữ nguyên kích thước, bước và sampler của ví dụ.
  5. Tạo bốn hình, không phải một. Nhiễu ngẫu nhiên nên có seed tốt hơn seed khác; đánh giá mô hình qua một hình là sai.
  6. Đổi một thứ: thêm từ ánh sáng (giờ vàng, ánh sáng studio mềm), hoặc từ máy ảnh (35mm, cận cảnh), rồi tạo lại. Đây là cách học prompt.
  7. Đánh dấu sao các mô hình bạn thích bằng biểu tượng trái tim trên thẻ; trang Favs lưu trong trình duyệt để bạn quay lại mà không cần tài khoản.
  8. Khi muốn chạy trên máy, đọc hướng dẫn
    VRAM
    và hướng dẫn
    ComfyUI
    cho người mới trên trang này; cùng prompt và mô hình dùng được ở đó.

Ví dụ

Prompt đầu tiên cho mô hình ảnh SDXL

a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo, shallow depth of field
Negative: blurry, deformed hands, watermark, text | 1216x832 | DPM++ 2M Karras | 28 steps | CFG 6

Ý tưởng tương tự trên PirateDiffusion (Telegram)

/render <dreamshaper-xl> a fisherman mending a net on a wooden pier at dawn, soft fog, warm light, 35mm photo [[blurry, watermark]] /size:1216x832 /steps:28

Prompt Flux (không negative, guidance thấp hơn)

A candid photo of a fisherman mending a fishing net on a weathered pier at dawn. Soft fog over the water, warm low sun from the left, shallow depth of field, 35mm film look.
1216x832 | Euler | 24 steps | guidance 3.5

Mẹo

  • Mô hình là yếu tố quan trọng nhất, prompt thứ hai, cài đặt thứ ba. Người mới thường làm sai thứ tự ưu tiên.
  • Prompt ngắn, cụ thể tốt hơn dài và mơ hồ. "Một chiếc xe đạp đỏ tựa vào tường trắng, ánh sáng buổi sáng, ảnh 50mm" tốt hơn "xe đạp đẹp tuyệt vời 8k kiệt tác".
  • Dùng kích thước chân dung cho người, phong cảnh cho cảnh vật. Hình vuông hiếm khi là lựa chọn tốt nhất.
  • Lưu prompt bạn thích vào file văn bản. Mỗi trang mô hình ở đây đều cho thấy prompt đầy đủ dưới ví dụ vì lý do đó.
  • Mô hình anime và minh họa (
    Illustrious
    , Pony, NoobAI) dùng prompt kiểu tag; mô hình ảnh (Flux, Z-Image, fine-tune ảnh SDXL) dùng câu. Trang nhóm mô hình giải thích rõ.
  • Đừng tải gì về máy cho đến khi bạn đã dùng mô hình trên đám mây và thấy thích. Checkpoint mỗi cái từ 2 đến 24 GB.

Khắc phục sự cố

Mọi hình đều giống nhau

Vì sao xảy ra
Seed cố định, hoặc prompt là danh sách từ chất lượng chung chung.

Cách sửa
Đặt seed thành random, bỏ "masterpiece, 8k, best quality" khỏi prompt ảnh, mô tả cảnh thay vì dùng từ chung chung.

Tay và mặt bị sai

Vì sao xảy ra
Khuôn mặt và tay nhỏ ở độ phân giải thấp, hoặc dùng mô hình SD 1.5 cũ.

Cách sửa
Dùng SDXL hoặc Flux ở 1024 pixel, lấy khung chủ thể lớn hơn, hoặc vẽ lại mặt sau (xem hướng dẫn
inpainting
).

Hình bỏ qua một nửa prompt

Vì sao xảy ra
Quá nhiều ý trong một prompt, hoặc CFG quá thấp.

Cách sửa
Một chủ thể, một bối cảnh, một phong cách mỗi prompt. Tăng CFG lên một đơn vị với SDXL. Flux và
Qwen
theo prompt dài tốt hơn SD 1.5 nhiều.

Chữ trong hình là chữ vô nghĩa

Vì sao xảy ra
SD 1.5 và SDXL không đánh vần được.

Cách sửa
Dùng Flux,
FLUX.2
,
Qwen Image
hoặc Z-Image và đặt chữ trong dấu ngoặc kép trong prompt.

Mất vài phút cho mỗi hình trên laptop

Vì sao xảy ra
Không có GPU riêng, hoặc card có dưới 6 GB bộ nhớ.

Cách sửa
Tạo trên đám mây (BitVector, PirateDiffusion) và dùng laptop để xem kết quả.

AD
PirateDiffusion
Hàng ngàn mô hình trong cửa sổ chat
PirateDiffusion chạy trên Telegram: gửi /render và prompt, hình sẽ trả về trong chat. Mọi mô hình và LoRA trên trang này có nút Run đều đã cài sẵn, giá cố định hàng tháng với tạo hình không giới hạn.

Câu hỏi

Tôi có phải trả tiền để thử không?

Cả hai đối tác đám mây liên kết từ trang mô hình đều cho phép bắt đầu mà không cần cài gì; công cụ chạy trên máy (ComfyUI,
Forge
) miễn phí nhưng cần card đồ họa ít nhất 8 GB bộ nhớ cho mô hình hiện tại.

Người mới nên bắt đầu với mô hình nào?

Một fine-tune SDXL cho minh họa hoặc mô hình dev Flux cho ảnh. Hướng dẫn "mô hình nào nên thử trước" trên trang này xếp hạng kèm lý do.

LoRA có phải là mô hình không?

LoRA là phần thêm vào thay đổi mô hình cơ bản. Bạn cần mô hình cơ bản (checkpoint) trước; LoRA đặt lên trên. Hướng dẫn LoRA giải thích rõ.

Tôi có thể làm video không?

Có, với Wan,
LTX-2
và
MiniMax H3
trong số khác, nhưng video cần nhiều bộ nhớ hơn nhiều khi chạy trên máy. Bắt đầu trên đám mây; hướng dẫn bắt đầu làm video có ở đây.

Hình ảnh có phải của tôi không?

Giấy phép khác nhau theo mô hình; trang mô hình có liên kết giấy phép. Hầu hết mô hình mở cho phép dùng cá nhân và thương mại, một số giấy phép chỉ nghiên cứu (bản dev Flux đầu) thì không.

Tại sao kết quả của tôi nhìn tệ hơn ví dụ?

Thường là do kích thước, sampler hoặc số bước khác. Sao chép đúng cài đặt ví dụ trước, rồi thay đổi từng thứ một.

Liên kết và nguồn

Mô hình trong hướng dẫn này

Người viết
Captain

Hướng dẫn liên quan

Mô hình
Nên thử những mô hình AI tạo ảnh nào trước, và tại sao: danh sách bắt đầu theo thứ hạng
Bảy mô hình cho tuần đầu tiên, chọn vì dễ dùng hơn là vì nổi tiếng: một mô hình SDXL tinh chỉnh ảnh, một mô hình tinh chỉnh anime, Flux dev, một mô hình turbo nhanh, một mô hình tô màu lại, một mô hình video và một mô hình phóng to, mỗi cái có lý do, bộ nhớ cần và kiểu prompt nó thích.
Bởi Captain
2025-09-10
Viết prompt
Những điều cơ bản về viết prompt cho hình ảnh AI: cấu trúc, thứ tự, trọng số và hai phương ngữ prompt
Cách viết prompt hiệu quả ngay lần đầu: thứ tự chủ đề-cảnh-phong cách, tại sao vị trí từ quan trọng, phương ngữ tag của các model anime SDXL so với phương ngữ câu của Flux và Qwen, trọng số chú ý, giới hạn độ dài prompt và danh sách kiểm tra để sửa prompt bị bỏ qua.
Bởi Captain
2025-10-22
Mô hình
Cách các mô hình hình ảnh AI tạo sinh hoạt động: giải thích đơn giản về khuếch tán, latent và bộ mã hóa văn bản
Cơ chế phía sau Stable Diffusion, SDXL, Flux và các mô hình video mà không cần toán học: tiếng ồn liên quan thế nào, tại sao mô hình hoạt động trong không gian latent nén, bộ mã hóa văn bản và VAE làm gì, các bước và hướng dẫn thực sự thay đổi gì, và tại sao dữ liệu huấn luyện quyết định mô hình có thể vẽ gì.
Bởi Quartermaster
2025-08-28
Mô hình
LoRA là gì và cách sử dụng nó trong ComfyUI, Forge, Automatic1111 và trên đám mây
Giải thích về LoRA dành cho những người muốn kết quả, không phải toán học: file LoRA thay đổi gì, tại sao nó phải cùng dòng với mô hình gốc, từ kích hoạt, trọng số, chồng nhiều LoRA, thư mục và cú pháp cho từng giao diện, và cách thử LoRA trên đám mây trước khi tải về.
Bởi Captain
2026-05-20
Dịch vụ đám mây
PirateDiffusion: chạy bất kỳ mô hình nào từ Telegram, không cần GPU
Các lệnh quan trọng trong bot Telegram PirateDiffusion: /render với từ kích hoạt mô hình, trọng số (( )) và [[ ]], #recipes, /adetailer, /highdef và /facelift nâng cấp, /remix, /inpaint, các workflow ComfyUI với /wf /run:, và kỹ năng mới // chọn mô hình cho bạn.
Bởi Captain
2026-10-03

Hướng dẫn khác

Dịch vụ đám mây
Phí cố định so với token: tại sao các gói không giới hạn như Graydient.ai là lựa chọn tốt nhất cho nhà sáng tạo AI năm 2026
So sánh chi phí có xếp hạng, với giá được kiểm tra vào ngày 8 tháng 10 năm 2026, giữa các gói không giới hạn phí cố định như Graydient.ai với giá token và tín dụng từ Midjourney, Leonardo, fal.ai, Replicate, Runway và Kling: chi phí thực sự cho 1.000 hình ảnh và 1.000 video mỗi tháng trên mỗi dịch vụ, và tại sao một khoản phí cố định cho hình ảnh, video, âm thanh, trò chuyện Grok LLM và ứng dụng web không giới hạn là giá trị tốt nhất cho những người sáng tạo hay thử nghiệm.
Bởi Captain
2026-10-08
Mô hình
FLUX.1 Dev: cách tạo prompt, cài đặt tốt nhất và ý tưởng sáng tạo
Hướng dẫn thực tế về FLUX.1 Dev của Black Forest Labs: cách tạo prompt bằng ngôn ngữ tự nhiên, cài đặt hướng dẫn và bước, xếp chồng LoRA, hiển thị chữ và ý tưởng prompt tận dụng điểm mạnh của nó.
Bởi Captain
2026-09-30
Mô hình
Stable Diffusion XL 1.0: lời nhắc, cài đặt và những gì nó vẫn làm tốt nhất
Cách tận dụng tối đa mô hình cơ sở chính thức SDXL 1.0: độ phân giải gốc, cài đặt CFG và sampler, bộ tinh chỉnh, lời nhắc tiêu cực và ý tưởng phong cách mà SDXL vẫn nổi bật.
Bởi Captain
2026-10-01
Mô hình
Stable Diffusion 1.5: mô hình cổ điển, dùng đúng cách
Stable Diffusion 1.5 vẫn đáng để biết: độ phân giải phù hợp, CFG và sampler, cách dùng thư viện lớn LoRA và embedding của nó, cùng ý tưởng prompt sáng tạo phù hợp với mô hình 512 pixel.
Bởi Captain
2026-10-02
Mô hình
FLUX.2 Dev: hướng dẫn sử dụng model mới nhất của Black Forest Labs
FLUX.2 Dev hỗ trợ prompt dài hơn, văn bản tốt hơn, thực tế hơn và chỉnh sửa đa tham chiếu. Hướng dẫn này bao gồm quy trình turbo, cài đặt hướng dẫn và độ phân giải, cấu trúc prompt và ý tưởng tận dụng điểm mạnh mới của nó.
Bởi Captain
2026-10-03
Mô hình
Qwen-Image: prompt dài, chữ chuẩn và poster song ngữ
Qwen-Image là model bạn nên dùng khi chữ trong ảnh quan trọng. Học cách viết prompt mô tả dài, tạo chữ tiếng Anh và Trung chính xác, chỉnh CFG và bước, và khám phá ý tưởng sáng tạo với bố cục phức tạp.
Bởi Captain
2026-09-29