01 — Chọn model AI
02 — Mức nén (Quantization)
Mức nén Q4_K_M
Nén ít → chất lượng cao, cần nhiều bộ nhớ | Nén nhiều → tiết kiệm bộ nhớ, chất lượng giảm nhẹ
Chọn model để xem link GGUF trên HuggingFace
👈 Chọn một model AI ở bên trái để xem cần GPU gì