Tinh chỉnh (fine-tune) LLM nhanh gấp 2 lần, tốn ít VRAM hơn — tạo model riêng của bạn.
Unsloth giúp huấn luyện/tinh chỉnh các model như Llama, Mistral, Qwen, Gemma nhanh hơn nhiều lần và tiết kiệm bộ nhớ GPU. Nó tối ưu sâu phần nhân tính toán nên bạn có thể fine-tune ngay trên GPU phổ thông hoặc Google Colab miễn phí. Kết quả xuất ra được sang GGUF để chạy với Ollama/llama.cpp.
Tải & chạy các mô hình LLM ngay trên máy bạn — trái tim cấp trí tuệ cho cả nhà máy.
Các bước cơ bản để bắt đầu.
Mở notebook mẫu trên Colab hoặc cài `pip install unsloth`Nạp model nền + tập dữ liệu của bạnChạy huấn luyện LoRA, sau đó export GGUFTải & chạy LLM (Llama, Mistral, Qwen…) cục bộ chỉ bằng một lệnh; có API tương thích OpenAI.
Chạy LLM cực nhẹ trên CPU/GPU thường, kể cả máy yếu; nền tảng cho hầu hết công cụ chạy AI cục bộ.