Tải & chạy LLM (Llama, Mistral, Qwen…) cục bộ chỉ bằng một lệnh; có API tương thích OpenAI.
Ollama biến việc chạy mô hình AI trên máy cá nhân thành đơn giản như cài một app. Chỉ một lệnh là tải xong model và bật server ngay trên máy bạn, kèm API tương thích OpenAI để mọi công cụ khác cắm vào. Dữ liệu không rời máy, không tốn phí API, chạy được cả khi mất mạng.
Tải & chạy các mô hình LLM ngay trên máy bạn — trái tim cấp trí tuệ cho cả nhà máy.
Các bước cơ bản để bắt đầu.
Tải app tại ollama.com hoặc cài bằng script chính thứcChạy `ollama pull llama3.1` để tải modelChạy `ollama run llama3.1` để chat thử ngay trong terminalTrỏ app của bạn tới `http://localhost:11434/v1` (OpenAI API)Chạy LLM cực nhẹ trên CPU/GPU thường, kể cả máy yếu; nền tảng cho hầu hết công cụ chạy AI cục bộ.
Ứng dụng desktop chạy chatbot AI hoàn toàn offline, riêng tư, không cần internet hay GPU khủng.
Thư viện gọi nhiều mô hình AI qua các nguồn khác nhau; dùng để thử nghiệm, học tập.