Đóng gói cả model + engine vào MỘT file chạy được trên mọi hệ điều hành — tải về là chạy, không cài gì.
llamafile (của Mozilla) gộp trọng số model và engine llama.cpp vào một tệp thực thi duy nhất chạy được trên Windows, macOS, Linux mà không cần cài đặt. Bạn chỉ tải một file, chạy, là có ngay chatbot cục bộ kèm giao diện web và API OpenAI. Cực kỳ tiện cho phân phối AI offline.
Tải & chạy các mô hình LLM ngay trên máy bạn — trái tim cấp trí tuệ cho cả nhà máy.
Các bước cơ bản để bắt đầu.
Tải một file .llamafile từ repo/releaseCấp quyền chạy (chmod +x) rồi khởi độngMở trình duyệt vào địa chỉ in ra để chatTải & chạy LLM (Llama, Mistral, Qwen…) cục bộ chỉ bằng một lệnh; có API tương thích OpenAI.
Chạy LLM cực nhẹ trên CPU/GPU thường, kể cả máy yếu; nền tảng cho hầu hết công cụ chạy AI cục bộ.