Huấn luyện LLM bằng C/CUDA thuần, không framework — tối giản, nhanh và cực kỳ đáng học.
llm.c là dự án huấn luyện LLM (như GPT-2/GPT-3) viết bằng C và CUDA thuần, không phụ thuộc PyTorch. Nó cho thấy toàn bộ phép tính của một mô hình ngôn ngữ ở mức thấp nhất, rất gọn và nhanh. Đây là 'giáo trình sống' cho ai muốn hiểu LLM tới tận phần cứng.
Tải & chạy các mô hình LLM ngay trên máy bạn — trái tim cấp trí tuệ cho cả nhà máy.
Các bước cơ bản để bắt đầu.
Clone repo, cài CUDA toolkit nếu dùng GPUBiên dịch bằng `make`Chạy script huấn luyện theo READMETải & chạy LLM (Llama, Mistral, Qwen…) cục bộ chỉ bằng một lệnh; có API tương thích OpenAI.
Chạy LLM cực nhẹ trên CPU/GPU thường, kể cả máy yếu; nền tảng cho hầu hết công cụ chạy AI cục bộ.