Biến MỘT ảnh chân dung + một đoạn tiếng nói thành video khuôn mặt nói chuyện, cử động đầu tự nhiên.
SadTalker tạo video 'talking head' từ một ảnh tĩnh và một đoạn audio: khuôn mặt sẽ nói khớp âm, chớp mắt và cử động đầu tự nhiên. Nó dựng chuyển động 3D của đầu nên sống động hơn lip-sync thuần. Có extension cho Stable Diffusion WebUI.
Tạo, chỉnh, phục hồi & tách vật thể trong ảnh — cả phòng thiết kế trong một máy.
Các bước cơ bản để bắt đầu.
Clone repo, cài phụ thuộc theo READMETải các checkpoint model được chỉ địnhChạy `inference.py` với ảnh + audio đầu vàoGiao diện web đầy đủ nhất để tạo ảnh bằng Stable Diffusion: txt2img, img2img, inpaint, LoRA.
Thư viện thị giác máy tính số 1 — xử lý ảnh/video, phát hiện vật thể, nền tảng cho mọi tool hình ảnh.