Đồng bộ khẩu hình (môi) khớp với bất kỳ đoạn tiếng nói nào — 'lồng tiếng' cho khuôn mặt trong video.
Wav2Lip chỉnh chuyển động môi của một khuôn mặt trong video sao cho khớp với một đoạn âm thanh bất kỳ. Nhờ đó bạn có thể 'lồng tiếng' cho nhân vật, đổi ngôn ngữ hay làm avatar nói theo giọng mới. Là mô hình lip-sync kinh điển, nền tảng cho nhiều công cụ avatar.
Tạo, chỉnh, phục hồi & tách vật thể trong ảnh — cả phòng thiết kế trong một máy.
Các bước cơ bản để bắt đầu.
Clone repo, cài phụ thuộc theo READMETải checkpoint Wav2Lip được chỉ địnhChạy `inference.py` với video + file audioGiao diện web đầy đủ nhất để tạo ảnh bằng Stable Diffusion: txt2img, img2img, inpaint, LoRA.
Thư viện thị giác máy tính số 1 — xử lý ảnh/video, phát hiện vật thể, nền tảng cho mọi tool hình ảnh.