Bộ công cụ chuyển văn bản thành giọng nói & nhân bản giọng chất lượng cao, nhiều ngôn ngữ.
Coqui TTS là thư viện text-to-speech mạnh mẽ với nhiều model chất lượng cao, gồm cả nhân bản giọng nói (voice cloning) từ mẫu ngắn. Nó hỗ trợ đa ngôn ngữ và chạy cục bộ. Dùng để tạo giọng đọc cho video, podcast, hoặc trợ lý nói.
Chuyển giọng thành chữ, chữ thành giọng, nhân bản voice & tách nhạc.
Các bước cơ bản để bắt đầu.
Cài `pip install TTS`Chạy `tts --text 'Xin chào' --out_path out.wav`Chọn model đa ngôn ngữ hoặc voice-clone (XTTS)Nhận dạng & chuyển giọng nói thành văn bản đa ngôn ngữ, độ chính xác cao; làm phụ đề, biên bản họp.
Mô hình tạo âm thanh/giọng nói đa ngôn ngữ, kể cả tiếng cười, nhạc, hiệu ứng.
Nhân bản giọng nói tức thì từ mẫu ngắn, điều khiển được cảm xúc, nhịp điệu, đa ngôn ngữ.