Thử tạo giọng đọc riêng từ mẫu thu, trong cùng một giao diện chuẩn bị dữ liệu.
GPT-SoVITS kết hợp tạo giọng từ mẫu với các bước tách giọng, chia bản thu và gắn văn bản. Bạn có thể thử nghiệm giọng riêng rồi tinh chỉnh bằng dữ liệu của mình; chất lượng còn tùy mẫu thu, ngôn ngữ và cấu hình.
Điểm nổi bật
- Tổng hợp theo mẫu và tinh chỉnh giọng.
- Có tách giọng, chia dữ liệu, ASR và gán văn bản trong WebUI.
- README liệt kê Anh, Nhật, Hàn, Quảng Đông và Trung cho suy luận liên ngôn ngữ.
Dùng khi nào?
Chuẩn bị tập đọc của chính bạn để thử quy trình tạo voice ở ngôn ngữ được hỗ trợ.
Bắt đầu ra sao?
Chọn gói Windows hoặc môi trường phù hợp theo hướng dẫn; tải model từ liên kết chính chủ.
Mở hướng dẫn cài đặt chính chủCần biết trước khi dùng
Không mặc định hỗ trợ tiếng Việt. README cảnh báo huấn luyện GPU Mac có vấn đề chất lượng; kiểm tra quyền của dữ liệu, checkpoint và người có giọng được dùng.
SẴN SÀNG CHO AI CỦA BẠN
Copy vào Gemini, Codex hoặc Claude. AI sẽ kiểm tra cách dùng và hỏi thông tin cần thiết để bắt đầu.
