Model clone chỉ dùng trong provider đã tạo. PVC cần dataset và xác minh chính chủ tại ElevenLabs.
Clone giọng từ audio mẫu
Một danh tính giọng, nhiều liên kết provider. Chọn nguồn audio và tạo binding riêng cho VieNeu hoặc ElevenLabs.
Audio 5–15 giây, một người nói, ít nhiễu và không có nhạc nền sẽ giúp giọng tham chiếu ổn định hơn. Khuyến nghị này dành cho VieNeu / Local. IVC tuân theo yêu cầu ElevenLabs; PVC cần dataset dài hơn và xác minh chính chủ tại provider.
Huấn luyện giọng chuyên sâu
JAVIS Voice Studio Classic giữ workflow hằng ngày gọn. Dataset, LoRA, benchmark và kiểm định model được mở trong Studio/LAB để tránh làm nặng giao diện này.
Đang đọc trạng thái...
Audio / Video → Text
Nhận dạng media, kiểm tra bản chép lời và chuyển nội dung sang sản xuất giọng nói.
Chưa chọn tệp.
Ngôn ngữ nguồn dùng để chép lời; không dịch văn bản.
ElevenLabs STT là dịch vụ online. Media được gửi tới ElevenLabs khi bạn bấm Nhận dạng; có thể tính credits theo tài khoản. Chọn tệp chưa gửi dữ liệu. Tệp tạm trên máy được xóa sau xử lý; bản gốc không thay đổi.
Đang kiểm tra cấu hình STT…
Làm sạch cơ bản: khoảng trắng + dấu lặp + khoảng cách dấu câu. Xóa từ lặp là tùy chọn riêng; giữ nguyên dấu tiếng Việt. Luôn kiểm tra nội dung trước khi tạo giọng.
SRT cần timestamps từ STT.
Hàng đợi dùng Engine + Voice đang chọn ở Tạo giọng (tối đa 250 mục). Kịch bản mở bước xem trước và mapping nhân vật trước khi tạo queue.
Nhật ký
Sự kiện vận hành và trợ giúp nhanh của phiên làm việc hiện tại.
——JAVIS Voice Studio ClassicTạo giọng: chọn engine và voice rồi tạo audio. Clone: dùng reference audio với VieNeu. Hàng đợi: tối đa 100 đoạn, có thể kéo đổi thứ tự, dán kịch bản, nghe toàn bộ và xuất file truyện.
