4 chế độ trong 1 ứng dụng: Sao chép giọng từ 5–10 giây âm thanh mẫu, Văn bản sang giọng nói theo thuộc tính, Hội thoại nhiều giọng cho podcast/audio drama, và Giọng nói sang văn bản có dấu thời gian. 600+ ngôn ngữ, offline hoàn toàn.
Đúng cấu trúc giao diện Voice Studio
Clone giọng từ 5–10s âm thanh mẫu.
Tạo giọng mới từ thuộc tính, không cần mẫu.
Nhiều nhân vật, mỗi người một giọng. Podcast, audio drama.
Bóc tách lời nói, xuất .txt hoặc .srt.
Dịch .srt bằng LLM — khoá cứng timing, giữ nguyên số dòng.
Tải model giọng đọc / nhận dạng, chọn LLM, xem phần cứng.
Bật server nội bộ cho n8n, Make hay Story Machine gọi vào.
App đi kèm <b>30 giọng mẫu sẵn</b> (nam/nữ, nhiều chất giọng). Lưu thêm giọng tự tạo, bấm <b>⭐</b> để pin yêu thích. Dùng được trong cả Sao chép giọng nói, Văn bản sang giọng nói và Hội thoại nhiều giọng. Sao lưu / phục hồi qua file <code>.vcp</code> để chia sẻ giữa các máy.
Ảnh chụp trực tiếp từ ứng dụng đang chạy, không phải mockup.
Mẫu 5–10 giây bên trái, văn bản cần đọc bên phải. <b>Kho giọng nói</b> nằm ngay dưới với 30 giọng mẫu sẵn và giọng bạn tự lưu.

Viết kịch bản theo cú pháp <code><Tên>: lời thoại</code>, gán mỗi nhân vật một giọng riêng, rồi đẩy cả kịch bản vào <b>hàng chờ tạo</b>.

Số dòng và mốc thời gian <b>bất biến</b> — AI chỉ được đổi chữ. Có bảng nhất quán chốt văn phong, thuật ngữ và cách xưng hô cho cả file.

Bật server nội bộ rồi để n8n, Make, script Python — hay <b>G-Labs Story Machine</b> — gọi vào tạo giọng. Có sẵn khoá API, body mẫu và ví dụ cURL.

Từ mẫu âm thanh đến file WAV / MP3