Dựng hội thoại
Audio nhiều người nói từ một kịch bản
Dựng hội thoại từng câu một. Mỗi câu thuộc về một preset người nói — gồm giọng và cao độ, tốc độ, âm lượng riêng — và VocaTTS ghép mọi câu, cùng khoảng nghỉ bạn đặt, thành một file hoàn chỉnh.
Chi tiết giới hạn
Chưa có giọng đọc nào. Hãy tạo preset giọng đọc (Ngôn ngữ → Tốc độ → Cao độ).
Soạn thảo kịch bản
| # | Thời gian | Giọng / Số đoạn | Trạng thái | Thao tác |
|---|---|---|---|---|
| Chưa có dữ liệu | ||||
Một đoạn hội thoại được dựng thế nào
- 1
Tạo preset người nói
Mỗi nhân vật một preset: chọn giọng có sẵn, giọng nhân bản hoặc giọng thiết kế, rồi chỉnh cao độ, tốc độ, âm lượng.
- 2
Viết từng câu
Thêm một block cho mỗi câu thoại, chọn ai nói và đặt khoảng nghỉ trước câu tiếp theo.
- 3
Xuất một file
Nghe thử từng câu, rồi tạo cả đoạn hội thoại thành một file audio duy nhất.
Có thể làm gì
Podcast hai người dẫn
Viết cuộc trò chuyện giữa hai người dẫn với giọng khác nhau và quãng nghỉ tự nhiên.
Hội thoại học ngoại ngữ
Dựng các tình huống giao tiếp, có khoảng nghỉ để người học nhắc lại.
Truyện audio
Người dẫn chuyện và từng nhân vật đều có giọng riêng.
Kịch bản đào tạo
Đóng vai khách hàng và nhân viên cho đào tạo hội nhập và chăm sóc khách hàng.
Mẹo để hội thoại tự nhiên
- Mỗi block là một lượt nói; đoạn độc thoại dài nên chia thành vài block.
- Đặt tốc độ hơi khác nhau giữa các người nói để dễ phân biệt.
- Khoảng nghỉ ngắn (vài trăm mili giây) tạo cảm giác trò chuyện; khoảng dài hợp khi chuyển cảnh.
- Bản nháp được tự lưu trên trình duyệt trong lúc bạn viết.
Yêu cầu và giới hạn
- Kịch bản
- Tối thiểu hai block; số block tối đa tuỳ gói
- Mỗi block
- Preset người nói (giọng, cao độ, tốc độ, âm lượng) và khoảng nghỉ sau câu
- Giọng
- Giọng có sẵn cùng giọng nhân bản và giọng thiết kế
- Đầu ra
- Một file audio ghép
- Credit
- Tính theo ký tự, theo mức của từng giọng được dùng
Câu hỏi thường gặp
Q: Một đoạn hội thoại có bao nhiêu người nói?
A: Bao nhiêu preset tuỳ bạn. Giới hạn nằm ở số block mỗi lần tạo, phụ thuộc vào gói.
Q: Có trộn giọng nhân bản với giọng có sẵn được không?
A: Được. Preset dùng được mọi giọng trong ô chọn, kể cả giọng trong mục “Giọng của tôi”.
Q: Có xuất file riêng cho từng người nói không?
A: Không. Công cụ xuất cả đoạn hội thoại thành một file. Muốn mỗi đoạn một file, hãy dùng chế độ nhiều đoạn trong Text to Speech.
Q: Kịch bản có được lưu không?
A: Bản nháp được giữ trên trình duyệt trong lúc bạn làm, tải lại trang cũng không mất.
Đã có phụ đề kèm nhãn người nói?
Gắn nhãn [A], [B] cho các dòng trong file SRT và gán giọng theo người nói ở công cụ SRT thành audio — thời gian sẽ bám theo video của bạn.