Dựng hội thoại

Audio nhiều người nói từ một kịch bản

Dựng hội thoại từng câu một. Mỗi câu thuộc về một preset người nói — gồm giọng và cao độ, tốc độ, âm lượng riêng — và VocaTTS ghép mọi câu, cùng khoảng nghỉ bạn đặt, thành một file hoàn chỉnh.

Dùng 0/0 tín dụng. Reset: N/A.

Chi tiết giới hạn

Tối đa ký tự / khối: 2,000
Tối đa khối: 0/0
+Credits / khối: 0

Chưa có giọng đọc nào. Hãy tạo preset giọng đọc (Ngôn ngữ → Tốc độ → Cao độ).

Soạn thảo kịch bản

0 block • 0 ký tựThời lượng ước tính: ~1 giây
Chưa có dữ liệu

Một đoạn hội thoại được dựng thế nào

  1. 1

    Tạo preset người nói

    Mỗi nhân vật một preset: chọn giọng có sẵn, giọng nhân bản hoặc giọng thiết kế, rồi chỉnh cao độ, tốc độ, âm lượng.

  2. 2

    Viết từng câu

    Thêm một block cho mỗi câu thoại, chọn ai nói và đặt khoảng nghỉ trước câu tiếp theo.

  3. 3

    Xuất một file

    Nghe thử từng câu, rồi tạo cả đoạn hội thoại thành một file audio duy nhất.

Có thể làm gì

  • Podcast hai người dẫn

    Viết cuộc trò chuyện giữa hai người dẫn với giọng khác nhau và quãng nghỉ tự nhiên.

  • Hội thoại học ngoại ngữ

    Dựng các tình huống giao tiếp, có khoảng nghỉ để người học nhắc lại.

  • Truyện audio

    Người dẫn chuyện và từng nhân vật đều có giọng riêng.

  • Kịch bản đào tạo

    Đóng vai khách hàng và nhân viên cho đào tạo hội nhập và chăm sóc khách hàng.

Mẹo để hội thoại tự nhiên

  • Mỗi block là một lượt nói; đoạn độc thoại dài nên chia thành vài block.
  • Đặt tốc độ hơi khác nhau giữa các người nói để dễ phân biệt.
  • Khoảng nghỉ ngắn (vài trăm mili giây) tạo cảm giác trò chuyện; khoảng dài hợp khi chuyển cảnh.
  • Bản nháp được tự lưu trên trình duyệt trong lúc bạn viết.

Yêu cầu và giới hạn

Kịch bản
Tối thiểu hai block; số block tối đa tuỳ gói
Mỗi block
Preset người nói (giọng, cao độ, tốc độ, âm lượng) và khoảng nghỉ sau câu
Giọng
Giọng có sẵn cùng giọng nhân bản và giọng thiết kế
Đầu ra
Một file audio ghép
Credit
Tính theo ký tự, theo mức của từng giọng được dùng

Câu hỏi thường gặp

Q: Một đoạn hội thoại có bao nhiêu người nói?

A: Bao nhiêu preset tuỳ bạn. Giới hạn nằm ở số block mỗi lần tạo, phụ thuộc vào gói.

Q: Có trộn giọng nhân bản với giọng có sẵn được không?

A: Được. Preset dùng được mọi giọng trong ô chọn, kể cả giọng trong mục “Giọng của tôi”.

Q: Có xuất file riêng cho từng người nói không?

A: Không. Công cụ xuất cả đoạn hội thoại thành một file. Muốn mỗi đoạn một file, hãy dùng chế độ nhiều đoạn trong Text to Speech.

Q: Kịch bản có được lưu không?

A: Bản nháp được giữ trên trình duyệt trong lúc bạn làm, tải lại trang cũng không mất.

Đã có phụ đề kèm nhãn người nói?

Gắn nhãn [A], [B] cho các dòng trong file SRT và gán giọng theo người nói ở công cụ SRT thành audio — thời gian sẽ bám theo video của bạn.