Tính năng chủ lực

Nhân bản giọng nói của bạn bằng AI

Gửi cho VocaTTS một đoạn ghi âm cách bạn nói chuyện và nhận về phiên bản tổng hợp của giọng bạn. Dùng nó để đọc kịch bản, lồng tiếng phụ đề và đóng một vai trong audio nhiều người nói — không cần tự thu từng bản.

Tạo giọng nhân bản

Đăng nhập với gói Basic trở lên. Bạn sẽ ghi hai đoạn: một mẫu giọng tự nhiên và một câu xác nhận đồng ý.

Đăng nhập để tạo giọng cá nhân

Giọng cá nhân được lưu vào tài khoản và dùng được trong Text to Speech, Multi-Voice và SRT to Speech.

Đăng nhập

Quy trình nhân bản

  1. 1

    Ghi mẫu giọng

    Nói 10–30 giây theo đúng cách bạn muốn giọng AI phát ra. Năng lượng và ngữ điệu được giữ lại, nên đừng đọc đều đều, dè dặt.

  2. 2

    Ghi câu đồng ý

    Chính người đó đọc một câu cố định xác nhận mình là chủ giọng. Phải đọc đúng từng chữ, ở một trong 30 ngôn ngữ được hỗ trợ.

  3. 3

    Tạo giọng và sử dụng

    Khi giọng sẵn sàng, nó xuất hiện trong mục “Giọng của tôi” ở mọi ô chọn giọng, cạnh các giọng có sẵn.

Để có mẫu giọng tốt

  • Dùng micro tai nghe hoặc micro điện thoại, cách miệng khoảng một bàn tay, thay vì micro laptop.
  • Chọn phòng nhỏ, yên tĩnh. Tiếng vang, tiếng quạt, nhạc nền đều lọt vào giọng.
  • Cố gắng ghi 20–30 giây; đọc hết đoạn gợi ý sớm thì cứ nói tiếp tự nhiên.
  • File WAV hoặc MP3 sạch từ micro thật thường cho kết quả tốt hơn ghi trên trình duyệt.

Dùng giọng nhân bản ở đâu

Phù hợp với

  • Người làm nội dung đăng bài thường xuyên, cần giọng đồng nhất giữa các video
  • Người làm khoá học cần cập nhật bài giảng khi sản phẩm hay giáo trình thay đổi
  • Đội sản phẩm làm lại lời thuyết minh hướng dẫn khi giao diện đổi
  • Podcaster cần sửa một câu mà không phải dựng lại micro

Yêu cầu và giới hạn

Mẫu giọng
10–30 giây nói tự nhiên, ghi trực tiếp hoặc tải file
Ghi âm đồng ý
2–30 giây, đọc nguyên văn, cùng người nói, 30 ngôn ngữ hỗ trợ
Gói
Basic trở lên (3 slot giọng riêng; Premium và Studio: 5)
Lưu trữ
Tối đa một năm; xoá bất cứ lúc nào để lấy lại slot
Credit
Audio tạo bằng giọng nhân bản tính theo mức của giọng Gemini
Khu vực
Chưa hỗ trợ tại Anh, EEA, Thuỵ Sĩ, Illinois và Texas

Nên lưu ý

  • Giọng nhân bản bám theo bản ghi: mẫu ồn hoặc đều đều cho ra giọng ồn hoặc đều đều.
  • Diễn xuất quá mạnh, hát hay la hét không phải mục tiêu ổn định cho giọng nhân bản.
  • Bản ghi gốc được chuyển đổi và gửi tới Google Gemini để tạo giọng; VocaTTS không giữ file thô.

Câu hỏi thường gặp

Q: Bản ghi âm cần dài bao nhiêu?

A: Mẫu giọng phải dài 10–30 giây. Khoảng 20–30 giây nói tự nhiên, có năng lượng cho giọng đầy đặn nhất.

Q: Vì sao phải ghi âm câu đồng ý?

A: Google Gemini — nơi tạo giọng — yêu cầu người nói xác nhận quyền sở hữu bằng cách đọc một câu cố định. Việc này bảo vệ mọi người khỏi bị nhân bản giọng khi chưa cho phép.

Q: Có được nhân bản giọng người khác không?

A: Chỉ khi người đó cho phép rõ ràng và tự ghi âm câu đồng ý. Không được nhân bản giọng mà bạn không có quyền sử dụng.

Q: Giọng nhân bản có dùng với file SRT được không?

A: Được. Chọn giọng trong mục “Giọng của tôi” ở công cụ SRT thành audio, file phụ đề sẽ được đọc bằng giọng của bạn và khớp thời gian từng dòng.

Q: Có xoá được giọng nhân bản không?

A: Được, bất cứ lúc nào trong công cụ hoặc mục “Giọng của tôi”. Xoá giọng sẽ xoá khỏi Gemini và trả lại slot cho gói của bạn.

Q: Giọng nhân bản dùng được bao lâu?

A: Gemini lưu giọng tối đa một năm. Sau đó bạn có thể tạo lại từ bản ghi âm mới.

Không dùng được tính năng nhân bản?

Nếu bạn ở khu vực chưa hỗ trợ, hoặc không muốn dùng giọng thật, Thiết kế giọng tạo một giọng nguyên bản từ đoạn mô tả bằng chữ.