Initializing, please wait a moment

Chuyển Văn Bản Thành Giọng Nói Khi Nào Nên Dùng

Công cụ Chuyển Văn Bản Thành Giọng Nói đáng dùng khi bạn cần giọng đọc mà không phải cài đặt gì và không đưa văn bản cho dịch vụ nào. Hướng dẫn này nói rõ khi nào phù hợp và khi nào không.

Trả lời nhanh. Hãy dùng khi bạn muốn giọng đọc nhất quán và tải về được, tạo ngay trong trình duyệt. Nên tránh khi đường truyền hạn chế hoặc trên điện thoại ít bộ nhớ, vì lần tải mô hình khoảng 380 MB là chi phí thật.

Khi nào phù hợp

Phù hợp khi văn bản mang tính riêng tư và không nên rời khỏi thiết bị, khi bạn cần tệp MP3 hoặc WAV cho video hay podcast, và khi một loạt đoạn thu phải nghe giống nhau: mười giọng đến từ mô hình đã tải chứ không từ hệ điều hành, nên cùng một đoạn tạo trên Windows sẽ nghe y như trên máy Mac hoặc điện thoại Android.

Khi nào không phù hợp

Không phù hợp với đường truyền tính dung lượng hoặc chậm, vì mô hình khoảng 380 MB phải tải một lần, cũng không phù hợp với máy ít bộ nhớ vì mô hình có thể không tải được - trong cả hai trường hợp trang sẽ báo rõ và mời dùng giọng nhanh của thiết bị, loại giọng thay đổi theo từng máy. Cũng không có phát tức thì: mỗi đoạn được kết xuất xong mới nghe được, nên văn bản rất dài sẽ chờ lâu hơn.

Những gì cần lường trước

Các lựa chọn giọng, ngôn ngữ, tốc độ và chất lượng nằm phía trên khung văn bản. Việc tạo giọng dùng GPU qua WebGPU khi trình duyệt hỗ trợ, còn lại dùng CPU qua WebAssembly; trang cho biết đang dùng cách nào, vì chế độ CPU chậm hơn rõ rệt với văn bản dài.

Những con số đáng chú ý

Số giọng có sẵn10 (M1-M5, F1-F5)
Số ngôn ngữ của mô hình31
Dung lượng tải mô hình một lầnkhoảng 380 MB
Chất lượng âm thanh44,1 kHz, một kênh
Tốc độ0,8x đến 1,5x
Bậc chất lượng4, 8 hoặc 16
Giới hạn văn bản mỗi lần20.000 ký tự

Câu hỏi thường gặp

Giọng nói có giống nhau trên mọi thiết bị không?

Có. Mười giọng thuộc mô hình đã tải, không thuộc hệ điều hành, nên kết quả giống nhau trên Windows, macOS hay Android.

Nếu thiết bị không chạy được mô hình thì sao?

Trang sẽ báo và hiện giọng nhanh của thiết bị, kèm bộ tạo tệp nhỏ gọn. Đó là hướng dự phòng: giọng khác nhau theo máy và nghe máy móc hơn.

← Quay lại công cụ tiện ích

Related tools:

  • Text to Speech - Text to Speech with 10 neural voices running in your browser: read text or an SRT transcript aloud
  • Speech to Text - Dictate live with your mic, or transcribe a saved recording on your own device with Whisper AI -