Trả lời ngắn gọn: Sách nói AI là âm thanh theo chương được tạo từ bản thảo. Công cụ tải tệp như ElevenLabs Audiobooks nhận EPUB và nhận diện chương. TextSpeech là công cụ làm sách nói dựa trên thao tác dán: sao chép từ Word hoặc Google Docs, dán tối đa một chương mỗi lần, tuân thủ giới hạn ký tự mỗi lượt tạo và xuất MP3 bằng gói trả phí. Cách này phù hợp với khóa học độc lập, truyện nhiều kỳ và sách kiểu podcast, không phải “tải tiểu thuyết 90 nghìn từ tiếng Anh rồi nhận một tệp sau năm phút”.
Công việc chia thành hai dạng. Công cụ tạo sách nói AI hoặc cho tải tệp EPUB/sách điện tử, hoặc cho tạo sách nói từ văn bản từng chương. Hãy biết rõ mình đang mua loại nào.
Đối chiếu tài liệu chính thức ngày 14 tháng 9 năm 2026. Đây là quy trình dựa trên tài liệu, không phải bài thử nghe trực tiếp. Bạn phải có quyền âm thanh đối với văn bản.
Công cụ sách nói AI và trình chuyển đổi EPUB
| Nền tảng / hướng dẫn | Cách nhập | Xử lý chương | Điểm khác của TextSpeech |
|---|---|---|---|
| ElevenLabs Audiobooks | Tải EPUB | Tự nhận diện chương; phân vai nhiều nhân vật | Không tải tệp, dán từ trình soạn thảo |
| AudiobookGen | Tải EPUB | Quy trình chuyển đổi cả sách | Chia chương thủ công, tự kiểm soát lượng dán |
| Audie.ai | Tải bản thảo | Tập trung truyện nhiều giọng | Quy trình một người kể |
| TextSpeech | Dán trong trình duyệt | Bạn chia tại ranh giới chương/cảnh | Nghe thử miễn phí 500 ký tự/lượt; trả phí để xuất MP3 và dùng thương mại |
Điều TextSpeech nói rõ: Chúng tôi là studio trên trình duyệt để dán văn bản theo chương, không phải trình chuyển EPUB thành sách nói. Nếu muốn tải lên rồi để công cụ tự làm, ElevenLabs hoặc AudiobookGen phù hợp hơn để chuyển EPUB và sách điện tử. Nếu muốn hơn 1.000 giọng, thẻ cảm xúc và cùng công cụ dùng cho lồng tiếng AI, hãy ở lại Studio nhưng dự trù nhiều lần xuất.
Giới hạn TextSpeech cần đưa vào kế hoạch
| Gói | Ký tự / lượt tạo | Số từ tiếng Anh gần đúng | Xuất MP3 | Dùng thương mại |
|---|---|---|---|---|
| Free | 500 | 70–90 | Chỉ nghe thử | Không |
| Basic / Pro | 15.000 | ~2.200–2.500 | Có | Có |
| Ultra | 30.000 | ~4.500–5.000 | Có | Có |
Một lượt tạo ≠ một cuốn sách. Chia theo chương hoặc cảnh, đếm ký tự từng khối và dự trù thời gian tạo lại, nghe toàn bộ. Số MP3 tùy độ dài chương thực tế, không chỉ tổng số từ.
Gói miễn phí: dùng để thử người kể ở phần mở đầu chương một, không dùng để giao tệp có thể bán.
Những gì cần có trước khi dán
- Quyền âm thanh đối với bản thảo: tác phẩm của bạn, tài liệu được cấp phép hoặc nội dung thuộc phạm vi công cộng đã xác minh.
- So sánh cùng một trang đầy đủ trong Studio, có hội thoại và tên khó đọc. Giọng kể kiểu YouTube là lựa chọn để thử; chọn theo phát âm, nhịp và tính nhất quán trong bản thảo của bạn.
- Quy tắc đặt tên:
01-chapter-one.mp3,02-chapter-two.mp3. - Basic, Pro hoặc Ultra để xuất MP3 và phân phối thương mại. Xem Điều khoản.
Chuẩn bị bản thảo
Định dạng bản in gây khó cho TTS. Trước khi dán:
- Bỏ hoặc sửa đầu đề cho cách đọc:
Chapter 3→Chapter threenếu số bị đọc sai. - Chuyển bảng thành danh sách đọc thành lời hoặc bỏ đi.
- Viết đầy đủ từ viết tắt mà giọng dễ đọc sai (
K8s, đường dẫn tệp, URL). - Hội thoại: một người nói mỗi đoạn với sách dùng một người kể.
- Bỏ dấu chú thích và tham chiếu trang; TTS sẽ đọc cả
p. 247.
Tạo sách nói từ văn bản: quy trình theo chương
Đây là cách dùng TextSpeech để chuyển văn bản thành sách nói và tạo sách nói từ văn bản.
- Mở Studio. Cố định một ID giọng cho cả dự án, ghi tên vào tệp ghi chú.
- Dán chỉ chương 1, hoặc khối đầu tiên dưới 15.000 ký tự.
- Tạo âm thanh. Kiểm tra đầu, giữa, cuối rồi nghe cả chương trước khi xuất.
- Sửa phát âm trong văn bản, tạo lại đoạn đó nếu cần.
- Xuất MP3 bằng gói trả phí qua văn bản thành MP3.
- Lặp lại cho chương 2 mà không đổi giọng.
Bắt đầu ở 1.0x, rồi so sánh cùng đoạn với tốc độ hơi khác. Chọn mức giữ rõ tên, hội thoại và khoảng nghỉ; riêng con số tốc độ không chứng minh chất lượng.
Phép tính minh họa: một chương đã làm sạch
Nếu chương đã làm sạch có 12.500 ký tự, nó nằm trong giới hạn Basic/Pro 15.000 ký tự cho một lượt tạo. Đây là phép tính minh họa, không phải mẫu được cung cấp hoặc đã thử. Hãy đếm ký tự thực trước khi tạo.
- Sửa
3.4 Implementation detailsthànhSection three point four. Implementation details. - Biến bảng ba cột thành ba câu đọc thành lời.
- Tạo rồi chuyển đến giữa chương. Nếu giọng “tươi cười” khi đọc văn bản khô, đổi sang giọng điềm tĩnh trong thư viện giọng trước chương 2, không phải sau.
- Xuất MP3. Giả sử 150 từ mỗi phút, 2.100 từ tiếng Anh mất khoảng 14 phút. Kiểm tra phần thiếu và độ dài khoảng nghỉ trong âm thanh thực tế; chỉ thời lượng không đủ chẩn đoán chất lượng.
- Chương 2: cùng ID giọng, tốc độ và thiết lập xuất.
Từ EPUB sang văn bản từng chương rồi thành sách nói
TextSpeech không tải EPUB hoặc DOCX. Với EPUB không DRM mà bạn được phép chuyển thể, hãy dùng cách thủ công này. Nếu bị hạn chế sao chép, hãy lấy nguồn không DRM được cho phép hoặc bản thảo gốc; quy trình này không gỡ DRM. Cách điều hướng và sao chép được ghi trong hướng dẫn trình đọc calibre.
- Thêm EPUB được phép vào calibre, chọn sách rồi chọn Xem để mở trình đọc.
- Mở mục lục và chọn chương. Nếu không có mục lục dùng được, tìm tiêu đề chương và kiểm tra chỗ chương kế tiếp bắt đầu.
- Chọn văn bản chương, nhấp chuột phải rồi chọn Sao chép. Với chương dài, sao chép các phần nhỏ liên tiếp và đối chiếu câu đầu, cuối để tránh thiếu hoặc trùng.
- Dán trước vào trình soạn thảo văn bản thuần. Bỏ điều hướng, chú thích và tiêu đề lặp; sửa bảng và đối chiếu chương. Đếm ký tự rồi chia tại ranh giới đoạn dưới giới hạn gói.
- Dán khối sạch vào Studio, giữ thiết lập giọng, nghe thử và sửa rồi xuất MP3 bằng gói trả phí. Lặp theo thứ tự và đặt tên theo chương, phần.
Dùng trình chuyển đổi có tải tệp khi:
- Sách đã là EPUB sạch với dấu chương thực sự.
- Bạn muốn tự nhận diện chương và một quy trình, không phải dán 25 lần.
- Bạn chấp nhận bộ giọng và điều khoản thương mại của nhà cung cấp đó.
Ở lại Studio khi:
- Bản thảo vẫn ở Google Docs hoặc Word.
- Bạn đã chọn giọng dẫn trong thư viện giọng và muốn cùng giọng đó cho clip YouTube.
- Bạn muốn kiểm tra một chương tối nay hơn là sửa lỗi mục lục EPUB.
Nghe, kiểm tra và ghép
Trước khi phân phối, thực hiện các kiểm tra nghe sau:
- Nghe trọn từng chương một lần trước khi xử lý hàng loạt phần còn lại.
- Cân bằng độ lớn âm thanh giữa các tệp; đừng chuẩn hóa đỉnh chương 1 về −0,1 dB nhưng để chương 2 ở −12 dB.
- Giữ nhật ký kiểm tra: mốc thời gian, lỗi, cách sửa như viết lại câu, thêm khoảng nghỉ bằng dấu phẩy, viết tên theo cách phát âm.
TextSpeech xuất MP3. Kiểm tra yêu cầu nơi nhận về mã hóa, độ lớn, khoảng lặng, thông tin mở/kết và thứ tự tệp; chỉnh bằng phần mềm âm thanh khi cần. Mastering kỹ thuật không cấp quyền phân phối giọng AI.
Xuất bản và phân phối
| Kênh | Chính sách giọng AI | Cần làm |
|---|---|---|
| Trang riêng / khóa học / podcast | Tùy quyền và quy tắc bên lưu trữ | Kiểm tra giấy phép và quy tắc nội dung trước khi đăng |
| Google Play Books | Hướng dẫn tải lên có Synthesized voice cho sách nói AI | Chọn đúng loại người kể và đáp ứng yêu cầu tài khoản, nội dung, tệp; khác công cụ tự đọc của Google |
| Kobo Writing Life | Nhận AI với siêu dữ liệu người kể là giọng tổng hợp | Ghi tác giả và người kể, tuân thủ yêu cầu tải lên hiện hành |
| ACX / Audible qua ACX | Yêu cầu người thật trừ khi được cho phép; cấm TTS/AI chưa được phép | Không nộp bản xuất TextSpeech khi chưa có phép; chỉ mastering không tạo đủ điều kiện |
Khai báo giọng AI ở nơi nền tảng yêu cầu. Quy tắc phân phối thay đổi; kiểm tra cổng tác giả của nhà bán lẻ trước khi hứa ngày ra mắt.
Lỗi thường gặp
- Mong dán cả cuốn sách một lần vào công cụ giới hạn 15.000 ký tự.
- Đưa âm thanh nghe thử gói Free vào sản phẩm trả phí: không có MP3, không có giấy phép thương mại.
- Đổi người kể ở chương 4 vì chương 1 “cần thêm năng lượng”.
- Thêm nhạc mà chưa kiểm tra độ rõ lời, quyền nhạc và quy tắc nơi nhận. So sánh với bản chỉ có lời trước khi giữ nhạc nền.
- Dùng giọng người nổi tiếng/nhân vật làm người kể chính thức; xem Điều khoản và quy định về mạo danh.
Câu hỏi thường gặp
Tôi có cần tải PDF hay EPUB không?
Không. TextSpeech không có tính năng tải bản thảo. Sao chép từ Word, Google Docs hoặc Scrivener rồi dán vào Studio. Đối thủ như ElevenLabs Audiobooks và AudiobookGen xoay quanh tải tệp; đó là công việc EPUB thành sách nói.
Tôi có thể làm sách nói hoàn chỉnh bằng gói Free không?
Bạn có thể nghe thử khối ngắn, 500 ký tự mỗi lượt tạo. Giao MP3 theo chương cần gói trả phí.
Sách của tôi sẽ có bao nhiêu tệp?
Đếm ký tự thực của từng chương đã làm sạch. Chia mỗi số cho giới hạn ký tự mỗi lượt tạo của gói, làm tròn lên rồi cộng lại. Đây là mức tối thiểu: giữ ranh giới đoạn hoặc cảnh có thể cần thêm tệp, và tạo lại có thể sinh thêm phiên bản.
Khác gì với trình chuyển sách điện tử thành sách nói?
Trình chuyển đổi tự nhập EPUB và nhận diện chương. TextSpeech cho chọn giọng, thẻ cảm xúc và cùng Studio dùng cho YouTube, đổi lại là dán chương thủ công.
Tôi có thể đăng chương lên YouTube không?
Có; kịch bản gốc và biên tập vẫn quan trọng. Xem cách thêm lồng tiếng AI vào YouTube.
MP3 hay WAV?
Định dạng xuất được ghi trong tài liệu TextSpeech là MP3. Giữ tệp gốc để sửa; đổi MP3 mất dữ liệu sang WAV không khôi phục chi tiết đã mất. Chọn định dạng nơi nhận yêu cầu và xác nhận riêng điều kiện nhận giọng AI.
Tạo chương một trong Studio. Nghe phút thứ năm trên điện thoại. Nếu bạn không muốn nghe người dẫn đó khi đi làm, hãy đổi giọng trước chương hai.


