• หนังสือเสียง AI
  • เครื่องมือสร้างหนังสือเสียง AI

วิธีสร้างหนังสือเสียง AI จากข้อความหรือ EPUB

เครื่องมือสร้างหนังสือเสียง AI เปลี่ยนข้อความ EPUB หรือหนังสือเป็นเสียงรายบท TextSpeech ใช้วิธีวางข้อความ ไม่ใช่ตัวแปลง EPUB ที่อัปโหลดแล้วปล่อยให้ทำทุกอย่างได้เลย

ทีม TextSpeechอ่าน 9 นาที
หนังสือ หูฟัง และโคมไฟตั้งโต๊ะข้างหน้าจอที่แสดงรูปคลื่นเสียง

คำตอบสั้น ๆ: หนังสือเสียง AI คือเสียงรายบทที่สร้างจากต้นฉบับ เครื่องมืออัปโหลดอย่าง ElevenLabs Audiobooks รับ EPUB แล้วตรวจจับบท ส่วน TextSpeech เป็นเครื่องมือทำหนังสือเสียงด้วยการวางข้อความ: คัดลอกจาก Word หรือ Google Docs วางครั้งละไม่เกินหนึ่งบท ทำตามเพดานอักขระต่อการสร้าง แล้วส่งออก MP3 ด้วยแพ็กเกจแบบชำระเงิน เหมาะกับคอร์สของผู้สร้างอิสระ นิยายรายตอน และหนังสือแนวพอดแคสต์ ไม่ใช่ “อัปโหลดนิยายภาษาอังกฤษ 90,000 คำ แล้วได้ไฟล์เดียวในห้านาที”

งานนี้มีสองแบบ เครื่องมือสร้างหนังสือเสียง AI อาจรับไฟล์ EPUB/อีบุ๊ก หรือให้คุณสร้างจากข้อความทีละบท ต้องรู้ว่ากำลังซื้อแบบไหน

ตรวจทานเอกสารทางการวันที่ 14 กันยายน 2026 นี่คือขั้นตอนจากเอกสาร ไม่ใช่ผลทดสอบฟังด้วยตนเอง คุณต้องมีสิทธิ์ด้านเสียงของข้อความ

เครื่องมือหนังสือเสียง AI เทียบกับตัวแปลง EPUB

แพลตฟอร์ม / คู่มือวิธีป้อนข้อมูลการจัดการบทความต่างของ TextSpeech
ElevenLabs Audiobooksอัปโหลด EPUBตรวจจับบทอัตโนมัติ เลือกเสียงหลายตัวละครไม่มีอัปโหลดไฟล์ ให้วางจากโปรแกรมเขียน
AudiobookGenอัปโหลด EPUBกระบวนการแปลงทั้งเล่มแบ่งบทเอง ควบคุมปริมาณที่วาง
Audie.aiอัปโหลดต้นฉบับเน้นนิยายหลายเสียงกระบวนการผู้บรรยายคนเดียว
TextSpeechวางในเบราว์เซอร์คุณแบ่งตามบทหรือฉากฟังตัวอย่างฟรี 500 อักขระต่อครั้ง จ่ายเงินเพื่อ MP3 และใช้เชิงพาณิชย์

สิ่งที่ TextSpeech บอกตรง ๆ: เราคือสตูดิโอบนเบราว์เซอร์สำหรับวางข้อความขนาดหนึ่งบท ไม่ใช่ตัวแปลง EPUB เป็นหนังสือเสียง หากต้องการอัปโหลดแล้วปล่อยให้ทำเอง ElevenLabs หรือ AudiobookGen เหมาะกับ EPUB และอีบุ๊ก หากต้องการเสียงมากกว่า 1,000 เสียง แท็กอารมณ์ และเครื่องมือเดียวกับที่ใช้ทำเสียงพากย์ AI ให้อยู่ใน Studio แต่ต้องวางแผนส่งออกหลายครั้ง

ข้อจำกัด TextSpeech ที่ต้องวางแผนรองรับ

แพ็กเกจอักขระ / การสร้างจำนวนคำภาษาอังกฤษโดยประมาณส่งออก MP3ใช้เชิงพาณิชย์
Free50070–90ฟังตัวอย่างเท่านั้นไม่ได้
Basic / Pro15,000~2,200–2,500ได้ได้
Ultra30,000~4,500–5,000ได้ได้

สร้างหนึ่งครั้ง ≠ หนังสือหนึ่งเล่ม แบ่งตามบทหรือฉาก นับอักขระแต่ละบล็อก และเผื่อเวลาสร้างใหม่กับฟังครบ จำนวน MP3 ขึ้นกับความยาวบทจริง ไม่ใช่แค่จำนวนคำรวม

แพ็กเกจฟรีใช้ทดลองผู้บรรยายกับต้นบทแรก ไม่ใช่ส่งมอบไฟล์สำหรับขาย

สิ่งที่ต้องเตรียมก่อนวางข้อความ

  • สิทธิ์ด้านเสียงของต้นฉบับ เช่น ผลงานตนเอง เนื้อหาที่ได้รับอนุญาต หรือสาธารณสมบัติที่ตรวจสอบแล้ว
  • เปรียบเทียบหน้าเดียวกันทั้งหน้าใน Studio รวมบทสนทนาและชื่ออ่านยาก ผู้บรรยายสไตล์ YouTube เป็นตัวเลือกให้ลอง เลือกจากการออกเสียง จังหวะ และความสม่ำเสมอในต้นฉบับของคุณ
  • รูปแบบชื่อไฟล์: 01-chapter-one.mp3, 02-chapter-two.mp3
  • Basic, Pro หรือ Ultra สำหรับส่งออก MP3 และเผยแพร่เชิงพาณิชย์ ดูข้อกำหนด

เตรียมต้นฉบับ

การจัดหน้าสิ่งพิมพ์ทำให้ TTS มีปัญหา ก่อนวางข้อความให้ทำดังนี้:

  • ลบหรือปรับหัวข้อให้เหมาะกับเสียงพูด: Chapter 3Chapter three หากอ่านตัวเลขผิด
  • เปลี่ยนตารางเป็นรายการพูดหรือตัดออก
  • ขยายคำย่อที่เสียงจะอ่านผิด (K8s, พาธไฟล์, URL)
  • บทสนทนา: หนึ่งผู้พูดต่อย่อหน้าในหนังสือที่มีผู้บรรยายคนเดียว
  • ลบสัญลักษณ์เชิงอรรถและการอ้างหน้า เพราะ TTS จะอ่าน p. 247 ออกเสียงด้วย

สร้างหนังสือเสียงจากข้อความ: ขั้นตอนรายบท

นี่คือวิธีใช้ TextSpeech เปลี่ยนข้อความเป็นหนังสือเสียงและสร้างหนังสือเสียงจากข้อความ

  1. เปิด Studio ล็อก ID เสียงเดียว ตลอดโครงการ จดชื่อไว้ในไฟล์บันทึก
  2. วางเฉพาะบทที่ 1 หรือบล็อกแรกที่ไม่ถึง 15,000 อักขระ
  3. สร้างเสียง ตรวจต้น กลาง และท้าย แล้วฟังทั้งบทก่อนส่งออก
  4. แก้การออกเสียงในข้อความ แล้วสร้างย่อหน้านั้นใหม่หากจำเป็น
  5. ส่งออก MP3 ด้วยแพ็กเกจชำระเงินผ่านข้อความเป็น MP3
  6. ทำซ้ำบทที่ 2 โดยไม่เปลี่ยนเสียง

เริ่มที่ 1.0x แล้วเปรียบเทียบข้อความเดิมด้วยความเร็วต่างเล็กน้อย เลือกค่าที่ชื่อ บทสนทนา และช่วงหยุดชัดเจน ตัวเลขความเร็วอย่างเดียวพิสูจน์คุณภาพไม่ได้

ตัวอย่างคำนวณ: บทที่จัดข้อความแล้ว

หากบทที่จัดแล้วมี 12,500 อักขระ จะอยู่ในเพดาน Basic/Pro 15,000 อักขระสำหรับสร้างครั้งเดียว นี่เป็นตัวอย่างคำนวณ ไม่ใช่ตัวอย่างที่ให้มาหรือทดสอบแล้ว โปรดนับอักขระจริงก่อนสร้าง

  1. เขียน 3.4 Implementation details ใหม่เป็น Section three point four. Implementation details.
  2. เปลี่ยนตารางสามคอลัมน์เป็นประโยคพูดสามประโยค
  3. สร้างแล้วข้ามไปกลางบท หากเสียง “ยิ้ม” กับเนื้อหาเรียบจริงจัง ให้เปลี่ยนเป็นเสียงสงบจากคลังเสียง ก่อนบทที่ 2 ไม่ใช่หลังจากนั้น
  4. ส่งออก MP3 หากสมมติ 150 คำต่อนาที ภาษาอังกฤษ 2,100 คำจะประมาณ 14 นาที ตรวจคำตกหล่นและช่วงหยุดในเสียงจริง ระยะเวลาอย่างเดียววินิจฉัยคุณภาพไม่ได้
  5. บทที่ 2: ID เสียง ความเร็ว และการตั้งค่าส่งออกเดิมทั้งหมด

จาก EPUB เป็นข้อความรายบทแล้วสร้างหนังสือเสียง

TextSpeech อัปโหลด EPUB หรือ DOCX ไม่ได้ สำหรับ EPUB ไม่มี DRM ที่คุณมีสิทธิ์ดัดแปลง ให้ใช้วิธีทำเองดังนี้ หากจำกัดการคัดลอก ให้หาต้นฉบับไม่มี DRM ที่ได้รับอนุญาตหรือไฟล์ต้นฉบับงานเขียน ขั้นตอนนี้ไม่ปลด DRM การนำทางและคัดลอกมีในคู่มือโปรแกรมอ่าน calibre

  1. เพิ่ม EPUB ที่ได้รับอนุญาตเข้า calibre เลือกหนังสือ แล้วเลือกดูเพื่อเปิดโปรแกรมอ่านอีบุ๊ก
  2. เปิดสารบัญและเลือกบท หากไม่มีสารบัญที่ใช้ได้ ให้หาหัวข้อบทและตรวจว่าบทต่อไปเริ่มตรงไหน
  3. เลือกข้อความบท คลิกขวาแล้วเลือกคัดลอก บทยาวให้คัดลอกช่วงเล็กต่อเนื่องกัน ตรวจประโยคแรกและท้ายเพื่อไม่ให้ตกหล่นหรือซ้ำ
  4. วางในโปรแกรมแก้ไขข้อความล้วนก่อน ลบข้อความนำทาง หมายเหตุ และหัวข้อซ้ำ ปรับตารางและเทียบเนื้อหาบท นับอักขระแล้วแบ่งตรงย่อหน้าให้ต่ำกว่าเพดานแพ็กเกจ
  5. วางบล็อกที่จัดแล้วใน Studio ใช้ค่าเสียงเดิม ฟังตัวอย่างและแก้ไข จากนั้นส่งออก MP3 ด้วยแพ็กเกจชำระเงิน ทำซ้ำตามลำดับและตั้งชื่อตามบทกับส่วน

ใช้ตัวแปลงแบบอัปโหลดเมื่อ:

  • หนังสือเป็น EPUB ที่เรียบร้อยพร้อมตัวแบ่งบทจริงอยู่แล้ว
  • ต้องการตรวจจับบทอัตโนมัติและกระบวนการเดียว ไม่ใช่วาง 25 ครั้ง
  • ยอมรับชุดผู้บรรยายและเงื่อนไขเชิงพาณิชย์ของผู้ให้บริการนั้นได้

อยู่ใน Studio เมื่อ:

  • ต้นฉบับยังอยู่ใน Google Docs หรือ Word
  • เลือกเสียงหลักในคลังเสียงแล้ว และอยากใช้เสียงเดียวกันในคลิป YouTube
  • อยากตรวจคุณภาพหนึ่งบทคืนนี้มากกว่าแก้สารบัญ EPUB

ฟัง ตรวจคุณภาพ และประกอบ

ก่อนจัดจำหน่าย ให้ตรวจด้วยการฟังดังนี้:

  • ฟังทุกบทจนจบหนึ่งครั้งก่อนประมวลผลส่วนที่เหลือเป็นชุด
  • ปรับความดังให้เท่ากันระหว่างไฟล์ อย่าปรับพีกบทที่ 1 เป็น −0.1 dB แล้วปล่อยบทที่ 2 ไว้ −12 dB
  • ทำบันทึกตรวจคุณภาพ: เวลา ปัญหา วิธีแก้ เช่น เปลี่ยนประโยค เพิ่มจุลภาคเพื่อหยุด หรือสะกดชื่อตามเสียง

TextSpeech ส่งออก MP3 ตรวจข้อกำหนดปลายทางเรื่องการเข้ารหัส ความดัง ความเงียบ เครดิต และลำดับไฟล์ ใช้โปรแกรมแก้ไขเสียงเมื่อจำเป็น การมาสเตอริงทางเทคนิคไม่ได้ให้สิทธิ์เผยแพร่เสียง AI

เผยแพร่และจัดจำหน่าย

ช่องทางนโยบายเสียง AIสิ่งที่ต้องทำ
เว็บไซต์ตนเอง / คอร์ส / พอดแคสต์ขึ้นกับสิทธิ์และกฎผู้ให้บริการตรวจสิทธิ์และกฎเนื้อหาก่อนเผยแพร่
Google Play Booksคู่มืออัปโหลดมีค่า Synthesized voice สำหรับหนังสือเสียง AIตั้งประเภทผู้บรรยายให้ถูกและทำตามข้อกำหนดบัญชี เนื้อหา ไฟล์ แยกจากเครื่องมือบรรยายอัตโนมัติของ Google
Kobo Writing Lifeรับ AI โดยระบุข้อมูลผู้บรรยายเป็นเสียงสังเคราะห์ใส่ผู้เขียนกับผู้บรรยายและทำตามข้อกำหนดอัปโหลดปัจจุบัน
ACX / Audible ผ่าน ACXต้องคนบรรยายเว้นแต่ได้รับอนุญาต ห้าม TTS/AI ที่ไม่ได้อนุญาตอย่าส่งไฟล์ TextSpeech โดยไม่มีอนุญาต มาสเตอริงอย่างเดียวไม่ทำให้มีสิทธิ์

เปิดเผยว่าใช้ AI เมื่อแพลตฟอร์มขอ กฎการจัดจำหน่ายเปลี่ยนได้ ตรวจพอร์ทัลผู้เขียนของผู้ขายก่อนรับปากวันออกจำหน่าย

ข้อผิดพลาดที่พบบ่อย

  • คาดหวังว่าจะวางทั้งเล่มครั้งเดียวในเครื่องมือที่จำกัด 15,000 อักขระ
  • ส่งเสียงตัวอย่างแพ็กเกจ Freeในสินค้าขาย ไม่มี MP3 และไม่มีสิทธิ์เชิงพาณิชย์
  • เปลี่ยนผู้บรรยายตอนบทที่ 4 เพราะบทที่ 1 “ต้องมีพลังอีกหน่อย”
  • เพิ่มเพลงโดยไม่ตรวจความชัดของคำพูด สิทธิ์เพลง และกฎปลายทาง เปรียบเทียบกับฉบับเสียงพูดล้วนก่อนเก็บเพลงพื้นหลังไว้
  • ใช้เสียงคนดัง/ตัวละครเป็นผู้บรรยายทางการ ดูข้อกำหนดและกฎการแอบอ้าง

คำถามที่พบบ่อย

ต้องอัปโหลด PDF หรือ EPUB ไหม?

ไม่ต้อง TextSpeech ไม่มีการอัปโหลดต้นฉบับ คัดลอกจาก Word, Google Docs หรือ Scrivener แล้ววางใน Studio คู่แข่งอย่าง ElevenLabs Audiobooks และ AudiobookGen เน้นอัปโหลดไฟล์ ซึ่งก็คืองาน EPUB เป็นหนังสือเสียง

ทำหนังสือเสียงทั้งเล่มด้วย Free ได้ไหม?

คุณฟังตัวอย่างบล็อกสั้นได้ ครั้งละ 500 อักขระ การส่งมอบ MP3 รายบทต้องใช้แพ็กเกจชำระเงิน

หนังสือจะมีไฟล์กี่ไฟล์?

นับอักขระจริงของแต่ละบทที่จัดแล้ว นำแต่ละจำนวนหารด้วยเพดานอักขระต่อการสร้างของแพ็กเกจ ปัดขึ้นแล้วรวมผล นี่คือขั้นต่ำ การรักษาขอบเขตย่อหน้าหรือฉากอาจต้องใช้ไฟล์เพิ่ม และการสร้างใหม่อาจเกิดเวอร์ชันเพิ่มเติม

ต่างจากตัวแปลงอีบุ๊กเป็นหนังสือเสียงอย่างไร?

ตัวแปลงนำเข้า EPUB และตรวจจับบทอัตโนมัติ TextSpeech ให้เลือกเสียง แท็กอารมณ์ และ Studio เดียวกับที่ใช้กับ YouTube แลกกับการวางบทด้วยตนเอง

เผยแพร่บทบน YouTube ด้วยได้ไหม?

ได้ บทต้นฉบับและการตัดต่อยังสำคัญ ดูวิธีเพิ่มเสียงพากย์ AI ใน YouTube

MP3 หรือ WAV?

รูปแบบส่งออกที่เอกสาร TextSpeech ระบุคือ MP3 เก็บต้นฉบับไว้แก้ไข การแปลง MP3 แบบสูญเสียข้อมูลเป็น WAV ไม่คืนรายละเอียดที่หาย เลือกรูปแบบตามปลายทางและตรวจสิทธิ์รับเสียง AI แยกต่างหาก

สร้างบทแรกใน Studio ฟังนาทีที่ห้าบนโทรศัพท์ หากไม่อยากฟังผู้บรรยายนี้ระหว่างเดินทาง ให้เปลี่ยนเสียงก่อนบทที่สอง

อ่านต่อ

ลองประโยคใน Studio

เลือกเสียง วางสคริปต์ แล้วฟังเทคก่อนส่งออก