Dictionary · โมเดลและผู้เล่นหลัก · 172 / 291

ElevenLabs

แพลตฟอร์ม AI ด้านเสียงที่ขึ้นชื่อเรื่องแปลงข้อความเป็นเสียงพูดเหมือนคนจริง โคลนเสียง พากย์ข้ามภาษา และสร้าง voice agent ได้ในกว่า 70 ภาษา

ElevenLabs คือบริษัทและแพลตฟอร์ม ai ด้านเสียงจากนิวยอร์ก ก่อตั้งปี 2022 โดยผู้ประกอบการชาวโปแลนด์สองคน: Piotr Dąbkowski (อดีตวิศวกร machine learning ที่ Google) และ Mateusz Staniszewski (อดีตสาย deployment ที่ Palantir) ชื่อบริษัทอ้างถึงวันที่ 11 พฤศจิกายน วันประกาศอิสรภาพของโปแลนด์ จุดที่ทำให้ดังคือ text-to-speech ที่เสียงเหมือนมนุษย์จริงมาก: ใช้ deep learning สังเคราะห์ทั้งอารมณ์และจังหวะน้ำเสียง ไม่ใช่เสียงหุ่นยนต์อ่านทื่อๆ แบบโปรแกรมอ่านออกเสียงยุคก่อน ปัจจุบันมีคลังเสียงให้เลือกกว่า 5,000 แบบ รองรับมากกว่า 70 ภาษา

ผลิตภัณฑ์แบ่งเป็นสามกลุ่มหลัก: ElevenCreative สำหรับงานสร้างสรรค์ (เสียงพูด · เพลงผ่าน Eleven Music · เสียงประกอบ) · ElevenAgents สำหรับสร้าง voice agent ที่คุยกับลูกค้าได้ทั้งทางโทรศัพท์ แชท และ WhatsApp · และ ElevenAPI ให้นักพัฒนาเรียกใช้ผ่าน api ความสามารถที่คนพูดถึงบ่อยคือ voice cloning: อัดตัวอย่างเสียงแล้วให้ระบบสร้างเสียงสังเคราะห์ที่เหมือนเจ้าของเสียงคนนั้น · AI dubbing ที่แปลเสียงพูดเป็นภาษาอื่นกว่า 90 ภาษาโดยยังรักษาโทนเสียงของผู้พูดเดิม · และ Scribe ระบบ speech-to-text ถอดเสียงเป็นข้อความพร้อมแยกว่าใครพูดประโยคไหน

สำหรับคนทำงานยุค AI นี่คือชื่อที่ควรรู้เพราะ "เสียง" กำลังกลายเป็นช่องทางหลักที่คนคุยกับระบบ generative-ai งานที่เคยต้องจ้างสตูดิโอ เช่น เสียงบรรยายคอร์ส e-learning, พากย์วิดีโอหลายภาษา, เสียงตอบรับ call center ตอนนี้ทำได้ในเวลาไม่กี่นาที ฝั่งธุรกิจก็ร้อนแรง: รอบทุนกุมภาพันธ์ 2026 ระดมได้ 500 ล้านดอลลาร์ ที่มูลค่าบริษัทราว 11,000 ล้านดอลลาร์ แต่เหรียญอีกด้านคือเทคโนโลยีโคลนเสียงถูกใช้ในทางที่ผิดได้ง่าย เคสดังคือ robocall ปลอมเสียงประธานาธิบดี Biden ช่วง primary ที่ New Hampshire ปี 2024 ซึ่งสืบพบว่าสร้างด้วยเทคโนโลยีของ ElevenLabs ทำให้เรื่อง deepfake เสียงและการขอ consent ก่อนโคลนเสียงใคร เป็นนโยบายที่ทุกองค์กรต้องเขียนให้ชัดก่อนหยิบเครื่องมือนี้มาใช้

ตัวอย่างจากบทสนทนาจริง

ถาม: ทีม L&D อยากทำเสียงบรรยายคอร์สภายในเป็นสามภาษา แต่งบจ้างนักพากย์ไม่พอ แล้วเจ้า ElevenLabs ที่คนพูดถึงกันนี่มันโปรแกรมตัดต่อเสียงหรือเปล่า

ตอบ: ไม่ใช่โปรแกรมตัดต่อครับ มันคือ AI สร้างเสียง: วางสคริปต์แล้วให้ระบบอ่านออกมาเป็นเสียงคนได้เลย จะเลือกเสียงจากคลังของเขา หรือ clone เสียงวิทยากรของเราเองก็ได้ (แต่ต้องขออนุญาตเจ้าของเสียงเป็นลายลักษณ์อักษรก่อน) เสร็จแล้วใช้ฟีเจอร์ dubbing แปลงเป็นอีกสองภาษาโดยโทนเสียงยังเป็นคนเดิม ไม่ต้องเข้าสตูดิโอสักรอบ

ระวังสับสนกับ

  • suno : Suno เน้นสร้าง "เพลง" ทั้งทำนองและเสียงร้องจากคำสั่งข้อความ ส่วน ElevenLabs เป็นแพลตฟอร์มที่งานหลักคือ "เสียงพูด" (แม้ภายหลังจะมี Eleven Music เพิ่มเข้ามาก็ตาม)
  • whisper : Whisper ของ openai เป็นโมเดลฝั่งถอดเสียงเป็นข้อความอย่างเดียว ส่วน ElevenLabs ครอบคลุมทั้งขาสร้างเสียง (text-to-speech) และขาถอดเสียง (Scribe)
  • synthesia : ElevenLabs ทำเฉพาะเสียงพูดและโคลนเสียง ส่วน Synthesia เอาเสียงมาประกอบกับ AI avatar เป็นวิดีโอคนพูดหน้ากล้องให้ครบในตัว

ดูคำนี้ใน Knowledge Atlas →

Sources (2)

■ ไม่อยากพลาดของใหม่

อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย

DifyGemma