ElevenLabs
แพลตฟอร์ม AI ด้านเสียงที่ขึ้นชื่อเรื่องแปลงข้อความเป็นเสียงพูดเหมือนคนจริง โคลนเสียง พากย์ข้ามภาษา และสร้าง voice agent ได้ในกว่า 70 ภาษา
ElevenLabs คือบริษัทและแพลตฟอร์ม ai ด้านเสียงจากนิวยอร์ก ก่อตั้งปี 2022 โดยผู้ประกอบการชาวโปแลนด์สองคน: Piotr Dąbkowski (อดีตวิศวกร machine learning ที่ Google) และ Mateusz Staniszewski (อดีตสาย deployment ที่ Palantir) ชื่อบริษัทอ้างถึงวันที่ 11 พฤศจิกายน วันประกาศอิสรภาพของโปแลนด์ จุดที่ทำให้ดังคือ text-to-speech ที่เสียงเหมือนมนุษย์จริงมาก: ใช้ deep learning สังเคราะห์ทั้งอารมณ์และจังหวะน้ำเสียง ไม่ใช่เสียงหุ่นยนต์อ่านทื่อๆ แบบโปรแกรมอ่านออกเสียงยุคก่อน ปัจจุบันมีคลังเสียงให้เลือกกว่า 5,000 แบบ รองรับมากกว่า 70 ภาษา
ผลิตภัณฑ์แบ่งเป็นสามกลุ่มหลัก: ElevenCreative สำหรับงานสร้างสรรค์ (เสียงพูด · เพลงผ่าน Eleven Music · เสียงประกอบ) · ElevenAgents สำหรับสร้าง voice agent ที่คุยกับลูกค้าได้ทั้งทางโทรศัพท์ แชท และ WhatsApp · และ ElevenAPI ให้นักพัฒนาเรียกใช้ผ่าน api ความสามารถที่คนพูดถึงบ่อยคือ voice cloning: อัดตัวอย่างเสียงแล้วให้ระบบสร้างเสียงสังเคราะห์ที่เหมือนเจ้าของเสียงคนนั้น · AI dubbing ที่แปลเสียงพูดเป็นภาษาอื่นกว่า 90 ภาษาโดยยังรักษาโทนเสียงของผู้พูดเดิม · และ Scribe ระบบ speech-to-text ถอดเสียงเป็นข้อความพร้อมแยกว่าใครพูดประโยคไหน
สำหรับคนทำงานยุค AI นี่คือชื่อที่ควรรู้เพราะ "เสียง" กำลังกลายเป็นช่องทางหลักที่คนคุยกับระบบ generative-ai งานที่เคยต้องจ้างสตูดิโอ เช่น เสียงบรรยายคอร์ส e-learning, พากย์วิดีโอหลายภาษา, เสียงตอบรับ call center ตอนนี้ทำได้ในเวลาไม่กี่นาที ฝั่งธุรกิจก็ร้อนแรง: รอบทุนกุมภาพันธ์ 2026 ระดมได้ 500 ล้านดอลลาร์ ที่มูลค่าบริษัทราว 11,000 ล้านดอลลาร์ แต่เหรียญอีกด้านคือเทคโนโลยีโคลนเสียงถูกใช้ในทางที่ผิดได้ง่าย เคสดังคือ robocall ปลอมเสียงประธานาธิบดี Biden ช่วง primary ที่ New Hampshire ปี 2024 ซึ่งสืบพบว่าสร้างด้วยเทคโนโลยีของ ElevenLabs ทำให้เรื่อง deepfake เสียงและการขอ consent ก่อนโคลนเสียงใคร เป็นนโยบายที่ทุกองค์กรต้องเขียนให้ชัดก่อนหยิบเครื่องมือนี้มาใช้
ตัวอย่างจากบทสนทนาจริง
ถาม: ทีม L&D อยากทำเสียงบรรยายคอร์สภายในเป็นสามภาษา แต่งบจ้างนักพากย์ไม่พอ แล้วเจ้า ElevenLabs ที่คนพูดถึงกันนี่มันโปรแกรมตัดต่อเสียงหรือเปล่า
ตอบ: ไม่ใช่โปรแกรมตัดต่อครับ มันคือ AI สร้างเสียง: วางสคริปต์แล้วให้ระบบอ่านออกมาเป็นเสียงคนได้เลย จะเลือกเสียงจากคลังของเขา หรือ clone เสียงวิทยากรของเราเองก็ได้ (แต่ต้องขออนุญาตเจ้าของเสียงเป็นลายลักษณ์อักษรก่อน) เสร็จแล้วใช้ฟีเจอร์ dubbing แปลงเป็นอีกสองภาษาโดยโทนเสียงยังเป็นคนเดิม ไม่ต้องเข้าสตูดิโอสักรอบ
ระวังสับสนกับ
- suno : Suno เน้นสร้าง "เพลง" ทั้งทำนองและเสียงร้องจากคำสั่งข้อความ ส่วน ElevenLabs เป็นแพลตฟอร์มที่งานหลักคือ "เสียงพูด" (แม้ภายหลังจะมี Eleven Music เพิ่มเข้ามาก็ตาม)
- whisper : Whisper ของ openai เป็นโมเดลฝั่งถอดเสียงเป็นข้อความอย่างเดียว ส่วน ElevenLabs ครอบคลุมทั้งขาสร้างเสียง (text-to-speech) และขาถอดเสียง (Scribe)
- synthesia : ElevenLabs ทำเฉพาะเสียงพูดและโคลนเสียง ส่วน Synthesia เอาเสียงมาประกอบกับ AI avatar เป็นวิดีโอคนพูดหน้ากล้องให้ครบในตัว
Sources (2)
- https://elevenlabs.io fetched 2026-08-01
- https://en.wikipedia.org/wiki/ElevenLabs fetched 2026-08-01
อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย