DeepSeek
บริษัท AI จากจีนผู้พัฒนาโมเดลภาษาแบบ open-weights อย่าง V3 และ R1 ที่ดังทั่วโลกต้นปี 2025 เพราะผลงานเทียบชั้นโมเดลชั้นนำแต่เคลมต้นทุนฝึกถูกกว่ามาก
DeepSeek คือบริษัท AI จากเมืองหางโจว ประเทศจีน ก่อตั้งเมื่อเดือนกรกฎาคม 2023 โดย Liang Wenfeng และได้ทุนสนับสนุนจาก High-Flyer กองทุน hedge fund ที่ Liang นั่งเป็น CEO อยู่เองด้วย ผลงานหลักคือ model ภาษาขนาดใหญ่ (llm) ตระกูล DeepSeek เช่น V2, V3 และ R1 ซึ่งเปิดให้ใช้ได้หลายทาง: แอปแชตฟรีบนมือถือ เว็บ chat.deepseek.com และ api สำหรับนักพัฒนา จุดต่างสำคัญจากค่ายใหญ่ฝั่งอเมริกาคือการปล่อยโมเดลแบบ open-weights ภายใต้ MIT License ตั้งแต่ต้นปี 2025: ใครก็ดาวน์โหลดตัวโมเดลไปรันบนเครื่องของตัวเองได้ แม้ข้อมูลที่ใช้ฝึกจะไม่ได้เปิดเผยก็ตาม
เหตุผลที่ชื่อนี้ดังระเบิดคือสูตร "ของเก่งแต่ต้นทุนถูก" DeepSeek ใช้สถาปัตยกรรม mixture-of-experts ที่เรียกใช้ parameters เพียงบางส่วนต่อการตอบแต่ละครั้ง ช่วยลดพลังประมวลผลที่ต้องใช้ลงมหาศาล บริษัทเคลมว่า V3 (ขนาด 671 พันล้าน parameters เปิดตัวธันวาคม 2024) ใช้งบฝึกราว 5.6 ล้านดอลลาร์ เทียบกับตัวเลขราว 100 ล้านดอลลาร์ที่มีรายงานว่า GPT-4 ใช้ พอปล่อย R1 ซึ่งเป็น reasoning-model ตามมาในเดือนมกราคม 2025 แอป DeepSeek ก็แซง chatgpt ขึ้นเป็นแอปฟรีที่ถูกดาวน์โหลดมากที่สุดบน App Store สหรัฐเมื่อ 27 มกราคม 2025 และสะเทือนตลาดหุ้นจนราคาหุ้น Nvidia ร่วง 18% มูลค่าบริษัทหายไปราว 6 แสนล้านดอลลาร์ เพราะนักลงทุนเริ่มตั้งคำถามว่าการสร้าง AI เก่งๆ อาจไม่ต้องใช้ชิปแพงๆ เยอะอย่างที่คิด
สำหรับคนทำงานยุค AI ควรรู้จักชื่อนี้ด้วยสองเหตุผล หนึ่ง: มันคือหลักฐานว่าโมเดลระดับแนวหน้าไม่จำเป็นต้องมาจากบริษัทอเมริกันเสมอไป และการเปิด weights ทำให้องค์กรนำไปรันแบบ on-premise-ai ได้เองโดยข้อมูลไม่ต้องออกนอกบริษัท สอง: ถ้าใช้ผ่านแอปหรือเว็บของ DeepSeek โดยตรง ข้อมูลที่พิมพ์จะถูกส่งไปยังเซิร์ฟเวอร์ของบริษัทจีน หลายองค์กรจึงต้องชั่งประเด็น data privacy ก่อนอนุมัติให้พนักงานใช้ นอกจากนี้ยังมีข้อพิพาทให้จับตา: เดือนกุมภาพันธ์ 2026 anthropic กล่าวหาว่า DeepSeek แอบเก็บเกี่ยวบทสนทนากับ Claude จำนวนมหาศาลผ่านบัญชีปลอมเพื่อนำไปฝึกโมเดล ปัจจุบัน DeepSeek ยังเดินหน้าต่อเนื่อง โดยเว็บทางการโชว์ API รุ่นใหม่อย่าง V4-Flash ที่ชูความสามารถด้าน agent เป็นจุดขาย
ตัวอย่างจากบทสนทนาจริง
น้องฝ่ายการตลาด: เห็นข่าวว่า DeepSeek ฟรีแล้วก็เก่งไม่แพ้ ChatGPT เลยนี่คะ งั้นทีมเราเลิกจ่ายค่า subscription แล้วย้ายไปใช้ DeepSeek กันเลยดีไหม
หัวหน้าทีม: ตัวโมเดลเก่งจริง แต่คำว่า "ฟรี" มีสองแบบนะ ถ้าใช้ผ่านแอปของ DeepSeek ข้อมูลลูกค้าเราจะวิ่งไปเซิร์ฟเวอร์ที่จีน ต้องให้ฝ่าย IT เช็กนโยบายก่อน อีกทางคือเพราะมันเป็น open-weights ฝ่าย IT จะโหลดโมเดลมารันบนเซิร์ฟเวอร์ของบริษัทเราเองก็ได้ ข้อมูลไม่รั่วออกไปไหน แต่ก็ต้องแลกกับต้นทุนเครื่องแทน
ระวังสับสนกับ
- deep-learning : ชื่อขึ้นต้นด้วย "deep" เหมือนกันแต่คนละเรื่อง · deep learning คือชื่อเทคนิคการฝึก neural-network หลายชั้นที่ AI ยุคนี้ใช้กันทั่วไป ส่วน DeepSeek คือชื่อบริษัทและชื่อตระกูลโมเดล
- open-source-ai : สื่อชอบเรียก DeepSeek ว่า "open source" แต่ที่ตรงกว่าคือ open-weights: เปิดให้โหลดเฉพาะตัว weights ของโมเดลภายใต้ MIT License ส่วนข้อมูลและกระบวนการฝึกไม่ได้เปิดเผยทั้งหมด
Sources (2)
- https://www.deepseek.com fetched 2026-08-01
- https://en.wikipedia.org/wiki/DeepSeek fetched 2026-08-01
อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย