Dictionary · โมเดลและผู้เล่นหลัก · 186 / 291

Midjourney

บริการ AI สร้างภาพจากข้อความแบบ text-to-image: พิมพ์คำบรรยายเป็น prompt แล้วได้ภาพกลับมา ใช้ผ่านเว็บหรือ Discord แบบสมัครสมาชิก

Midjourney คือบริการ generative-ai สาย text-to-image ที่ดังที่สุดเจ้าหนึ่งของโลก: ผู้ใช้พิมพ์คำบรรยายภาพที่อยากได้เป็นข้อความ (เรียกว่า prompt) แล้วระบบจะสร้างภาพขึ้นมาใหม่ให้ชุดละ 4 ภาพ พัฒนาโดย Midjourney, Inc. research lab อิสระใน San Francisco ก่อตั้งโดย David Holz (ผู้ร่วมก่อตั้ง Leap Motion) เปิด open beta เมื่อ 12 กรกฎาคม 2022 และทำกำไรได้ตั้งแต่เดือนสิงหาคมปีเดียวกัน เอกลักษณ์ช่วงแรกคือไม่มีแอปของตัวเอง: ต้องใช้ผ่าน bot ใน Discord ด้วยคำสั่ง /imagine ก่อนจะเปิดเว็บไซต์ให้ใช้ตรงในเดือนสิงหาคม 2024 ปัจจุบันเป็นบริการแบบสมัครสมาชิก เริ่มต้นราว $10 ต่อเดือน

ตัว model อัปเดตต่อเนื่องตั้งแต่ V1 (กุมภาพันธ์ 2022) จนถึง V8.1 (เมษายน 2026) และมีรุ่นพิเศษอย่าง Niji ที่จูนมาสำหรับภาพแนว anime โดยตั้งแต่ V4 เป็นต้นมาเทรนบน Google TPU ส่วนสถาปัตยกรรมภายในบริษัทไม่เปิดเผย เดือนมิถุนายน 2025 Midjourney ขยับเข้าสู่วิดีโอด้วย V1 video model: เอาภาพนิ่ง (จะสร้างใน Midjourney หรืออัปโหลดเองก็ได้) มาทำให้ขยับเป็นคลิป 5 วินาที ต่อความยาวได้ครั้งละ 4 วินาที สูงสุด 21 วินาที โดยกินทรัพยากรราว 8 เท่าของการสร้างภาพหนึ่งครั้ง และ Holz ประกาศว่านี่คือบันไดขั้นแรกสู่เป้าหมายระยะยาวเรื่อง real-time open-world simulation

คนทำงานยุค AI ควรรู้จัก Midjourney เพราะมันกลายเป็นเครื่องมือมาตรฐานของงานภาพในหลายวงการ: วงการโฆษณาใช้ brainstorm และสร้างภาพต้นฉบับ สถาปนิกใช้ทำ mood board ช่วงเริ่มโปรเจกต์แทนการค้น Google Images ศิลปินใช้ prototype ไอเดียให้ลูกค้าดูก่อนลงมือทำจริง ภาพที่ได้มักถูกนำไปวางต่อในงานนำเสนอหรือเอกสารที่สร้างด้วยเครื่องมืออย่าง gamma อีกที แต่อีกด้านหนึ่ง Midjourney ก็เป็นศูนย์กลางข้อถกเถียงเรื่อง ai-copyright มาตลอด: ภาพที่สร้างด้วย Midjourney ชนะรางวัลที่งาน Colorado State Fair ปี 2022 จนศิลปินประท้วง ตามมาด้วยคดีจากกลุ่มศิลปิน และปี 2025 ถูกฟ้องโดยสตูดิโอยักษ์อย่าง Disney, Universal และ Warner Bros. Discovery องค์กรที่จะใช้ภาพจาก Midjourney เชิงพาณิชย์จึงควรมี ai-policy เรื่องลิขสิทธิ์รองรับให้ชัดก่อน

ตัวอย่างจากบทสนทนาจริง

น้องทีมการตลาด: พี่คะ หนูพิมพ์ขอให้ Midjourney ช่วยสรุป brief ลูกค้า มันไม่ยอมตอบเป็นข้อความเลย ส่งแต่รูปกลับมา 4 รูป หนูใช้ผิดตรงไหน

หัวหน้าทีม: ไม่ผิดที่เครื่องครับ ผิดที่เลือกเครื่องมือ Midjourney ไม่ใช่ chatbot แบบ chatgpt มันเป็นบริการ text-to-image คือรับ prompt แล้วคืนมาเป็น "ภาพ" อย่างเดียว ถ้าจะสรุป brief ให้ใช้ ChatGPT หรือ Claude ก่อน แล้วค่อยเอา key message ที่ได้มาเขียนเป็น prompt ให้ Midjourney ทำภาพประกอบแคมเปญอีกที

ระวังสับสนกับ

  • stable-diffusion : สร้างภาพจากข้อความเหมือนกัน แต่ Stable Diffusion เป็น model แบบ open-weights ที่ดาวน์โหลดไปรันบนเครื่องตัวเองหรือดัดแปลงต่อได้ ส่วน Midjourney เป็นบริการปิด ต้องจ่าย subscription และใช้ผ่านเว็บหรือ Discord เท่านั้น
  • diffusion-model : อันนี้คือชื่อ "ตระกูลเทคนิค" ที่เครื่องมือสร้างภาพหลายเจ้าใช้ ไม่ใช่ชื่อผลิตภัณฑ์ ส่วน Midjourney คือชื่อแบรนด์บริการ ซึ่งตัวบริษัทเองไม่เคยเปิดเผยว่าข้างในใช้สถาปัตยกรรมอะไร

ดูคำนี้ใน Knowledge Atlas →

■ ไม่อยากพลาดของใหม่

อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย

Microsoft CopilotMistral AI