Mercury 2.5 กับโมเดลภาษาแบบ diffusion
Mercury 2.5 กับโมเดลภาษาแบบ diffusion
Inception Labs เปิดให้ใช้ Mercury 2.5 ทั่วไปเมื่อ 8 ก.ย. 2026 ตาม dateline ของเอกสารข่าวที่ระบุว่า "REDWOOD CITY, Calif., September 08, 2026" (Business Wire) จุดที่ต้องระบุให้ตรงคือวันนี้ไม่ใช่การเปิดตัวครั้งแรก รุ่นพรีวิวขึ้นให้ลองบน OpenRouter ตั้งแต่ 31 ส.ค. 2026 แล้ว และหลังเปิดใช้งานทั่วไป รายการรุ่นพรีวิวก็ถูกถอดออกจาก API (OpenRouter)
โมเดล diffusion ต่างจากโมเดลทั่วไปตรงไหน
คำอธิบายกลไกอยู่ในเอกสารข่าวของบริษัท ไม่ได้อยู่ในหน้าบล็อกที่คนอ้างถึงกันมากที่สุด เนื้อความระบุว่าโมเดลภาษาส่วนใหญ่ที่ใช้งานจริงทุกวันนี้ยังสร้างข้อความแบบ autoregressive คือทีละโทเคน วิธีนี้ผูกทั้งค่าใช้จ่ายและเวลาหน่วงไว้กับความลึกของการคิดโดยตรง ยิ่งโมเดลต้องคิดมากก็ยิ่งช้าและยิ่งแพง ส่วนโมเดลแบบ diffusion ทำงานต่างออกไป คือเริ่มจากร่างหยาบของผลลัพธ์แล้วขัดโทเคนหลายตัวให้ชัดขึ้นพร้อมกัน (Business Wire)
หน้าบล็อกของบริษัทเองไม่มีประโยคอธิบายกลไกนี้เลย ใครที่จะอ้างอิงคำอธิบายข้างต้นจึงต้องชี้ไปที่เอกสารข่าว ไม่ใช่หน้าบล็อก
ตัวเลขที่บริษัทให้ไว้
ความเร็วที่ระบุคือ 1,107 โทเคนต่อวินาที บนการ์ด NVIDIA ที่หาซื้อได้ทั่วไป หน้าประกาศไม่ระบุรุ่นการ์ด ไม่ระบุ batch size ไม่ระบุจำนวนงานที่รันพร้อมกัน และไม่ระบุความยาวข้อมูลนำเข้า ส่วนเอกสารข่าวเขียนตัวเลขต่างออกไปเล็กน้อยว่าเกิน 1,100 โทเคนต่อวินาทีในการใช้งานจริง
หน้าต่างบริบทอยู่ที่ 260,000 โทเคน เพิ่มจาก 128,000 โทเคนของรุ่นก่อน ความสามารถที่ระบุคือปรับระดับการคิดได้ เรียกเครื่องมือหลายตัวพร้อมกันได้ และคืน JSON ตามโครงสร้างที่กำหนดได้
ราคาป้ายคือ 0.20 ดอลลาร์ต่อล้านโทเคนขาเข้าและ 0.75 ดอลลาร์ต่อล้านโทเคนขาออก ช่วงเปิดตัวลด 80 เปอร์เซ็นต์เหลือ 0.04 และ 0.15 ดอลลาร์ ทั้งหน้าบล็อกและเอกสารข่าวไม่ได้ระบุวันสิ้นสุดของโปรโมชัน ซึ่งไม่ได้แปลว่าเป็นราคาถาวร รุ่นพรีวิวก่อนหน้านี้ใช้โปรลด 80 เปอร์เซ็นต์เหมือนกันแต่กำหนดวันหมดไว้ชัดเจน ราคาที่บันทึกไว้นี้เป็นราคา ณ 10 ก.ย. 2026 อีกชั้นที่มักตกหล่นคือราคาอ่านจากแคชที่ 0.02 ดอลลาร์ต่อล้านโทเคน ซึ่งช่วงโปรคิดจริงที่ 0.004 ดอลลาร์ต่อล้านโทเคนตาม API ของ OpenRouter
ตัวเลข 40 เปอร์เซ็นต์ที่ต้องอ่านอย่างระวัง
หน้าบล็อกเขียนไว้ใต้หัวข้อคุณภาพว่าความฉลาดเพิ่มขึ้น 40 เปอร์เซ็นต์จาก Mercury 2 และเทียบได้กับโมเดลราคาประหยัดของค่ายใหญ่อย่าง GPT-5.6 Luna ระดับ Low, Gemini 3.5 Flash-Lite และ Claude Haiku 4.5
บริษัทไม่ได้ระบุว่าตัวเลขนี้วัดจากชุดทดสอบหรือดัชนีตัวไหน ทั้งในหน้าบล็อกและในเอกสารข่าว ทั้งหน้าไม่มีตารางคะแนน ไม่มีชื่อชุดทดสอบ และไม่มีตัวเลขดิบสักตัว ที่ต้องระวังยิ่งกว่านั้นคือเอกสารสองชิ้นของบริษัทเองให้ตัวเลขคนละหน่วย หน้าบล็อกเขียนว่าเพิ่มขึ้น 40 เปอร์เซ็นต์ ส่วนเอกสารข่าวเขียนว่าเพิ่มขึ้น 10 จุด
บริษัทยังเขียนเองด้วยว่างานจริงของลูกค้าให้สัญญาณที่ชัดกว่าชุดทดสอบเพียงอย่างเดียว และใช้เสียงจากลูกค้ากับเคสที่พังในการใช้งานจริงมาปรับการวัดผลและการฝึก
ยังไม่มีใครวัดอิสระเลยแม้แต่เจ้าเดียว
ณ 10 ก.ย. 2026 หน้าโมเดล Mercury 2.5 บน Artificial Analysis คืน HTTP 404 คือยังไม่มีการวัดจากบุคคลที่สาม ส่วนรุ่นก่อนหน้าคือ Mercury 2 มีหน้าอยู่จริงและแสดงความเร็วขาออก 777 โทเคนต่อวินาที กับคะแนน 12 บนดัชนีความฉลาดของสำนักนั้น (Artificial Analysis)
ตัวเลขที่ใกล้เคียงการวัดอิสระที่สุดในหน้าประกาศคือคำบอกเล่าของลูกค้า ซึ่งเป็นตัวเลขจากระบบของลูกค้าเอง ไม่ใช่ชุดทดสอบที่ทำซ้ำได้ และคำบอกเล่าเหล่านั้นพูดถึง Mercury โดยรวม ไม่ได้เจาะจงรุ่น 2.5
กับดักตัวเลข 170 มิลลิวินาที
เลข 170 มิลลิวินาทีปรากฏสองที่บนหน้าเดียวกันโดยเป็นคนละเรื่อง ที่หนึ่งคือ Mercury Voice ซึ่งอยู่ในสถานะพรีวิว ระบุว่าเริ่มคืนโทเคนแรกภายในไม่ถึง 170 มิลลิวินาที อีกที่หนึ่งคือเคสลูกค้าชื่อ OpenCall ที่ระบุว่า Mercury ทำให้ค่ากลางของเวลาตอบสนองของโมเดลเข้าใกล้ 170 มิลลิวินาที สองตัวนี้เป็นคนละมาตรวัดและคนละผลิตภัณฑ์ ห้ามเขียนรวมกัน
เสียงค้านในวงสนทนา
กระทู้บน Hacker News ที่ได้ 245 คะแนนมีเสียงตั้งข้อสังเกตตรงกับสิ่งที่ตรวจพบ คือการเทียบกับโมเดลอื่นในเชิงคะแนนหายไปจากประกาศ และการเทียบความเร็วเป็นการเทียบกับรุ่นเล็กของค่ายอื่นที่เก่ากว่าหลายรุ่น ข้อสังเกตเหล่านี้เป็นความเห็นของผู้ใช้ ไม่ใช่ข้อเท็จจริงที่ยืนยันได้ แต่ชี้ทิศทางว่าต้องอ่านตัวเลขชุดนี้อย่างระวัง (Hacker News)
ทำไมเรื่องนี้สำคัญกับคนทำงาน
งานที่มีคนนั่งรออยู่หน้าจอจริง เช่น ผู้ช่วยตอบลูกค้าสด การเติมข้อความระหว่างพิมพ์ หรือการแปลทันที ความเร็วมีค่าไม่แพ้ความแม่น ถ้าโมเดลตระกูลนี้ทำได้ตามที่อ้าง ทางเลือกสำหรับงานที่ต้องตอบเร็วจะไม่ได้เหลือแค่การจ่ายแพงขึ้นเพื่อซื้อความเร็ว
แต่วิธีประเมินที่ถูกต้องในตอนนี้คือทดสอบกับงานของตัวเอง ไม่ใช่เชื่อตัวเลขในประกาศ เพราะทั้งความเร็วและความฉลาดยังไม่มีใครนอกบริษัทวัดเลย และราคาช่วงเปิดตัวที่ถูกกว่าราคาป้ายห้าเท่า เป็นราคาที่เปลี่ยนได้โดยไม่ต้องแจ้งล่วงหน้า การวางระบบทั้งกองไว้บนราคานี้จึงเป็นความเสี่ยงคนละเรื่องกับคุณภาพของโมเดล
ดูเทียบกับ gpt-5-6-family และ gemini-3-8-flash-2026 ซึ่งเป็นกลุ่มที่บริษัทเลือกมาเทียบเอง และดู kimi-k3 สำหรับอีกด้านหนึ่งของเรื่องความเร็ว คือการรันโมเดลใหญ่บนเครื่องตัวเอง
คำถามที่ยังไม่มีคำตอบ
- ตัวเลข 1,107 โทเคนต่อวินาทีวัดบนการ์ดรุ่นไหน ที่จำนวนงานพร้อมกันเท่าไร ยังไม่มีคำตอบจากบริษัท
- ความฉลาดที่เพิ่มขึ้นวัดด้วยอะไร และทำไมเอกสารสองชิ้นของบริษัทเองถึงให้หน่วยคนละแบบ
- ราคาช่วงเปิดตัวจะอยู่ถึงเมื่อไร บริษัทไม่ระบุ
- Artificial Analysis หรือผู้วัดอิสระรายอื่นจะขึ้นผลของ Mercury 2.5 เมื่อไร
Sources (5)
- https://www.inceptionlabs.ai/blog/introducing-mercury-2-5 fetched 2026-09-10
- https://www.businesswire.com/news/home/20260908593295/en/ fetched 2026-09-10
- https://openrouter.ai/inception/mercury-2.5 fetched 2026-09-10
- https://artificialanalysis.ai/models/mercury-2 fetched 2026-09-10
- https://news.ycombinator.com/item?id=49616354 fetched 2026-09-10
อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย