OpenAI เปิดผลทดสอบชิปที่ออกแบบเองสำหรับงานตอบคำถามโดยเฉพาะ แล้วอ้างว่าทำงานได้มากกว่าต่อไฟหนึ่งหน่วย
ชิปตัวนี้ชื่อ Jalapeño ออกแบบร่วมกับ Broadcom และทำหน้าที่ตอบคำถามอย่างเดียว ใช้ฝึกโมเดลไม่ได้ ผลิตออกมาครั้งแรกเมื่อเดือน พ.ย. 2025 ตัวเลขสเปกที่ผู้วิเคราะห์รายงานคือ 13.4 PFLOPs แบบ MXFP4 บนกระบวนการผลิต N3P ของ TSMC หน่วยความจำ HBM4 ที่แบนด์วิดท์ 15.4TB ต่อวินาทีต่อแพ็กเกจ และกำลังไฟที่ระบุไว้ระดับตัวชิปคือ 700 วัตต์ โดยวัดกำลังไฟจริงตอนทำงานต่อเนื่องได้ไม่เกิน 550 วัตต์
ตัวเลขความเร็วที่รายงานคือเกิน 700 สัญลักษณ์ต่อวินาทีต่อผู้ใช้หนึ่งคนบนโมเดล DeepSeek R1 เมื่อมีผู้ใช้คนเดียว เกือบ 700 บน Kimi K2.5 และราว 1,400 บน GPT-OSS โดย OpenAI เป็นฝ่ายรันชุดทดสอบชื่อ InferenceX ของสำนักวิเคราะห์เอง ไม่ใช่สำนักวิเคราะห์เป็นคนรัน
หัวหน้าฝ่ายฮาร์ดแวร์ของ OpenAI ชื่อ Richard Ho พูดถึงผลนี้ในการแถลงทางโทรศัพท์ว่า "The bottom line is that the results show a very, very significant performance advance over state of the art" และพูดต่อในอีกช่วงหนึ่งว่า "Jalapeño can serve more AI work per unit of power, while also returning responses more quickly" กำหนดใช้งานจริงคือปลายปี 2026 ในจำนวนน้อยมาก แล้วทยอยขยายตลอดปี 2027 โดยผลผลิตส่วนใหญ่จะมาช่วงปลายปีหน้า
ข้อควรระวังมีห้าข้อ ข้อแรกและสำคัญที่สุดคือยังไม่มีบุคคลที่สามทำซ้ำตัวเลขใดได้เลยสักตัว ผู้วิเคราะห์เขียนไว้เองว่า "all numbers are provided to us by OpenAI" และเข้าไปดูการรันด้วยตาแต่ไม่ได้รันชุดทดสอบเองทั้งหมด ข้อสองคือผลทั้งหมดวัดที่ข้อความเข้าแปดพันสัญลักษณ์และออกหนึ่งพัน ซึ่งเป็นโจทย์ที่จูนง่ายกว่างานจริงที่คุยหลายรอบและบริบทยาว ข้อสามคือตอนนี้ชิปยังอยู่ในขั้นตัวอย่างวิศวกรรม ยังไม่ได้ผลิตจริง ข้อสี่คือชิปของ OpenAI รันแบบทำนายทีละสัญลักษณ์ ขณะที่ตัวเลขของชิปรุ่นถัดไปที่เอามาเทียบใช้เทคนิคเดาล่วงหน้า และข้อห้าคือผู้วิเคราะห์ระบุเองว่า "we believe that comparison to Blackwell is somewhat incomplete and unfair" เพราะคู่เทียบที่ถูกต้องคือชิปรุ่นถัดไปที่ใช้หน่วยความจำรุ่นเดียวกัน ส่วนของที่ยกมาเทียบยังใช้หน่วยความจำรุ่นก่อน
▲ ทำไมต้องรู้ · ค่าใช้จ่ายที่องค์กรจ่ายให้ AI ส่วนใหญ่ไม่ได้อยู่ที่การฝึกโมเดล แต่อยู่ที่การเรียกใช้ซ้ำๆ ทุกวัน การที่ผู้ให้บริการรายใหญ่ที่สุดหันมาทำชิปเองสำหรับขั้นนี้โดยเฉพาะ เป็นสัญญาณว่าต้นทุนต่อการเรียกหนึ่งครั้งมีทางลงอีก แต่ไม่ใช่ปีนี้ ส่วนที่ใช้ได้ทันทีคือแบบแผนการอ่านตัวเลขของผู้ขาย ให้ดูก่อนว่าใครเป็นคนวัด วัดที่ความยาวข้อความเท่าไร และคู่เทียบเป็นรุ่นเดียวกันหรือรุ่นก่อน