OpenAI บอกว่าโมเดลรุ่นถัดไปของตัวเองอาจแรงถึงระดับ Critical ด้านความปลอดภัยไซเบอร์ จึงพักงานภายในบางส่วนไว้ก่อนปล่อย (ต่อเนื่องจาก 2026-08-02)
OpenAI เผยแพร่โพสต์ชื่อ Responding to the next frontier of critical cyber capabilities เมื่อ 7 ส.ค. 2026 ระบุว่าหลังประเมินโมเดลรุ่นถัดไปที่ยังไม่ปล่อยซึ่งใช้ชื่อภายในว่า Astra ผลออกมาแรงพอที่บริษัทเขียนเองว่า "our preliminary evaluations indicate strong enough performance that we cannot rule out Critical capability level" ในหมวดความปลอดภัยไซเบอร์ของกรอบ Preparedness Framework ซึ่งบริษัทเผยแพร่ครั้งแรกเมื่อธันวาคม 2023
นิยามระดับ Critical ที่โพสต์ยกมาเองมีสองขา ขาแรกคือโมเดลที่หาและสร้าง exploit ระดับ zero-day ได้ทุกระดับความรุนแรง ในระบบสำคัญที่ป้องกันแน่นหนาในโลกจริงหลายระบบ โดยไม่ต้องมีคนเข้าไปช่วย ขาที่สองคือโมเดลที่วางแผนและลงมือโจมตีแบบใหม่ตั้งแต่ต้นจนจบกับเป้าหมายที่ป้องกันแน่นหนา เมื่อได้รับเพียงเป้าหมายกว้างๆ ข้อเดียว
สิ่งที่บริษัทลงมือทำคือพักงานภายในที่เกี่ยวกับ Astra ซึ่งยังไม่ผ่านข้อกำหนดความปลอดภัยชุดที่เข้มขึ้น เพิ่มสภาพแวดล้อมทดสอบที่แยกออกมาและจำกัดทั้งทางออกอินเทอร์เน็ตและเครื่องมือ เพิ่มการเข้ารหัสและการป้องกันน้ำหนักโมเดล เพิ่มการรันแบบ sandbox กับการเฝ้าระวังและตรวจจับ แล้วทำงานร่วมกับหน่วยงานรัฐที่เกี่ยวข้องและองค์กรด้านความปลอดภัย AI ที่คัดเลือกไว้ เพื่อทดสอบความสามารถของโมเดล
ถ้อยคำเป็นเรื่องที่ต้องอ่านให้ตรงในข่าวนี้ เพราะโพสต์เขียนว่ายังตัดความเป็นไปได้ไม่ได้ ไม่ได้เขียนว่าถึงระดับ Critical แล้ว ส่วนคำว่าครั้งแรกมาจากข้อความที่ OpenAI โพสต์บน X เองว่ากำลังปฏิบัติกับ Astra เป็นโมเดลตัวแรกของบริษัทในระดับ critical ด้านไซเบอร์ตามกรอบของตัวเอง โดยโมเดลก่อนหน้ารวมถึง GPT-5.6 Sol ถูกประเมินไว้ที่ระดับ High ไม่ใช่ Critical
ข้อควรระวังคือหน้าเว็บของ OpenAI ปิดกั้นเครื่องมือดึงข้อมูลของเรา เราจึงอ่านตัวบทผ่าน text proxy ไม่ใช่จากหน้าต้นฉบับโดยตรง ทั้งหมดนี้เป็นการประเมินเบื้องต้นของผู้ขายที่ประเมินสินค้าตัวเองและยังไม่มีการยืนยันจากภายนอก โพสต์ระบุชัดด้วยว่า "Astra is an upcoming model, and was not involved in exploiting Hugging Face." จึงเป็นโมเดลคนละตัวกับที่ก่อเหตุกับ Hugging Face และยังไม่มีกำหนดปล่อย Astra
▲ ทำไมต้องรู้ · สิ่งที่ข่าวนี้บอกกับคนทำงานคือความสามารถเขียนโค้ดกับความสามารถเจาะระบบเป็นของที่โตขึ้นพร้อมกัน แยกจากกันไม่ได้ เมื่อผู้สร้างโมเดลเองต้องพักงานเพราะกลัวความสามารถของสิ่งที่ตัวเองสร้าง สมมติฐานที่องค์กรควรใช้คือเครื่องมือรุ่นถัดๆ ไปจะเจาะระบบเก่งขึ้นเรื่อยๆ ไม่ว่าจะตั้งใจหรือไม่ ข้อที่หยิบไปใช้ได้ทันทีคือระบบภายในที่ agent เข้าถึงได้ ควรถูกนับว่าเป็นระบบที่ผู้โจมตีเข้าถึงได้ด้วย และอีกข้อคือเวลาอ่านข่าวความปลอดภัยของ AI ให้ดูว่าใครประเมิน เพราะกรณีนี้ผู้ประเมินคือเจ้าของโมเดล ไม่ใช่ผู้ตรวจอิสระ
TechCrunch · OpenAI · openai-astra-critical-cyber · openai-astra-ten-proofs