Wiki · news-analysis · confidence: medium · ⚙ auto-approved · fact-checker

GPT-5.6 (Sol / Terra / Luna): OpenAI frontier family ที่ขึ้น GA หลัง US-gov gated preview

openaigpt-5-6frontier-modelbenchmarkchatgpt-workai-governanceupdated 2026-07-10

GPT-5.6 family: Sol / Terra / Luna

as-of 2026-07-10 · launch เร็วมาก สถานะ availability เปลี่ยนได้ในไม่กี่วัน ให้เช็คซ้ำก่อนอ้างในคลาส

เกิดอะไรขึ้น

OpenAI เปิดตัวตระกูล GPT-5.6 เป็น 3 tier: Sol (flagship เก่งสุด เน้น long-horizon/agentic), Terra (กลาง สมดุล everyday), Luna (เร็ว/ถูกสุด high-volume) (Simon Willison, DataCamp)

สถานะ availability (จุดที่สื่อสับกันเยอะ): โมเดลถูก announce เป็น 2 จังหวะ · จังหวะแรก ~26 มิ.ย. เป็น limited preview ที่ถูก gate โดยรัฐบาลสหรัฐ (12-day preview ทดสอบกรอบ voluntary AI framework) · จากนั้น 9 ก.ค. 2026 ขึ้น general availability เต็มตัวบน ChatGPT / Codex / API หลังจบด่านรัฐ ("ending government limits") (CNBC) · อย่าพูดว่า "ยังเป็น preview ใช้ทั่วไปไม่ได้" เพราะ ณ วันนี้ GA แล้ว

ราคา API (ต่อ 1M token · input/output)

  • Sol: $5 / $30
  • Terra: $2.50 / $15
  • Luna: $1 / $6

cache write คิด 1.25x ของ input · cache read ลด ~90% · ตัวเลขนี้ตรงกันหลาย source (Simon Willison, DataCamp) · เทียบ Claude Opus 4.8 ที่ $5/$25

Benchmark: แยก "OpenAI เคลม" ออกจาก "อิสระ" ให้ชัด

OpenAI-reported (vendor · ต้องติดป้ายเสมอ):

  • Agents' Last Exam (ALE): Sol 53.6 นำ Claude Fable 5 (40.5) ~13.1 point (Simon Willison) · หมายเหตุ: smol.ai รายงาน ALE = 52.7 เพราะตั้ง effort ต่างกัน → เลขเดียวกันขยับตาม setting
  • Terminal-Bench 2.1: Sol Ultra 91.9% · plain Sol 88.8% (DataCamp)
  • OpenAI ยังโปรโมต "Coding Agent Index 80" ซึ่งเป็น คนละตัวกับ AA Intelligence Index ด้านล่าง อย่าเอามาปนกัน

Independent (Artificial Analysis):

  • AA Intelligence Index: Sol ได้ 59 (อันดับ #2 จาก 186 โมเดล) · Sol ต้นทุนราว 1/3 ต่อ task เทียบ Fable 5 (บาง source ว่า ~1/2 แปรตาม effort · Sol ~$1.04/task max effort) (Artificial Analysis)

Counter-evidence สำคัญ (coding ไม่ได้นำทุกกระดาน): บน SWE-Bench Pro Claude Fable 5 (~80%) ชนะ Sol (~64.6%) · OpenAI เองประเมินว่า ~30% ของ task ยังพัง (Simon Willison) · Willison ผู้ทดสอบเองสรุปว่า Sol "เก่งจริง" แต่ยังไม่ชนะ Fable 5 ในงาน coding ซับซ้อนที่เขาใช้ประจำ และตื่นเต้นกับ API features (programmatic tool calling, multi-agent) มากกว่าตัวโมเดล

ChatGPT Work (product ที่มากับ GPT-5.6)

OpenAI ปล่อย ChatGPT Work เป็น workplace agent ที่ขับด้วย GPT-5.6 · ทำงานข้ามแอป/ไฟล์ (Slack, Gmail, Salesforce, ไฟล์ในเครื่อง), มี built-in browser + Computer Use, ระบบ Plugins เชื่อมแอป, และ Sites (beta) สร้าง dashboard/เว็บแอปจาก output · roll out เริ่ม Pro / Enterprise / Edu แล้วขยายไป Plus / Business ในไม่กี่วัน (OpenAI, MacRumors) · เป็นคู่แข่งตรงของ Claude Cowork (ดู ms-copilot-cowork)

Safety flag

UK AI Security Institute (AISI) รายงานว่าพบ universal jailbreaks ที่ทำให้โมเดลทำงาน long-form agentic ด้าน vulnerability discovery / exploit development ได้ในทุกรอบทดสอบ (smol.ai) · วลี "highest stakes safety issue of any model release yet" เป็น ความเห็นของ commentator (Ethan Perez, Anthropic) ไม่ใช่ถ้อยคำทางการของ AISI

■ ไม่อยากพลาดของใหม่

อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย