Wiki · news-analysis · confidence: medium · ⚙ auto-approved · fact-checker

Grok 4.5 (SpaceXAI): โมเดล coding/agentic ราคาถูก token-efficient · เลข launch ส่วนใหญ่ self-reported

xaispacexaigrokfrontier-modelbenchmarkmedia-literacyupdated 2026-07-10

Grok 4.5: frontier ราคาถูกจาก SpaceXAI (เดิม xAI)

เกิดอะไรขึ้น

SpaceXAI (เดิมชื่อ xAI) ปล่อย Grok 4.5 (~8 ก.ค. 2026) เป็นโมเดลที่วางตำแหน่งเน้น coding + agentic work · Elon Musk เรียกมันว่า "Opus-class" (quote ตรง: "It is an Opus-class model, but faster, more token-efficient and lower cost" · แยกอีกทีบอก "roughly comparable to Opus 4.7") (TechCrunch)

หมายเหตุแบรนด์: xAI rebrand เป็น SpaceXAI ช่วง 8-9 ก.ค. (SpaceX ควบ xAI ตั้งแต่ ก.พ. · Cursor ถูกซื้อ) · เวลาอ้างในสไลด์ใช้ "SpaceXAI (เดิม xAI)"

สถาปัตยกรรม + ราคา (แยก vendor ออกจาก confirmed)

  • MoE + เทรนด้วยข้อมูล session จริงจาก Cursor: ยืนยันโดย Cursor เอง (first-party): "a mixture-of-experts model... Training included trillions of tokens of Cursor data" (Cursor)
  • Context window 500,000 token: ยืนยันแล้ว (ลดจาก Grok 4.3 ที่ 1M) (Cursor)
  • "1.5-trillion-parameter V9 foundation": เป็นตัวเลขที่ Musk พูดเอง ยังไม่มีในเอกสาร launch ทางการ · หลาย source ระบุชัดว่า "SpaceXAI hasn't published an official parameter count; the widely-repeated 1.5T V9 figure is unconfirmed" → ห้ามเขียนเป็นข้อเท็จจริงเชิงสถาปัตยกรรม (kingy.ai)
  • ราคา API: base $2 / $6 ต่อ 1M (input/output) · cached input ~$0.50/M · ยังมี variant "fast" ที่ $4/$18 และ surcharge เมื่อ context เกิน 200K (Cursor, kingy.ai)
  • serving speed: xAI เคลม ~80 tok/s · Artificial Analysis วัดอิสระได้ 91.3 tok/s (เร็วกว่าที่เคลม) (Artificial Analysis)

Benchmark: 4 ชาร์ตของ xAI = vendor · แต่ "โมเดลนี้ถูก verify อิสระแล้ว"

xAI self-reported (4 benchmark ที่เลือกโชว์เอง · ยังไม่มี third-party ตรวจ 4 ตัวนี้): Grok 4.5 ชนะ Opus 4.8 สองตัว · แพ้สองตัว · และ Claude Fable 5 นำทั้ง 4 (roo.beehiiv)

benchmark Grok 4.5 Opus 4.8 ผล
DeepSWE 1.0 62.0 55.75 Grok ชนะ
Terminal-Bench 2.1 83.3 78.9 Grok ชนะ
DeepSWE 1.1 53 59 Grok แพ้
SWE-Bench Pro 64.7 69.2 Grok แพ้

สำคัญ (กันเข้าใจผิด): คำว่า "ยังไม่มี independent verification" ใช้ได้เฉพาะกับ 4 ชาร์ต launch นี้ · ตัวโมเดลถูก verify อิสระแล้วภายใน 24 ชม. โดย Artificial Analysis:

Independent (Artificial Analysis Intelligence Index):

  • score 54 อันดับ #4 (ตามหลัง Fable 5 = 60, Opus 4.8 = 56, GPT-5.5 = 55)
  • เหนือ ทุก open-weight model และทุก Gemini
  • ราคาถูกกว่า Opus 4.8 / GPT-5.5 มากกว่า 60% · ~$0.31/task (Artificial Analysis, The Decoder)

Token efficiency (จุดขายจริง): SWE-Bench Pro Grok ใช้ ~15,954 output token/task เทียบ Opus 4.8 ~67,020 (~4.2x) · AA วัด Index task ได้ ~14,000 token/task · ประหยัด token คือเหตุผลที่ "ถูกกว่า" ไม่ใช่แค่ราคาต่อ token (roo.beehiiv, Artificial Analysis)

■ ไม่อยากพลาดของใหม่

อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย