Grok 4.5 (SpaceXAI): โมเดล coding/agentic ราคาถูก token-efficient · เลข launch ส่วนใหญ่ self-reported
Grok 4.5: frontier ราคาถูกจาก SpaceXAI (เดิม xAI)
เกิดอะไรขึ้น
SpaceXAI (เดิมชื่อ xAI) ปล่อย Grok 4.5 (~8 ก.ค. 2026) เป็นโมเดลที่วางตำแหน่งเน้น coding + agentic work · Elon Musk เรียกมันว่า "Opus-class" (quote ตรง: "It is an Opus-class model, but faster, more token-efficient and lower cost" · แยกอีกทีบอก "roughly comparable to Opus 4.7") (TechCrunch)
หมายเหตุแบรนด์: xAI rebrand เป็น SpaceXAI ช่วง 8-9 ก.ค. (SpaceX ควบ xAI ตั้งแต่ ก.พ. · Cursor ถูกซื้อ) · เวลาอ้างในสไลด์ใช้ "SpaceXAI (เดิม xAI)"
สถาปัตยกรรม + ราคา (แยก vendor ออกจาก confirmed)
- MoE + เทรนด้วยข้อมูล session จริงจาก Cursor: ยืนยันโดย Cursor เอง (first-party): "a mixture-of-experts model... Training included trillions of tokens of Cursor data" (Cursor)
- Context window 500,000 token: ยืนยันแล้ว (ลดจาก Grok 4.3 ที่ 1M) (Cursor)
- "1.5-trillion-parameter V9 foundation": เป็นตัวเลขที่ Musk พูดเอง ยังไม่มีในเอกสาร launch ทางการ · หลาย source ระบุชัดว่า "SpaceXAI hasn't published an official parameter count; the widely-repeated 1.5T V9 figure is unconfirmed" → ห้ามเขียนเป็นข้อเท็จจริงเชิงสถาปัตยกรรม (kingy.ai)
- ราคา API: base $2 / $6 ต่อ 1M (input/output) · cached input ~$0.50/M · ยังมี variant "fast" ที่ $4/$18 และ surcharge เมื่อ context เกิน 200K (Cursor, kingy.ai)
- serving speed: xAI เคลม ~80 tok/s · Artificial Analysis วัดอิสระได้ 91.3 tok/s (เร็วกว่าที่เคลม) (Artificial Analysis)
Benchmark: 4 ชาร์ตของ xAI = vendor · แต่ "โมเดลนี้ถูก verify อิสระแล้ว"
xAI self-reported (4 benchmark ที่เลือกโชว์เอง · ยังไม่มี third-party ตรวจ 4 ตัวนี้): Grok 4.5 ชนะ Opus 4.8 สองตัว · แพ้สองตัว · และ Claude Fable 5 นำทั้ง 4 (roo.beehiiv)
| benchmark | Grok 4.5 | Opus 4.8 | ผล |
|---|---|---|---|
| DeepSWE 1.0 | 62.0 | 55.75 | Grok ชนะ |
| Terminal-Bench 2.1 | 83.3 | 78.9 | Grok ชนะ |
| DeepSWE 1.1 | 53 | 59 | Grok แพ้ |
| SWE-Bench Pro | 64.7 | 69.2 | Grok แพ้ |
สำคัญ (กันเข้าใจผิด): คำว่า "ยังไม่มี independent verification" ใช้ได้เฉพาะกับ 4 ชาร์ต launch นี้ · ตัวโมเดลถูก verify อิสระแล้วภายใน 24 ชม. โดย Artificial Analysis:
Independent (Artificial Analysis Intelligence Index):
- score 54 อันดับ #4 (ตามหลัง Fable 5 = 60, Opus 4.8 = 56, GPT-5.5 = 55)
- เหนือ ทุก open-weight model และทุก Gemini
- ราคาถูกกว่า Opus 4.8 / GPT-5.5 มากกว่า 60% · ~$0.31/task (Artificial Analysis, The Decoder)
Token efficiency (จุดขายจริง): SWE-Bench Pro Grok ใช้ ~15,954 output token/task เทียบ Opus 4.8 ~67,020 (~4.2x) · AA วัด Index task ได้ ~14,000 token/task · ประหยัด token คือเหตุผลที่ "ถูกกว่า" ไม่ใช่แค่ราคาต่อ token (roo.beehiiv, Artificial Analysis)
Sources (6)
- https://cursor.com/blog/grok-4-5 fetched 2026-07-10
- https://artificialanalysis.ai/articles/grok-4-5-brings-spacexai-to-the-the-intelligence-frontier fetched 2026-07-10
- https://roo.beehiiv.com/p/grok-4-5 fetched 2026-07-10
- https://kingy.ai/blog/grok-4-5-benchmarks-pricing-context-window/ fetched 2026-07-10
- https://techcrunch.com/2026/07/08/spacexai-releases-grok-4-5-which-elon-describes-as-an-opus-class-model/ fetched 2026-07-10
- https://the-decoder.com/grok-4-5-is-so-cheap-compared-to-fable-5-and-gpt-5-5-that-benchmark-gaps-may-not-matter-much/ fetched 2026-07-10
อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย