AI News · 12 ข่าว

AI News · 2026-07-10

Models

OpenAI ปล่อย GPT-5.6 family (Sol/Terra/Luna) ขึ้น GA 9 ก.ค. หลังผ่าน 12-day gated preview ของรัฐบาลสหรัฐ ⚙

ตระกูล 3 tier: Sol (flagship long-horizon/agentic), Terra (กลาง), Luna (เร็ว/ถูก) · ราคา Sol $5/$30, Terra $2.50/$15, Luna $1/$6 ต่อ 1M · สำคัญเรื่องสถานะ: announce เป็น 2 จังหวะ · limited preview ที่ถูก gate โดยรัฐบาลสหรัฐ ~26 มิ.ย. แล้ว ขึ้น general availability เต็มตัว 9 ก.ค. (อย่าพูดว่ายัง preview) · benchmark OpenAI-reported: Agents' Last Exam Sol 53.6 นำ Fable 5 (40.5) ~13.1 pt · แต่ SWE-Bench Pro อิสระ Fable 5 (~80%) ยังชนะ Sol (~64.6%) · Artificial Analysis Index อิสระ: Sol 59 อันดับ #2 · UK AISI flag universal jailbreak ด้าน cyber

ทำไมต้องรู้ · frontier ออกถี่ระดับวันเว้นวัน สไลด์เปรียบเทียบต้องติดวันที่กำกับ · เคสสอน media literacy สด: headline "แซง Fable 5" เป็น vendor number ที่ selective พอดูงาน coding อิสระกลับแพ้ · และ การต้องผ่าน gated preview ของรัฐก่อน GA คือ data point ล่าสุดของ AI governance (thread เดียวกับ export controls) · ผ่าน fact-checker gate หลังแก้สถานะ GA + ติดป้าย vendor number → เก็บเข้า wiki

SpaceXAI (เดิม xAI) ปล่อย Grok 4.5: coding/agentic ราคาถูก token-efficient · เลข launch เกือบทั้งหมด self-reported ⚙

Grok 4.5 (8 ก.ค.) MoE เทรนด้วย session data จริงจาก Cursor · context 500K · ราคา $2/$6 (base) · Musk เรียก "Opus-class" · ตัวเลข "1.5T V9" เป็นคำ Musk พูดเอง ยังไม่มีในเอกสาร launch ทางการ · 4 benchmark ที่ xAI โชว์: ชนะ Opus 4.8 สองตัว แพ้สองตัว Fable 5 นำทั้ง 4 · แต่โมเดลถูก verify อิสระแล้ว: Artificial Analysis Index = 54 อันดับ #4 (ตามหลัง Fable 60/Opus 56/GPT-5.5 55) เหนือทุก open-weight + Gemini ถูกกว่า Opus 60%+ · ประหยัด token ~4x (15,954 vs 67,020 ต่อ task)

ทำไมต้องรู้ · launch เดียวมีครบ 3 ชั้นให้สอนแยก: vendor selective (เลือกโชว์ 4 ชาร์ตดูดี) · เลข CEO พูดเองยังไม่ยืนยัน (1.5T) · เลข independent ที่ต่ำกว่าเคลม (#4) · และเป็นเคส "benchmark gap อาจไม่สำคัญเท่าราคา/token efficiency" ตอบลูกค้าที่ถามว่าต้องใช้ตัวแพงสุดไหม · ผ่าน fact-checker gate หลัง scope เลข vendor + ติดป้าย 1.5T ว่า unconfirmed → เก็บเข้า wiki

Meta ปล่อย Muse Spark 1.1 + เปิด Meta Model API: เน้น agentic tool calling + computer use (ต่อเนื่องจาก 2026-07-08)

Meta ปล่อย Muse Spark 1.1 พร้อมเปิด API (Meta Model API) ครั้งแรก · จุดเน้น agentic tool calling + computer use + coding · Meta ยอมรับ benchmark ยังตามหลัง Opus/GPT แต่เคลม internal test ว่าสูสี · Simon Willison ลองสร้าง plugin llm-meta-ai ต่อ CLI แล้วทดสอบ generate SVG · ยังไม่เปิดในไทย (HN 309 pts)

ทำไมต้องรู้ · ต่อ thread Meta Muse (คู่กับ Muse Image 07-08 + teaser Muse Spark coding/agentic 07-04) · Meta เปิด API = เข้าถึงได้จริงนอก Meta AI/IG แล้ว · แต่ข้อจำกัด "ยังไม่เปิดในไทย" เป็นจุดที่ต้องเช็คก่อนแนะนำลูกค้าไทย · data point landscape ว่าเจ้าใหญ่ทุกรายมี agentic API แล้ว

Tools

OpenAI เปิด ChatGPT Work: workplace agent ขับด้วย GPT-5.6 · คู่แข่งตรงของ Claude Cowork

ChatGPT Work (9 ก.ค.) ทำงานข้ามแอป/ไฟล์ (Slack, Gmail, Salesforce, ไฟล์ในเครื่อง), มี built-in browser + Computer Use, ระบบ Plugins, และ Sites (beta) สร้าง dashboard/เว็บแอปจาก output · ทำงานหลายขั้นแบบ scheduled เองได้ · roll out เริ่ม Pro/Enterprise/Edu แล้วขยาย Plus/Business ในไม่กี่วัน

ทำไมต้องรู้ · กระทบคอร์ส Cowork ทั้งสองตรงๆ: ตลาด workplace agent มีผู้เล่นใหญ่เพิ่ม (OpenAI ตาม Anthropic Claude Cowork + Microsoft Copilot Cowork) · ต้องอัป slide landscape "ใครทำ agentic workspace บ้าง" และเตรียมตอบ "ChatGPT Work ต่างจาก Cowork ยังไง" · pattern เดียวกัน (cross-app + computer use + human-in-the-loop) แต่คนละ ecosystem

Claude Code 2.1.206: เพิ่ม /cd path suggestions + /doctor เตือน CLAUDE.md อ้วน + git push remote handling (ต่อเนื่องจาก 2026-07-09)

ขยับจาก 2.1.205 · maintenance/DX release: /cd แนะนำ path แบบ /add-dir, /doctor เพิ่ม check เสนอ trim ไฟล์ CLAUDE.md ที่ใหญ่เกิน, ปรับ git push ให้รองรับ configured push remote · แก้บั๊ก expired login message, MCP server timeout, OAuth token refresh · ไม่มี breaking UI ใหม่

ทำไมต้องรู้ · เวอร์ชันที่ใช้สอน workshop ขยับต่อ · จุด "/doctor เตือน CLAUDE.md อ้วน" ตรงกับที่สอนเรื่อง context hygiene (ไฟล์ instruction ยาวเกินกิน token/ทำโมเดลหลง) · permission Manual ยังเป็น ■ เดิม ไม่มี demo พังเพิ่ม

Simon Willison: "Rewriting Bun in Rust" · แปลง 535,496 บรรทัด Zig→Rust ใน 11 วัน ด้วย Fable 5 · ค่า API $165,000

Willison เขียนถึงเคส Jarred Sumner (ผู้สร้าง Bun) ใช้ Fable 5 (pre-release Mythos-class) + Claude Code แปลง codebase Bun จาก Zig เป็น Rust 535,496 บรรทัด จนผ่าน test suite 100% ทุก platform ใน 11 วัน · ต้นทุน API ~$165,000 · เทคนิคหลัก: conformance test suite เป็น ground truth + adversarial code review

ทำไมต้องรู้ · เคส AI-at-scale ที่มีตัวเลขจริงครบ (บรรทัด/วัน/ดอลลาร์) ไว้เล่าให้ผู้บริหารเห็นว่า "AI แปลงภาษาโปรแกรมทั้ง codebase ได้จริง แต่แลกด้วย $165k + ต้องมี test suite แน่นเป็น oracle" · ต่อ thread cost/AI ROI (Tunguz break-even 2029 07-07, Meta tokenmaxxing 07-03) · จุดสอน: ไม่มี test suite = ทำแบบนี้ไม่ได้

Microsoft ปล่อย Flint: ภาษา/เครื่องมือ visualize การทำงานของ AI agent (HN 338 pts)

Microsoft เปิด Flint เป็น visualization language สำหรับ render flow การทำงานของ AI agent (trajectory/tool calls) เป็นแผนภาพ · open บน GitHub · ขึ้น HN 338 คะแนน 8 ก.ค.

ทำไมต้องรู้ · ต่อ thread "วัด/มองเห็น agent ให้ลึก" (คู่กับ AgentLens ข้อ 9 + Beyond the Leaderboard 07-09) · observability ของ agent กำลังเป็นหมวดเครื่องมือของตัวเอง · ใช้ตอบผู้เรียนสาย dev/architect ว่า debug agent ที่ทำงานหลายขั้นดูยังไง

Research

"The Harness Effect" (arXiv 2607.06906): orchestration design กำหนด token economics มากกว่าเลือก model

ทดลองคุมตัวแปรข้าม 6 foundation model เปลี่ยนแค่วิธี orchestrate: ต้นทุน/task ลด 41% ($0.21→$0.12), token ลด 38% (14.2k→8.8k), latency ลด 44% โดยคุณภาพงานคงที่ (0.78→0.81) · quality-per-dollar เพิ่ม 82% · ประหยัดต่อเนื่องทุกโมเดล (33-61%) · สรุป: ชั้น orchestration มีผลต่อ economics มากกว่าความต่างระหว่างตัวโมเดล

ทำไมต้องรู้ · หลักฐานวิชาการตรงหัวใจคอร์ส Cowork/agent: แทนที่จะไล่อัป model แพงขึ้นเรื่อยๆ (token maxxing) ให้ออกแบบ harness/orchestration ให้ดีก่อน · ตัวเลขสำเร็จรูปตอบผู้บริหารว่า "ลดบิล AI 40% โดยไม่เปลี่ยนโมเดล" ทำได้ที่ชั้นออกแบบระบบ (คู่กับ Grok token efficiency ข้อ 2 + )

arXiv agent-eval cluster (07-09): AgentLens (production trajectory review) + In-Context Search เมื่อไหร่ช่วยจริง

"AgentLens" (2607.06624) เสนอวิธีรีวิว trajectory ของ coding agent จาก production เพื่อประเมินจริง · "When Does In-Context Search Help?" (2607.06720) วางทฤษฎี sampling-complexity ว่า reflection-driven reasoning ช่วยเมื่อไหร่และไม่ช่วยเมื่อไหร่

ทำไมต้องรู้ · ต่อ thread "วัด agent ให้ลึกกว่าคะแนนดิบ" ของสัปดาห์ (Beyond the Leaderboard 07-09, AutomationBench 07-08) · AgentLens = ประเมินจาก trajectory จริงไม่ใช่ score เดียว · In-Context Search = เตือนว่า "ให้โมเดลคิดซ้ำ/ค้นในหัว" ไม่ได้ช่วยเสมอ ต้องรู้เงื่อนไข

SciReasoner (arXiv 2607.07708 · HF 71 upvotes): scientific foundation model reasoning ข้าม protein/molecule/crystal

เปเปอร์ท็อปของ HF ช่วงนี้: multimodal scientific foundation model ที่ทำ structural reasoning แบบตีความได้ ข้ามโดเมน protein/molecule/crystal ผ่าน unified structure-aware vocabulary

ทำไมต้องรู้ · ต่อ thread AI lab verticalize เข้า science (คู่กับ Anthropic ประกาศทำ drug development เอง 07-04) · data point ว่า foundation model สาย science กำลังโต · ใช้ตอบผู้เรียนสาย R&D/pharma/material ว่า AI ในงานวิทยาศาสตร์ไม่ใช่แค่ LLM คุยเก่ง

Business

Samsung Q2 กำไรพุ่ง ~19 เท่า YoY · รายได้โต ~129% จากดีมานด์ชิปหน่วยความจำสาย AI

Samsung รายงานผลประกอบการเบื้องต้น Q2: รายได้เพิ่มราว 129% กำไรจากการดำเนินงานเพิ่มราว 19 เท่าเทียบ Q2 ปี 2025 · แรงหลักมาจากความต้องการ AI-related memory chip

ทำไมต้องรู้ · ต่อ thread "สงครามต้นทุน/กำลังประมวลผลของ AI" (Anthropic เช่า DC Kentucky 07-07, คุย Samsung ทำชิป 07-05) · ตัวเลขนี้เป็นหลักฐานฝั่ง supply ว่า capex AI ยังโตแรงจริง ไม่ใช่แค่ hype · ใช้เล่าภาพผู้บริหารว่าเงินไหลเข้า infrastructure ชั้น hardware ก่อนถึง application

"AI content อยู่ทุกที่ในโซเชียล โดยเฉพาะ LinkedIn" (Pangram · HN 172 pts)

บทวิเคราะห์ Pangram (เครื่องมือตรวจ AI text) ชี้ว่าคอนเทนต์ที่ generate ด้วย AI ท่วมฟีดโซเชียล โดยเฉพาะ LinkedIn ในสัดส่วนสูง · ขึ้น HN 172 คะแนน 9 ก.ค.

ทำไมต้องรู้ · ต่อ thread AI slop / authenticity (คู่กับ AI fake news 07-03) · กระทบคอร์สสาย content/marketing + งาน /article โดยตรง: ตลาดล้น AI content แล้ว การเขียนด้วย "น้ำเสียงจริงของแบรนด์/คน" (VOICE) กลายเป็น differentiator ไม่ใช่แค่ generate ให้ไว · เตือนผู้เรียนว่า "โพสต์ AI ล้วน" เริ่มถูกจับได้และลด trust (คู่กับ , )

■ ไม่อยากพลาดของใหม่

สรุปข่าวแบบนี้ระบบทำทุกเช้า ถ้าอยากให้คัดเรื่องเด่นส่งถึงมือทาง LINE โดยไม่ต้องแวะมาเช็คเอง กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย