AI News · 9 ข่าว

AI News · 2026-07-05

Tools

Simon Willison ปล่อย sqlite-utils 4.0rc2 ที่ "Fable 5 เขียน+รีวิวเกือบทั้งตัว" เจอบั๊ก commit หายกลางทาง

Willison ใช้ Fable 5 (ต้นทุนจริงไม่ได้ subsidize $149.25) รีวิว sqlite-utils รอบสุดท้ายก่อน stable เจอบั๊กสำคัญเช่น delete_where() ที่ไม่ commit transaction · แล้วให้ GPT-5.5 รีวิวไขว้ (cross-model) เจอเพิ่มว่า query() แอบ commit write ก่อนจะ raise error

ทำไมต้องรู้ · เคสสดของ "AI ช่วยรีวิว release" + เทคนิค cross-model review (ให้คนละค่ายตรวจกันเอง) ที่เอาไปสอน QA workflow ได้ทันที · ต่อ thread "ตรวจงาน AI เสมอ" (คู่กับ Building to the Test 07-03)

"Better Models: Worse Tools": Opus 4.8 / Sonnet 5 เรียก custom tool schema ผิดบ่อยกว่ารุ่นเก่า

Armin Ronacher พบว่าโมเดล Anthropic รุ่นใหม่ invoke tool ที่นิยามเองผิด (over-invoke) มากกว่ารุ่นก่อน เพราะถูก train ให้เก่ง edit tools ในตัวของ Claude Code เป็นหลัก จนคนที่เขียน tool/integration ของตัวเองเจอ regression

ทำไมต้องรู้ · สวนสัญชาตญาณ "โมเดลใหม่ = ดีกว่าทุกอย่าง" · ใครสอน MCP / agent tool design ต้องเตือนว่าอัป model แล้วต้อง re-test tool-calling ของตัวเอง ไม่ใช่แค่ดู benchmark

Claude Code เจอรายงาน session/cache "รั่วข้ามพื้นที่": Enterprise ZDR โผล่งานที่ไม่ใช่ของตัวเอง

GitHub issue #74066 (277 pts): ผู้ใช้ที่ล็อกอิน Enterprise ZDR อยู่ๆ agent ถามเรื่องสร้างวิหาร Minecraft แล้ว recap ยืนยันว่ากำลังทำอยู่ ทั้งที่ไม่เกี่ยวกับงานเลย · เกิดหลัง compact ประวัติ + setup รัน agent คนละ dir กับที่ทำงาน (มี .claude สองที่) · ติด label area:security+area:core ยังไม่มีคำตอบทางการจาก Anthropic (v2.1.199, macOS)

ทำไมต้องรู้ · ต่อ thread trust/telemetry ของ AI tool ทั้งสัปดาห์ (Alibaba ban 07-04, steganographic marker 07-02) · ลูกค้าองค์กรสาย compliance จะถามเรื่อง data isolation ทันที ต้องตอบได้ว่ายังเป็น report ที่ยังไม่ยืนยัน

Open Source AI Gap Map: ดัชนี open-source AI 421 โปรเจกต์ในที่เดียว

Current AI ทำ index รวม 421 รายการ (software 266, models 85, datasets 50, hardware 20) ข้อมูลใต้แผนที่เป็น MIT license เปิดบน GitHub

ทำไมต้องรู้ · reference สำเร็จรูปเวลาลูกค้าถาม "มีทางเลือก open-source แทนตัวนี้ไหม" · ใช้ทำสไลด์ภูมิทัศน์ open ecosystem ได้เลย

Research

EvoPolicyGym: benchmark วัด agent ที่ "ปรับ policy ของตัวเองซ้ำๆ" จาก feedback

เปเปอร์อันดับต้นบน HF (42 upvotes): วัดความสามารถ agent ในการค่อยๆ ปรับ executable policy ให้ดีขึ้นผ่าน feedback ในสภาพแวดล้อม interactive แบบคุมได้

ทำไมต้องรู้ · ต่อ thread "วัด agent ให้ลึกกว่าคะแนนดิบ" ของสัปดาห์ (PACE/SkillCoach 07-04, AgenticSTS 07-03) · self-improving agent เป็นหัวข้อที่ผู้บริหารเริ่มถาม

FlashMorph: เลือกเป็นราย layer ว่าชั้นไหนต้อง full attention ชั้นไหนใช้ linear ได้

เปเปอร์ "Morphing into Hybrid Attention" (37 upvotes): วิธีแปลง Transformer ให้เป็น hybrid โดยเก็บ full attention เฉพาะ layer ที่จำเป็น ลด compute โดยพยายามคงคุณภาพ

ทำไมต้องรู้ · พื้นฐานว่าทำไมโมเดลรุ่นใหม่ถึงเสิร์ฟ context ยาวได้ถูกลง · ใช้ตอบคำถาม "1M context ทำได้ยังไงไม่ให้แพงระเบิด" ในคลาสสาย engineer

Business

Anthropic คุย Samsung เรื่องทำชิป AI เอง: ตาม OpenAI ที่เพิ่งออกชิป Jalapeño

Blognone (4 ก.ค.): Anthropic รายงานว่าคุยกับ Samsung เรื่องผลิตชิป AI custom (ยังไม่เผย workload หรือแผน) · Anthropic ยืนยันกระจาย compute หลายเจ้าอยู่แล้ว (Google, Amazon, NVIDIA) และจะเดินหน้า diversify ต่อ · เกิดหลัง OpenAI เปิดตัวชิป Jalapeño กับ Broadcom

ทำไมต้องรู้ · lab ใหญ่ทุกเจ้าเริ่มลงมาทำชิปเองเพื่อกดต้นทุน · เล่าให้ผู้บริหารเห็นว่าสงครามต้นทุน AI ย้ายลงไปถึงชั้น hardware แล้ว

Cloudflare แยกบอทเป็น 3 ประเภท Search/Agent/Training: เว็บมีโฆษณาบล็อก Training อัตโนมัติ 15 ก.ย.

นโยบายใหม่แบ่งบอทเป็น Search (จัด index), Agent (ทำงานแทน), Training (เทรนโมเดล) · ตั้งแต่ 15 ก.ย. 2026 เว็บที่มีโฆษณาจะบล็อก Agent+Training อัตโนมัติ ปล่อยแต่ Search · บอทที่ทำหลายหน้าที่ ถ้าเว็บบล็อก Training จะโดนบล็อกทั้งตัว บีบให้ยักษ์ (Google/Bing/Apple) ประกาศ capability ให้ชัด

ทำไมต้องรู้ · กระทบทั้งฝั่งทำ AI agent ที่วิ่งดึงเว็บ และฝั่ง data strategy ของคนทำโมเดล · เป็นหมุดหมายว่า "เข้าถึงข้อมูลเว็บฟรี" กำลังปิดลงเรื่อยๆ

แคมเปญ "Right to Intelligence": ปกป้องสิทธิ์รันโมเดล AI บนเครื่องตัวเอง

แคมเปญพุ่งขึ้น HN 539 pts เรียกร้องสิทธิ์การรัน local/open AI (body หน้าเว็บ block เหมือน 07-04 เก็บได้แค่หัวข้อ/คะแนนผ่าน HN)

ทำไมต้องรู้ · ต่อ thread อธิปไตย/ความเป็นส่วนตัวของ local AI (llama.cpp 1M บน 5090 · sovereign LLM Amalia/LongCat) · สะท้อนว่าประเด็น "สิทธิ์ใช้ AI นอก cloud" เริ่มกลายเป็นขบวนการเชิงนโยบาย

■ ไม่อยากพลาดของใหม่

สรุปข่าวแบบนี้ระบบทำทุกเช้า ถ้าอยากให้คัดเรื่องเด่นส่งถึงมือทาง LINE โดยไม่ต้องแวะมาเช็คเอง กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย