Wiki · news-analysis · confidence: high · ⚙ auto-approved · fact-checker

Gemini 3.8 Flash และ 3.8 Flash Cyber

googlegeminigemini-3-8-flashpricingcybersecurityfairwindbenchmarkmodel-releaseupdated 2026-09-03

Gemini 3.8 Flash และ 3.8 Flash Cyber

Google ประกาศโมเดลสองตัวเมื่อ 2 ก.ย. 2026 คือ Gemini 3.8 Flash และ Gemini 3.8 Flash Cyber โดยเขียนในประกาศของตัวเองว่า "marking our third Flash release in only six weeks" (Google)

ตัวหลักคงความเร็วและต้นทุนเท่ารุ่น 3.7 แต่ปรับความสามารถด้านการให้เหตุผลและการเขียนโปรแกรมขึ้น บันทึกการเปลี่ยนแปลงของ Gemini API ลงวันเดียวกันระบุว่า gemini-3.8-flash เข้าสถานะพร้อมใช้งานทั่วไป (Gemini API changelog)

ราคาที่มีวันหมดอายุติดมาด้วย

นี่คือส่วนที่ต้องจดใส่งบประมาณมากกว่าคะแนนสอบใดๆ ในหน้านี้

ราคาช่วงแนะนำอยู่ที่ 0.75 ดอลลาร์ต่อล้านโทเคนขาเข้า และ 3.75 ดอลลาร์ต่อล้านโทเคนขาออก หน้าราคาทางการระบุเงื่อนไขเวลาไว้ตรงตัวว่า "$0.75 through December 31, 2026" และ "$1.50 starting January 1, 2027" คู่กับ "$7.50 starting January 1, 2027" แปลว่าตั้งแต่ 1 ม.ค. 2027 ราคาทั้งขาเข้าและขาออกขึ้นเป็นสองเท่า (Gemini API pricing)

ราคาบนหน้านี้เป็นราคา ณ วันที่ 3 ก.ย. 2026 และเป็นตัวเลขที่ผู้ให้บริการเปลี่ยนได้ก่อนถึงกำหนด

ตัวเลขที่ประกาศ และกับดักการอ่านชื่อชุดทดสอบ

Google ระบุว่า 3.8 Flash ทำได้ 54.9 เปอร์เซ็นต์บน HLE-Verified หน้าโมเดลของ Google เองแสดงตัวเลขเทียบว่า 3.8 Flash อยู่ที่ 54.9 GPT-5.6 Sol อยู่ที่ 54.5 Claude Opus 5 อยู่ที่ 54.4 และ 3.7 Flash อยู่ที่ 53.6 (Google DeepMind)

กับดักอยู่ตรงนี้ ชุดทดสอบชื่อ Humanity's Last Exam แบบธรรมดาเป็นคนละแถวกับ HLE-Verified และในแถวธรรมดานั้น 3.8 Flash อยู่ที่ 45.4 เทียบกับ 3.7 Flash ที่ 45.7 คือลดลงเล็กน้อย ใครที่หยิบตัวเลขไปใช้ต้องระบุให้ตรงว่าเป็นแถวไหน ไม่อย่างนั้นจะเล่าคนละเรื่องกัน

ตัวเลข DeepSWE ที่ไม่ควรอ้างจากประกาศ

ประกาศของ Google เขียนเรื่อง DeepSWE v1.1 ไว้เป็นถ้อยคำเท่านั้นว่า "3.8 Flash outperforms most larger frontier models in autonomously solving complex engineering problems end to end, only at a fraction of the cost" โดยไม่มีตัวเลขในตัวบท ตัวเลขอยู่ในภาพกราฟเท่านั้น

ผลคือสำนักข่าวที่ไล่อ่านจากภาพรายงานตัวเลขไม่ตรงกัน บางแห่งใช้ 71.0 บางแห่งใช้ 73.7 หน้านี้จึงไม่ระบุตัวเลข DeepSWE ใครที่ต้องใช้ต้องเปิดเอกสารประเมินผลฉบับ PDF ของ Google อ่านเอง แล้วอ้างจากไฟล์นั้น ไม่ใช่อ้างจากประกาศ ความต่างระหว่างสองตัวเลขนี้เปลี่ยนเรื่องเล่าทั้งหมด เพราะตัวหนึ่งแปลว่าตามหลังอยู่พอสมควร อีกตัวแปลว่าเสมอกันในราคาที่ถูกกว่ามาก

รุ่น Cyber ไม่ได้ขายทั่วไป

Gemini 3.8 Flash Cyber เปิดให้เฉพาะกลุ่มที่ Google เรียกว่า trusted defenders ผ่านโครงการชื่อ Fairwind Program หน้าโครงการระบุกลุ่มผู้มีสิทธิไว้สามกลุ่มคือหน่วยงานรัฐและหน่วยงานความมั่นคงไซเบอร์ ระดับชาติ ผู้ดูแลโครงสร้างพื้นฐานสำคัญ และแพลตฟอร์มเทคโนโลยีหลัก พร้อมเงื่อนไขเพิ่มคือการตรวจประวัติผู้ขอใช้ การจำกัดการเข้าถึงไว้เฉพาะทีมความปลอดภัย ทีมรับมือเหตุ และทีมทดสอบเจาะระบบภายในองค์กรนั้น และการติดตามการใช้งาน (Fairwind Program)

รุ่น Cyber ไม่ปรากฏในบันทึกการเปลี่ยนแปลงของ API และไม่ปรากฏบนหน้าราคา ซึ่งสอดคล้องกับการที่มันยังไม่เปิดทั่วไป

ตัวเลขฝั่งความมั่นคงไซเบอร์ที่ต้องอ่านให้ครบ

Google ระบุว่ารุ่น Cyber ทำได้เกิน 70 เปอร์เซ็นต์บนชุดทดสอบภายในชุดเดียว ที่ให้โมเดลไล่หาช่องโหว่ ในโค้ดที่เขียนด้วยภาษาโปรแกรม 20 ภาษา จุดที่ต้องระบุให้ตรงคือเป็นชุดทดสอบชุดเดียวไม่ใช่หลายชุด และเป็นงานค้นหาช่องโหว่ ไม่ใช่งานเขียนแพตช์

บนชุดทดสอบการปะช่องโหว่ชื่อ CWE-Bench ประกาศเขียนว่า "with a pass@1 of 47.2% compared to a leading frontier model at 47.8%, yet offered at a significantly lower cost" คือรุ่น Cyber ทำได้ต่ำกว่า โมเดลที่เอามาเทียบ และ Google วางกรอบเรื่องนี้เป็นข้อได้เปรียบด้านราคา ไม่ใช่การเอาชนะ โดยไม่ระบุว่าโมเดลที่เอามาเทียบคือตัวไหน

คำกล่าวอ้างที่แรงที่สุดคือทีมความปลอดภัยของ Chrome รายงานว่ารุ่นนี้ "produced 2.6 times more correct patches to vulnerabilities in Chrome than the best commercial models" ข้อที่ต้องกำกับไว้เสมอคือ ทีมความปลอดภัยของ Chrome เป็นทีมภายในของ Google เอง ตัวเลขนี้จึงไม่ใช่การยืนยันจากบุคคลที่สาม แม้จะอ่านดูเหมือนเป็น และโมเดลที่เอามาเทียบก็ไม่ได้ระบุชื่อ

สถานะการยืนยันจากภายนอก

ตัวเลขที่ยกมาทั้งหมดในหน้านี้เป็นผลที่ Google วัดและเผยแพร่เอง ยังไม่มีใครทำซ้ำได้อย่างอิสระ ณ วันที่ 3 ก.ย. 2026

สิ่งที่มีอยู่ตอนนี้มีสองอย่างและทั้งคู่ไม่ใช่การทำซ้ำ อย่างแรกคือ Google อ้างในประกาศของตัวเองว่า Wiz พบว่ารุ่น Cyber ทำคะแนนความครอบคลุมสูงกว่าในชุดทดสอบเจาะระบบภายในของ Wiz เอง ที่ต้นทุนต่ำกว่า ซึ่งยังเป็นตัวเลขที่มาถึงเราผ่านประกาศของผู้ขาย อย่างที่สองคือผู้ประเมินอิสระเผยแพร่ผลของตัวเองแล้ว แต่ใช้ชุดทดสอบคนละชุดกัน จึงเอามาเทียบตรงๆ กับตัวเลขของ Google ไม่ได้ (Artificial Analysis)

เรื่องที่คนเข้าใจผิดบ่อย

หนึ่ง คำว่าพร้อมใช้งานทั่วไปในบันทึกการเปลี่ยนแปลง ใช้กับโมเดลบน API เท่านั้น ฝั่งผู้ใช้ทั่วไปแคบกว่านั้น คือเปิดให้เฉพาะผู้สมัครแพ็กเกจ Pro และ Ultra ผ่านแอป Gemini โหมด AI ในการค้นหา และ Google Sheets

สอง หลายคนอ่านว่ารุ่น Cyber คือรุ่นที่ซื้อเพิ่มได้ ความจริงคือซื้อไม่ได้ ต้องผ่านการคัดกรองและตรวจประวัติ

สาม ตัวเลข 2.6 เท่าถูกเล่าต่อเป็นผลทดสอบจากภายนอก ความจริงคือมาจากทีมภายในของ Google เอง

สิ่งที่องค์กรไทยหยิบไปใช้ได้

ข้อแรกคือให้ใส่วันหมดอายุของราคาลงในการคำนวณความคุ้มค่าตั้งแต่วันแรก ระบบที่คำนวณแล้วคุ้มด้วยราคา 0.75 ดอลลาร์ อาจไม่คุ้มที่ 1.50 ดอลลาร์ และวันที่เปลี่ยนราคาคือ 1 ม.ค. 2027 ซึ่งอยู่ในรอบงบประมาณถัดไปของหลายองค์กรพอดี

ข้อที่สองคือแนวโน้มที่ผู้ผลิตแยกความสามารถด้านความปลอดภัยออกไปอยู่หลังการคัดกรอง แปลว่าเครื่องมือที่เก่งที่สุดของแต่ละค่ายจะไม่ใช่ตัวที่ซื้อได้ด้วยบัตรเครดิตอีกต่อไป องค์กรที่วางแผนงานความปลอดภัยโดยสมมติว่าจ่ายเงินแล้วได้ใช้ ควรมีทางสำรอง

ข้อที่สามคือวิธีอ่านตัวเลขเบนช์มาร์ก หน้านี้มีตัวอย่างครบสามแบบในเรื่องเดียว คือชื่อชุดทดสอบที่มีสองแถว ตัวเลขที่อยู่ในภาพจนสื่ออ่านไม่ตรงกัน และตัวเลขที่ดูเหมือนมาจากภายนอกแต่จริงๆ มาจากภายใน

คำถามที่ยังไม่มีคำตอบ

ยังไม่มีใครทำซ้ำตัวเลขชุดนี้ด้วยชุดทดสอบเดียวกัน และยังไม่ทราบว่าจะมีเมื่อไร

ยังไม่ทราบว่า Google จะขยาย Fairwind Program ให้กว้างขึ้นหรือไม่ และเกณฑ์การอนุมัติจริงเข้มแค่ไหน

ยังไม่ทราบว่าราคาที่จะขึ้นในวันที่ 1 ม.ค. 2027 จะเกิดขึ้นตามที่ประกาศไว้จริงหรือไม่

■ ไม่อยากพลาดของใหม่

อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย