Dictionary · กลไกโมเดล · 44 / 291

Input tokens

จำนวน token ทั้งหมดที่เราส่งให้ AI อ่านในแต่ละครั้ง ทั้งคำสั่ง ประวัติแชท และไฟล์แนบ เป็นฝั่ง "ขาเข้า" ที่ผู้ให้บริการใช้คิดค่าบริการ

Input tokens คือฝั่ง "ขาเข้า" ของการคุยกับ model : ทุกอย่างที่เราส่งเข้าไปให้โมเดลอ่านก่อนที่มันจะเริ่มตอบ จะถูกหั่นเป็นหน่วยย่อยที่เรียกว่า token แล้วนับรวมกันเป็นยอด input tokens ของคำขอครั้งนั้น สำหรับโมเดลตระกูล Claude หนึ่ง token ยาวประมาณ 3.5 ตัวอักษรภาษาอังกฤษ (ภาษาอื่นรวมทั้งภาษาไทยจะได้จำนวนต่างออกไป) จุดที่คนมักไม่รู้คือ input ไม่ได้มีแค่คำถามล่าสุดที่เราพิมพ์ : system-prompt ที่ระบบแนบให้ทุกครั้ง ประวัติการคุยทั้งหมดใน session นิยามของ tool ที่เปิดใช้ ผลลัพธ์ tool-result ที่เครื่องมือส่งกลับมา ไปจนถึงเอกสารหรือผลค้นเว็บที่แนบเข้าไป ทั้งหมดนับเป็น input tokens หมด

เหตุผลที่คนทำงานยุค AI ต้องรู้จักคำนี้ : มันคือหน่วยคิดเงินหลักของ AI แทบทุกเจ้า ราคาคิดเป็น "ต่อล้าน token" (MTok) และแยกขาเข้ากับขาออกชัดเจน เช่น Claude Sonnet 4.6 คิด input $3 ต่อล้าน token ขณะที่ output-tokens คิด $15 ต่อล้าน : ขาออกแพงกว่าขาเข้าราว 5 เท่า แต่ในงานจริงปริมาณขาเข้ามักเยอะกว่ามาก เพราะทุก turn ระบบต้องส่งประวัติเก่าทั้งก้อนกลับเข้าไปใหม่ ยิ่งคุยยาวหรือแนบไฟล์ใหญ่ ยอด input tokens ยิ่งโตสะสม ผู้ให้บริการจึงมีกลไกลดต้นทุนฝั่งนี้โดยเฉพาะ เช่น prompt caching ที่ทำให้ cache-tokens ส่วนที่อ่านซ้ำจาก cache คิดเพียง 10% ของราคา input ปกติ และ Batch API ที่ลดทั้ง input และ output ลงครึ่งหนึ่งสำหรับงานที่ไม่เร่งด่วน

ต่อให้ไม่ได้เขียนโค้ดเรียก API เอง ความเข้าใจเรื่อง input tokens ก็ช่วยตอบคำถามในชีวิตประจำวันได้หลายข้อ : ทำไมแชทที่คุยยาวๆ ถึงช้าลงและเปลืองขึ้น ทำไมองค์กรถึงขอให้เลือกแนบเฉพาะหน้าที่เกี่ยวข้องแทนการโยนคู่มือทั้งเล่มเข้าไปทุกครั้ง และทำไมโมเดลถึงมีเพดานความยาวที่เรียกว่า context-window ซึ่งจำกัดว่าขาเข้าทั้งหมดบวกขาออกจะยาวได้แค่ไหน

ตัวอย่างจากบทสนทนาจริง

ฝ่ายบัญชี: "เดือนนี้บิล AI ของทีมพุ่งขึ้นสามเท่า ทั้งที่ดูในระบบแล้ว AI ตอบสั้นๆ ไม่กี่บรรทัดเอง มันคิดเงินมั่วหรือเปล่าคะ"

ทีม IT: "ไม่มั่วครับ ค่าใช้จ่ายส่วนใหญ่ไม่ได้อยู่ที่คำตอบ แต่อยู่ที่ input tokens : ทีมเราตั้ง workflow ให้แนบคู่มือ 80 หน้าเข้าไปกับทุกคำถาม แถมประวัติแชทเก่าก็ถูกส่งกลับเข้าไปใหม่ทุกรอบ ขาเข้าเลยบวมเป็นแสน token ต่อครั้ง เดี๋ยวผมเปิด prompt caching กับตัดเอกสารให้เหลือเฉพาะบทที่ใช้ น่าจะลดได้เกินครึ่ง"

ระวังสับสนกับ

  • output-tokens : ฝั่งตรงข้ามกัน คือ token ที่โมเดลสร้างออกมาเป็นคำตอบ ราคาต่อ token แพงกว่า input หลายเท่า แต่ปริมาณมักน้อยกว่า
  • context-window : คนละเรื่องกับการคิดเงิน มันคือ "เพดานพื้นที่" ว่า input บวก output รวมกันยาวได้สูงสุดแค่ไหนในหนึ่งคำขอ ส่วน input tokens คือ "มิเตอร์" ที่นับว่าใช้ไปเท่าไหร่จริง
  • ai-roi : input tokens คือหนึ่งในต้นทุนที่ต้องนับรวมตอนคำนวณผลตอบแทนการลงทุน AI ไม่ใช่แค่ค่า license ต่อ seat เท่านั้น

ดูคำนี้ใน Knowledge Atlas →

■ ไม่อยากพลาดของใหม่

อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย

เพิ่มเพื่อนใน LINE →
QR เพิ่มเพื่อน LINE ของ TRAINIAC AIคอมพิวเตอร์สแกนด้วยมือถือได้เลย

InferenceKnowledge cutoff