Ollama
โปรแกรม open source สำหรับดาวน์โหลดและรันโมเดล AI บนคอมพิวเตอร์ของเราเอง ข้อมูลประมวลผลอยู่ในเครื่อง ไม่ต้องส่งขึ้นคลาวด์ของผู้ให้บริการ
Ollama คือโปรแกรม open source (สัญญาอนุญาต MIT) ที่ทำให้การรัน model AI ประเภท llm บนเครื่องคอมพิวเตอร์ของเราเองกลายเป็นเรื่องง่าย: ติดตั้งเสร็จแล้วพิมพ์คำสั่งเดียว เช่น ollama run ตามด้วยชื่อโมเดล ระบบจะดาวน์โหลดโมเดลแบบ open-weights อย่าง gemma, qwen, deepseek หรือ gpt-oss จากคลังโมเดลของ Ollama มารันบนเครื่องให้ทันที รองรับทั้ง macOS, Windows, Linux และ Docker ตัวโปรแกรมเขียนด้วยภาษา Go ใช้ llama.cpp เป็น engine เบื้องหลัง และเป็นหนึ่งในโปรเจกต์ open source ยอดนิยมที่สุดในสาย AI (บน GitHub มีดาวมากกว่า 177,000 ดวง)
จุดที่ทำให้ Ollama ถูกนำไปต่อยอดได้กว้างคือมันไม่ใช่แค่หน้าต่างแชท: มันเปิด REST api ไว้บนเครื่องเรา (เช่น endpoint /api/chat) พร้อม library ภาษา Python และ JavaScript ให้แอปหรือ agent อื่นเรียกใช้โมเดลที่รันอยู่ได้เหมือนเรียกบริการ AI ทั่วไป มี Modelfile ไว้ปรับแต่งโมเดล และคลังโมเดลครอบคลุมทั้งงานแชท เขียนโค้ด vision, embeddings และ reasoning นอกจากรันในเครื่องแล้ว Ollama ยังมีบริการ cloud เสริมสำหรับโมเดลใหญ่ที่เครื่องเราแบกไม่ไหว โดยระบุชัดว่าข้อมูลผู้ใช้จะไม่ถูกนำไปใช้ training โมเดลต่อ
คนทำงานยุค AI ควรรู้จัก Ollama เพราะมันคือคำตอบยอดนิยมของโจทย์ "อยากใช้ AI แต่ข้อมูลห้ามออกนอกองค์กร": การประมวลผลหรือ inference เกิดขึ้นในเครื่องของเราทั้งหมดและทำงานแบบ offline ได้ จึงเป็นเครื่องมือสำคัญของแนวทาง on-premise-ai ที่องค์กรซึ่งเข้มงวดเรื่องความลับของข้อมูลนิยมพิจารณา และยังเป็นสนามทดลองมาตรฐานที่ทีมเทคนิคใช้ลองโมเดล open weights ก่อนตัดสินใจลงทุนระบบจริง
ตัวอย่างจากบทสนทนาจริง
ฝ่ายการตลาด: ฝ่าย IT สั่งห้ามเอาข้อมูลลูกค้าไปวางใน chatgpt เด็ดขาด แบบนี้ทีมเราก็หมดสิทธิ์ใช้ AI ช่วยสรุปข้อมูลเลยใช่ไหม
ทีม IT: ไม่ถึงขนาดนั้นครับ เราติดตั้ง Ollama ไว้บน server ภายในบริษัท แล้วดึงโมเดล open weights อย่าง Qwen มารันให้แล้ว ข้อมูลลูกค้าจะถูกประมวลผลอยู่ในระบบของเราเอง ไม่ถูกส่งออกไปหาผู้ให้บริการภายนอกเลย
ระวังสับสนกับ
- llama : Llama คือตระกูลโมเดลของ Meta ส่วน Ollama คือโปรแกรมสำหรับรันโมเดลจากหลายค่าย ชื่อคล้ายกัน (และ Ollama ก็ใช้ llama.cpp เป็นฐาน) แต่ตัวหนึ่งคือ "โมเดล" อีกตัวคือ "เครื่องมือรันโมเดล"
- hugging-face : Hugging Face เป็นแพลตฟอร์มกลางสำหรับแจกจ่ายและดาวน์โหลดโมเดลกับ dataset ส่วน Ollama เน้นบทบาทเป็นตัวรันโมเดลบนเครื่องเราให้ใช้งานได้จริง
- vendor-lock-in : การดาวน์โหลดโมเดลมารันเองผ่าน Ollama เป็นทางเลือกที่ช่วยลดการพึ่งพา API ของผู้ให้บริการ AI รายใดรายหนึ่ง
Sources (3)
- https://ollama.com fetched 2026-08-01
- https://github.com/ollama/ollama fetched 2026-08-01
- https://docs.ollama.com fetched 2026-08-01
อ่านจบแล้วอยากตามเรื่อง AI แบบนี้ต่อทุกวัน เรามีสรุปข่าวภาษาไทยส่งทาง LINE ทุกเช้า กดเพิ่มเพื่อนไว้ได้เลย ไม่มีค่าใช้จ่าย