# ราคาโมเดล AI ลดแรงเดือนตุลาคม 2026 ต้นทุน AI ขององค์กรไทยจะลดลงจริงแค่ไหน

> Claude Haiku 5.5 และ GPT-6 Luna ลดราคาเหลือ 0.10 ดอลลาร์ต่อล้านโทเคนขาเข้า แต่ต้นทุน AI จริงขึ้นกับ tokenizer บริบทยาว แคช และราคาโปรโมชันที่จะหมดในปี 2027

- ประเภท: บทวิเคราะห์ · หมวด: AI
- เผยแพร่: 2026-10-08T11:54:00.000Z · อัปเดต: 2026-10-08T11:54:00.000Z
- โดย: กองบรรณาธิการ THAI DATA, THAI DATA IT BUSINESS ENTERPRISE
- ที่มา: https://thaidata.co.th/ai/ai-cost-price-drop-october-2026-thai-budgets/

## สรุปประเด็นสำคัญ

- ณ **8 ตุลาคม 2026** Claude Haiku 5.5 และ GPT-6 Luna มีราคามาตรฐานเท่ากันที่ **0.10 ดอลลาร์** ต่อล้านโทเคนขาเข้าและ **0.50 ดอลลาร์** ขาออก ถูกกว่า Claude Haiku 4.5 สิบเท่า
- Anthropic ระบุว่า Haiku 5.5 ถูกกว่า Haiku 4.5 ต่อโทเคนถึง 90% แต่ค่าใช้งานเฉลี่ยลดราว **75%** เพราะ tokenizer ใหม่และคำขอที่ยาวเกิน 100,000 โทเคน ต้นทุน AI จริงจึงลดน้อยกว่าราคาป้าย
- Google ขาย Gemini 3.8 Flash ที่ 0.75/3.75 ดอลลาร์ถึง **31 ธันวาคม 2026** แล้วขึ้นเป็น **1.50/7.50 ดอลลาร์** ตั้งแต่ 1 มกราคม 2027 ส่วน Mistral Large 4 รุ่นพรีวิวขายราคาลดพิเศษครึ่งหนึ่งของราคาปกติ
- จากการคำนวณของเราเอง แชตบอตบริการลูกค้า **100,000 บทสนทนาต่อเดือน** ที่ใช้แคช มีต้นทุน AI ราว **245 ดอลลาร์** บน Haiku 5.5 หรือ GPT-6 Luna เทียบกับ **2,450 ดอลลาร์** บน Haiku 4.5
- endpoint ที่ระบุพื้นที่ประมวลผลข้อมูลมีค่าบริการเพิ่ม **10%** ทั้งบน OpenAI และ Claude บน Amazon Bedrock กับ Google Cloud เรื่องนี้ต้องอยู่ในงบตั้งแต่แรกหากองค์กรต้องคุมข้อมูลตาม PDPA

ต้นทุน AI ต่อโทเคนลดลงแรงในต้นเดือนตุลาคม 2026 ณ วันที่ 8 ตุลาคม Claude Haiku 5.5 ที่ Anthropic เปิดตัวเมื่อ 7 ตุลาคม และ GPT-6 Luna ของ OpenAI ตั้งราคาเท่ากันที่ 0.10 ดอลลาร์สหรัฐต่อล้านโทเคนขาเข้า ถูกกว่า Claude Haiku 4.5 สิบเท่า แต่บิลจริงขององค์กรจะลดน้อยกว่าราคาป้าย เพราะขึ้นกับวิธีนับโทเคน ความยาวของ prompt การใช้แคช และราคาโปรโมชันที่บางรายประกาศแล้วว่าจะขึ้นในปี 2027

บทวิเคราะห์นี้รวบรวมราคาจากหน้าราคาและเอกสารของ Anthropic, OpenAI, Google และ Mistral AI ที่เปิดตรวจเมื่อ 8 ตุลาคม 2026 ทุกตัวเลขเป็นราคามาตรฐานสกุลดอลลาร์สหรัฐ ไม่รวมภาษี และผู้ให้บริการเปลี่ยนได้ตลอด ส่วนรายละเอียดของแต่ละรุ่นอ่านได้ใน[ข่าวเปิดตัว Claude Haiku 5.5](/ai/claude-haiku-5-5-launch-price-benchmarks/) [ข่าว GPT-6 ใน ChatGPT และ API](/ai/openai-gpt-6-intelligent-ui-chatgpt-sol-luna/) และ[ข่าว Mistral Large 4](/ai/mistral-large-4-open-weight-1-trillion-preview/)

## ราคาโมเดล AI ณ 8 ตุลาคม 2026 อยู่ที่เท่าไร

ตารางนี้เลือกโมเดลที่องค์กรมักใช้กับงานปริมาณมาก ซึ่งเป็นส่วนที่กินต้นทุน AI มากที่สุด และใส่รุ่นกลางสองรุ่นไว้เทียบ ราคาเป็นดอลลาร์สหรัฐต่อล้านโทเคน ใน tier มาตรฐานและช่วง prompt สั้น

| โมเดล | ขาเข้า | ขาเข้าที่แคช | ขาออก | เงื่อนไขที่ต้องดู |
| --- | --- | --- | --- | --- |
| Claude Haiku 5.5 | 0.10 | 0.01 | 0.50 | prompt เกิน 100K: 0.50 / 0.05 / 2.50 |
| GPT-6 Luna | 0.10 | 0.01 | 0.50 | เกิน 272K: 0.20 / 0.02 / 0.75 |
| Gemini 3.1 Flash-Lite | 0.25 | 0.025 | 1.50 | ขาเข้าเสียง 0.50 |
| Mistral Large 4 (พรีวิว) | 0.68 | 0.07 | 2.09 | ราคาลดพิเศษ ปกติ 1.36 / 0.14 / 4.18 |
| Gemini 3.8 Flash | 0.75 | 0.075 | 3.75 | ถึง 31 ธ.ค. 2026 จากนั้น 1.50 / 0.15 / 7.50 |
| Claude Haiku 4.5 | 1.00 | 0.10 | 5.00 | รุ่นก่อน Haiku 5.5 |
| Claude Sonnet 5.5 | 2.00 | 0.10 | 10.00 | ราคาเดียวตลอดบริบท 1M |
| GPT-6 Sol | 2.00 | 0.20 | 10.00 | gpt-6.1-sol แคช 0.10 |

เมื่อเทียบกับรุ่นก่อนบนหน้าราคาเดียวกัน gpt-6-luna คิดขาเข้าครึ่งหนึ่งของ gpt-5.6-luna ที่ 0.20 ดอลลาร์ และขาออกไม่ถึงครึ่งของ 1.20 ดอลลาร์ ราคาขาเข้าของ Gemini 3.8 Flash ปีนี้ก็เป็นครึ่งหนึ่งของ Gemini 3.5 Flash ที่ยังอยู่ในหน้าราคาที่ 1.50 ดอลลาร์ และขาออกต่ำกว่า 9.00 ดอลลาร์ของรุ่นนั้นมาก ส่วน Anthropic ลดราคาอ่านแคชของ Sonnet 5.5 จาก 0.20 เหลือ 0.10 ดอลลาร์พร้อมการเปิดตัว Haiku 5.5

![ราคาต่อล้านโทเคนของโมเดลกลุ่มราคาประหยัด ณ 8 ตุลาคม 2026 Haiku 5.5 และ GPT-6 Luna อยู่ต่ำสุด ส่วน Gemini 3.8 Flash จะแพงขึ้นเท่าตัวในปี 2027](https://thaidata-co-th.s3.ap-southeast-1.amazonaws.com/thaidata.co.th/images/articles/ai-cost-price-drop-october-2026-thai-budgets/budget-model-prices.webp?v=7ce0a6d4) _(ภาพ: THAI DATA (ข้อมูล: Anthropic, OpenAI, Google, Mistral AI))_

## ทำไมราคาต่อโทเคนลดลง แต่ต้นทุน AI ไม่ได้ลดเท่ากัน

บิลค่า AI คือจำนวนโทเคนคูณราคา ราคาลดลงจริง แต่จำนวนโทเคนต่องานและเงื่อนไขการคิดเงินเปลี่ยนไปพร้อมกัน ตัวเลขของ Anthropic เองเป็นตัวอย่างที่ชัด บริษัทระบุว่า Haiku 5.5 ถูกกว่า Haiku 4.5 ราว 90% เมื่อคำขอไม่เกิน 100,000 โทเคน และราว 50% เมื่อเกิน โดย 90% ของคำขอบน Haiku 4.5 อยู่ในกลุ่มแรก เมื่อรวมผลของ tokenizer ใหม่ที่ใช้โทเคนต่องานมากขึ้นเล็กน้อย ค่าใช้งานเฉลี่ยจึงลดลง "ราว 75%" ไม่ใช่ 90%

ต้นทุน AI ขององค์กรขึ้นกับสี่เรื่องที่ไม่ได้อยู่บนป้ายราคา

- **จำนวนโทเคนต่องาน** ซึ่งเปลี่ยนตาม tokenizer ภาษา และโทเคนที่โมเดลใช้คิดก่อนตอบ
- **เกณฑ์บริบทยาว** ที่ทำให้ราคาต่อโทเคนกระโดดเมื่อ prompt ยาวเกินกำหนด
- **ส่วนลดและค่าบริการเพิ่ม** ทั้งแคช งานแบบ Batch โหมดเร่งความเร็ว และการระบุพื้นที่ประมวลผล
- **ราคาโปรโมชัน** ที่มีวันหมดอายุ หรือไม่ได้บอกวันหมดอายุ

## Tokenizer และโทเคนที่ใช้คิดทำให้ต้นทุน AI เพิ่มขึ้นได้อย่างไร

Tokenizer คือตัวตัดข้อความเป็นโทเคน ผู้ให้บริการแต่ละรายใช้ของตัวเอง ข้อความภาษาไทยชุดเดียวกันจึงนับได้ไม่เท่ากันในแต่ละโมเดล และต้นทุน AI ก็ต่างกันไปด้วย Anthropic ระบุว่า tokenizer ของ Claude 4.7 ขึ้นไป ซึ่ง Haiku 5.5 ใช้ด้วย นับข้อความเดิมได้มากกว่ารุ่นเก่าราว 30% และตัวเลขจริงขึ้นกับเนื้อหา ส่วนค่าประมาณ 1 โทเคนต่อราว 4 ตัวอักษรที่บริษัทให้ไว้เป็นของภาษาอังกฤษ บริษัทเขียนกำกับเองว่าจำนวนจริงต่างกันตามภาษา

อีกส่วนคือโทเคนที่โมเดลใช้คิด หน้าราคาของ OpenAI ระบุว่าราคาขาออกรวม reasoning tokens ซึ่งผู้ใช้มองไม่เห็นผ่าน API และหน้าราคาของ Google ก็เขียนว่าราคาขาออกรวม thinking tokens โทเคนขาออกที่ถูกคิดเงินจึงอาจมากกว่าความยาวคำตอบที่เห็นบนจอ ขึ้นกับระดับการคิดที่ตั้งไว้ การให้โมเดลคิดลึกกับทุกคำขอจึงเพิ่มต้นทุน AI ได้โดยไม่รู้ตัว

วิธีที่แม่นที่สุดคือส่งข้อความไทยจริงขององค์กรผ่านเครื่องมือนับโทเคนของแต่ละราย ซึ่ง Anthropic, OpenAI และ Google มีเอกสารเรื่องนี้ให้ แล้วจดจำนวนโทเคนต่อเอกสารหรือต่อบทสนทนาไว้เป็นฐานของการประมาณต้นทุน AI

## prompt ยาวเกิน 100K หรือ 272K โทเคน ต้นทุน AI เปลี่ยนอย่างไร

บริบท 1 ล้านโทเคนไม่ได้แปลว่าทุกโทเคนราคาเท่ากัน

- **Claude Haiku 5.5** เมื่อ prompt เกิน 100,000 โทเคน ทุกรายการแพงขึ้น 5 เท่า ขาเข้าเป็น 0.50 และขาออกเป็น 2.50 ดอลลาร์
- **GPT-6** OpenAI นับ prompt ไม่เกิน 272K โทเคนเป็นบริบทสั้น ถ้าเกิน gpt-6-luna ขาเข้าเป็น 0.20 ขาออก 0.75 ดอลลาร์ และ gpt-6.1-sol เป็น 4.00 และ 15.00 ดอลลาร์
- **Gemini** หน้าราคาแสดงราคาเดียวสำหรับรุ่น Flash แต่ Gemini 3.1 Pro Preview ขึ้นจาก 2.00 เป็น 4.00 ดอลลาร์ขาเข้า และจาก 12.00 เป็น 18.00 ดอลลาร์ขาออก เมื่อ prompt เกิน 200K โทเคน
- **Claude รุ่น 4.6 ขึ้นไป** ยกเว้น Haiku 5.5 คิดราคาเดียวตลอดบริบท 1 ล้านโทเคน

จากการคำนวณของเรา คำขอหนึ่งครั้งบน Haiku 5.5 ที่ใส่เอกสาร 120,000 โทเคนมีค่าขาเข้า 0.06 ดอลลาร์ ถ้าตัดเหลือ 90,000 โทเคนจะเหลือ 0.009 ดอลลาร์ ลดโทเคนลง 25% แต่ค่าขาเข้าลดราว 85% ระบบ RAG ที่คัดเฉพาะเนื้อหาที่เกี่ยวข้องจึงลดต้นทุน AI ได้มากกว่าการโยนเอกสารทั้งก้อนเข้าไป

![หน้า Pricing ของ OpenAI แยกราคาบริบทสั้นและบริบทยาวของตระกูล GPT-6 และระบุค่าบริการเพิ่ม 10% สำหรับ endpoint ที่ระบุพื้นที่ประมวลผล](https://thaidata-co-th.s3.ap-southeast-1.amazonaws.com/thaidata.co.th/images/articles/ai-cost-price-drop-october-2026-thai-budgets/openai-gpt-6-pricing-page.webp?v=561411db) _(ภาพ: OpenAI (ภาพหน้าจอ))_

## แคช Batch และโหมดเร่งความเร็ว เปลี่ยนต้นทุน AI ได้แค่ไหน

ส่วนที่ซ้ำทุกคำขอ เช่น system prompt คู่มือสินค้า หรือนโยบายบริษัท ควรเก็บไว้ในแคช

- **Anthropic** คิดค่าอ่านแคช 10% ของราคาขาเข้าปกติ Haiku 5.5 จึงเหลือ 0.01 ดอลลาร์ และคิด 5% บน Sonnet 5.5 กับ Opus 5.5 ค่าเขียนแคชแบบ 5 นาทีคือ 1.25 เท่า แบบ 1 ชั่วโมงคือ 2 เท่า บริษัทระบุว่าแคช 5 นาทีคุ้มทุนตั้งแต่การอ่านซ้ำครั้งแรก
- **OpenAI** คิดขาเข้าที่แคชของ gpt-6-luna 0.01 ดอลลาร์ และอธิบายว่าค่าเขียนแคชไม่ได้บวกเพิ่ม โทเคนขาเข้าแต่ละตัวถูกคิดเป็นขาเข้าปกติ ขาเข้าที่แคช หรือการเขียนแคชอย่างใดอย่างหนึ่ง
- **Google** คิดค่าแคชของ Gemini 3.8 Flash 0.075 ดอลลาร์ บวกค่าเก็บ 0.50 ดอลลาร์ต่อล้านโทเคนต่อชั่วโมงในปี 2026

งานที่ไม่ต้องตอบทันที เช่น สรุปบทสนทนาทั้งวันหรือจัดหมวดเอกสารย้อนหลัง ส่งแบบ Batch เพื่อลดต้นทุน AI ส่วนนั้นลง 50% ได้ทั้งบน Anthropic, OpenAI (Batch และ Flex) และ Google (Batch และ Flex) ในทางกลับกัน ความเร็วมีราคา โหมด Fast ของ gpt-6-luna คิดสองเท่าที่ 0.20/1.00 ดอลลาร์ และ Priority ของ Gemini 3.8 Flash คิด 1.35/6.75 ดอลลาร์

## ราคาโปรโมชันและราคาปี 2027 กระทบต้นทุน AI อย่างไร

ราคาที่เห็นวันนี้บางส่วนมีวันหมดอายุ หน้าราคาของ Google ระบุว่า Gemini 3.8 Flash และ Gemini 3.7 Flash คิด 0.75 ดอลลาร์ขาเข้าและ 3.75 ดอลลาร์ขาออกถึง 31 ธันวาคม 2026 แล้วตั้งแต่ 1 มกราคม 2027 จะเป็น 1.50 และ 7.50 ดอลลาร์ ค่าแคชและค่าเก็บแคชก็ขึ้นเท่าตัวเช่นกัน ระบบที่เปิดใช้ปลายปีนี้จึงมีต้นทุน AI ต่อโทเคนสองเท่าตั้งแต่วันแรกของปีหน้า โดยไม่ได้เปลี่ยนอะไรเลย

![ตารางราคา Gemini 3.8 Flash บนหน้าราคาของ Google ระบุราคาถึง 31 ธันวาคม 2026 และราคาใหม่ตั้งแต่ 1 มกราคม 2027](https://thaidata-co-th.s3.ap-southeast-1.amazonaws.com/thaidata.co.th/images/articles/ai-cost-price-drop-october-2026-thai-budgets/gemini-3-8-flash-pricing-page.webp?v=802828a0) _(ภาพ: Google (ภาพหน้าจอ))_

Mistral Large 4 รุ่นพรีวิวแสดงเป็นราคาลดพิเศษ 0.68/0.07/2.09 ดอลลาร์ จากราคาปกติ 1.36/0.14/4.18 ดอลลาร์ โดยหน้าเอกสารไม่ได้ระบุวันสิ้นสุด ส่วน OpenAI เขียนกำกับไว้ว่าราคาโปรโมชันของ GPT-5.6 Sol มีให้อย่างน้อยถึง 21 พฤศจิกายน 2026

งบปี 2027 จึงควรคำนวณด้วยราคาหลังหมดโปรโมชันเป็นค่าตั้งต้น แล้วถือส่วนต่างเป็นเงินที่ประหยัดได้ระหว่างนี้ ไม่ใช่ฐานของงบ

## ตัวอย่างต้นทุน AI ของแชตบอตบริการลูกค้าภาษาไทย

ตัวอย่างนี้เป็นการคำนวณของ THAI DATA เองจากราคาในตารางแรก ใช้สมมติฐานดังนี้

- แชตบอตตอบลูกค้า 100,000 บทสนทนาต่อเดือน บทสนทนาละ 5 รอบถาม-ตอบ
- ทุกรอบส่ง system prompt กับข้อมูลสินค้า 4,000 โทเคน และข้อความลูกค้า ประวัติแชต กับเนื้อหาที่ค้นมาอีก 2,000 โทเคน
- โมเดลตอบรอบละ 500 โทเคน นับรวมโทเคนที่ใช้คิดแล้ว
- ต่อบทสนทนาจึงเป็นขาเข้า 30,000 โทเคน (ส่วนที่ซ้ำ 20,000) และขาออก 2,500 โทเคน ทั้งเดือนคือขาเข้า 3,000 ล้านโทเคนและขาออก 250 ล้านโทเคน
- ใช้ราคามาตรฐานช่วงบริบทสั้น ไม่รวมภาษี กรณีใช้แคชคิดส่วนที่ซ้ำ 20,000 โทเคนเป็นราคาอ่านแคชทั้งหมด ไม่รวมค่าเขียนแคชและค่าเก็บแคชของ Gemini
- สมมติว่าทุกโมเดลนับโทเคนได้เท่ากัน ซึ่งในความจริงไม่เท่า

สมมติฐานนี้ตั้งขึ้นให้คำนวณง่ายและเทียบกันได้ ไม่ใช่ค่าเฉลี่ยของตลาด ตัวเลขขององค์กรจริงอาจสูงหรือต่ำกว่านี้มาก

## ผลคำนวณ: ต้นทุน AI ของแชตบอต 100,000 บทสนทนาต่อเดือน

| โมเดล | ต้นทุน AI ไม่ใช้แคช (ดอลลาร์/เดือน) | ใช้แคช (ดอลลาร์/เดือน) |
| --- | --- | --- |
| Claude Haiku 5.5 | 425 | 245 |
| GPT-6 Luna | 425 | 245 |
| Gemini 3.1 Flash-Lite | 1,125 | 675 |
| Mistral Large 4 (ราคาลดพิเศษ) | 2,562.50 | 1,342.50 |
| Gemini 3.8 Flash (ราคาปี 2026) | 3,187.50 | 1,837.50 |
| Claude Haiku 4.5 | 4,250 | 2,450 |
| Gemini 3.8 Flash (ราคาตั้งแต่ปี 2027) | 6,375 | 3,675 |

![ต้นทุน AI ต่อเดือนของแชตบอต 100,000 บทสนทนา Haiku 5.5 และ GPT-6 Luna ต่ำสุด แคชลดบิลได้ราว 40–48% ทุกรุ่น](https://thaidata-co-th.s3.ap-southeast-1.amazonaws.com/thaidata.co.th/images/articles/ai-cost-price-drop-october-2026-thai-budgets/chatbot-monthly-cost.webp?v=2b7947fa) _(ภาพ: THAI DATA (ข้อมูล: Anthropic, OpenAI, Google, Mistral AI))_

สองรุ่นที่ถูกที่สุดมีต้นทุน AI ราว 245 ดอลลาร์ต่อเดือนเมื่อใช้แคช หรือราว 0.0025 ดอลลาร์ต่อบทสนทนา ถูกกว่า Haiku 4.5 สิบเท่า และต่างจากแถวล่างสุดถึง 15 เท่า แคชลดบิลได้ราว 40–48% ในทุกแถว เพราะสองในสามของโทเคนขาเข้าเป็นส่วนที่ซ้ำ ถ้าข้อความไทยของจริงนับเป็นโทเคนมากกว่าสมมติฐาน 30% ทุกแถวก็ขึ้น 30% เช่น 245 เป็นราว 319 ดอลลาร์ และถ้าเลือกรุ่นกลางอย่าง Sonnet 5.5 หรือ GPT-6 Sol ที่ 2/10 ดอลลาร์ แถวไม่ใช้แคชจะเป็น 8,500 ดอลลาร์

ราคาไม่ได้บอกคุณภาพ Mistral Large 4 เป็นโมเดลที่ใหญ่กว่ารุ่นเล็กในตารางมาก และ Anthropic เองแนะนำให้ใช้ Haiku กับงานง่าย Sonnet กับงาน production ส่วนใหญ่ และ Opus กับงานที่ต้องใช้เหตุผลซับซ้อนที่สุด การเทียบที่ถูกคือเทียบต้นทุนต่อบทสนทนาที่แก้ปัญหาลูกค้าได้จริงในคุณภาพที่ยอมรับได้

## Open-weight อย่าง Mistral Large 4 เปลี่ยนสมการต้นทุน AI อย่างไร

Mistral เปิด Mistral Large 4 รุ่นพรีวิวเมื่อ 6 ตุลาคม 2026 หน้าเอกสารระบุพารามิเตอร์รวม 1.05 ล้านล้านตัว ใช้งานจริงครั้งละ 52,000 ล้านตัว มี vision encoder 1,600 ล้านพารามิเตอร์ และรองรับบริบท 1 ล้านโทเคน บริษัทระบุว่าจะปล่อยน้ำหนักโมเดลภายในสิ้นเดือนนี้ และจะให้บริการหลายภูมิภาคทั่วโลก รวมถึงระบบในยุโรปที่ Mistral ดำเนินการเองทั้งหมด

![หน้าเอกสาร Mistral Large 4 แสดงสถานะ Public Preview พารามิเตอร์ 1.05T และราคาลดพิเศษเทียบราคาปกติ](https://thaidata-co-th.s3.ap-southeast-1.amazonaws.com/thaidata.co.th/images/articles/ai-cost-price-drop-october-2026-thai-budgets/mistral-large-4-docs-page.webp?v=efda2d87) _(ภาพ: Mistral AI (ภาพหน้าจอ))_

Open-weight หมายถึงองค์กรดาวน์โหลดโมเดลไปรันบนเครื่องของตัวเองได้ ค่าโทเคนจึงหายไป แต่ต้นทุน AI ย้ายไปเป็นค่าเครื่อง ค่าไฟ และค่าคนแทน จากการคำนวณอย่างง่ายของเรา น้ำหนัก 1.05 ล้านล้านพารามิเตอร์ที่ความแม่นยำ 8 บิตใช้หน่วยความจำราว 1 TB และที่ 4 บิตราว 525 GB ยังไม่นับหน่วยความจำสำหรับบริบทยาว จึงต้องกระจายบน GPU หลายตัว ณ 8 ตุลาคม หน้าเอกสารของ Mistral Large 4 ยังไม่แสดงรายละเอียดสัญญาอนุญาตของน้ำหนัก องค์กรควรรออ่านเงื่อนไขการใช้งานเชิงพาณิชย์ก่อนวางแผนลงทุน

## เลือกจ่ายตาม API หรือรันโมเดลเอง ดูจากอะไร

| ประเด็น | จ่ายตาม API | รันโมเดล open-weight เอง |
| --- | --- | --- |
| รูปแบบต้นทุน | ผันแปรตามปริมาณ เริ่มได้ทันที | ต้นทุนคงที่ ทั้ง GPU ไฟฟ้า พื้นที่ และทีมงาน |
| ความเสี่ยงด้านราคา | ผู้ให้บริการปรับได้ เช่น Gemini 3.8 Flash ปี 2027 | คุมเองได้ แต่รับค่าอัปเกรดและบำรุงรักษา |
| ที่อยู่ของข้อมูล | ตามพื้นที่ที่ผู้ให้บริการเปิด | อยู่ในโครงสร้างพื้นฐานขององค์กร |
| รุ่นใหม่ | ได้ทันทีที่ออก | ต้องดาวน์โหลด ทดสอบ และย้ายเอง |
| เหมาะกับ | งานที่ปริมาณไม่แน่นอนหรือยังทดลอง | งานปริมาณสูงสม่ำเสมอ หรือข้อมูลที่ห้ามออกนอกองค์กร |

จุดคุ้มทุนต่างกันทุกองค์กร หลักคิดคือเทียบต้นทุน AI แบบจ่ายตาม API ที่คาดไว้ในปีหน้า กับต้นทุนรวมของคลัสเตอร์ GPU ที่ใส่น้ำหนักโมเดลได้ทั้งหมดบวกค่าคนดูแล ถ้าบิล API ยังอยู่ระดับหลักร้อยหรือหลักพันดอลลาร์ต่อเดือนอย่างในตัวอย่างแชตบอต การลงทุนเครื่องเพื่อรันโมเดลระดับล้านล้านพารามิเตอร์เพื่อประหยัดค่าโทเคนยากที่จะคุ้ม เหตุผลที่หนักแน่นกว่าคือข้อกำหนดด้านข้อมูล

## CIO องค์กรไทยควรวางแผนต้นทุน AI ปี 2027 อย่างไร

1. **ทดสอบด้วยข้อมูลภาษาไทยของตัวเอง** เตรียมชุดคำถามและเอกสารจริงจากงานที่จะใช้ วัดทั้งคุณภาพคำตอบและจำนวนโทเคนของแต่ละโมเดล หน้าราคาที่เราตรวจไม่มีตัวเลขการนับโทเคนของภาษาไทย และประกาศของ Mistral ระบุว่าข้อมูลฝึกครอบคลุมกว่า 160 ภาษาแต่ไม่ได้แยกผลภาษาไทย
2. **คิดเป็นต้นทุน AI ต่องาน** เช่น ต่อบทสนทนาที่ปิดได้ หรือต่อเอกสารที่ดึงข้อมูลสำเร็จ แทนการดูราคาต่อโทเคนอย่างเดียว
3. **วางรั้วกันต้นทุน AI บานปลาย** ส่งงานง่ายให้โมเดลเล็กก่อนแล้วส่งต่อรุ่นใหญ่เมื่อจำเป็น จำกัดความยาวคำตอบ คุม prompt ให้อยู่ใต้เกณฑ์ 100K หรือ 272K โทเคน เก็บส่วนที่ซ้ำในแคช ส่งงานย้อนหลังแบบ Batch และตั้งเพดานกับการแจ้งเตือนค่าใช้จ่ายแยกรายโครงการ
4. **ตั้งงบต้นทุน AI ด้วยราคาหลังโปรโมชัน** บวกส่วนเผื่อจากจำนวนโทเคนที่อาจเพิ่ม แล้วทบทวนทุกไตรมาส เพราะราคาเปลี่ยนเร็วกว่ารอบงบประมาณ
5. **ออกแบบให้เปลี่ยนผู้ให้บริการได้** แยกชั้นที่เรียกโมเดลออกจากแอป เพื่อย้ายไปรุ่นที่คุ้มกว่าได้โดยไม่ต้องเขียนระบบใหม่ และรันชุดทดสอบเดิมทุกครั้งที่ย้าย

## คำถามเรื่อง PDPA และพื้นที่ประมวลผลที่ต้องถามผู้ให้บริการ

ราคาถูกไม่มีความหมายถ้าใช้กับข้อมูลลูกค้าไม่ได้ ก่อนส่งข้อมูลส่วนบุคคลเข้าโมเดล ฝ่ายไอทีและเจ้าหน้าที่คุ้มครองข้อมูลส่วนบุคคล (DPO) ควรได้คำตอบเป็นลายลักษณ์อักษรในเรื่องต่อไปนี้

- **ข้อมูลถูกประมวลผลที่ไหน** Claude API ประมวลผลแบบ global เป็นค่าเริ่มต้น ถ้าบังคับให้ประมวลผลในสหรัฐฯ รุ่น 4.6 ขึ้นไปคิด 1.1 เท่า บน Amazon Bedrock และ Google Cloud endpoint แบบระบุภูมิภาคแพงกว่า global 10% ส่วน OpenAI คิดเพิ่ม 10% สำหรับ endpoint แบบระบุพื้นที่ของโมเดลที่ออกตั้งแต่ 5 มีนาคม 2026 ค่าส่วนเพิ่มนี้ควรรวมอยู่ในต้นทุน AI ตั้งแต่แรก
- **ข้อมูลถูกนำไปปรับปรุงโมเดลหรือไม่** หน้าราคา Gemini API ระบุว่าเนื้อหาในแผนฟรีถูกใช้ปรับปรุงผลิตภัณฑ์ แต่แผนเสียเงินไม่ใช้ งานจริงขององค์กรจึงไม่ควรอยู่บนแผนฟรี
- **เก็บข้อมูลไว้นานเท่าไรและใครเข้าถึงได้** ตรวจในสัญญาประมวลผลข้อมูล (DPA) และรายชื่อผู้ประมวลผลช่วงของผู้ให้บริการ
- **การส่งข้อมูลออกนอกประเทศ** PDPA มีเงื่อนไขเรื่องการส่งข้อมูลส่วนบุคคลไปต่างประเทศ ถ้าพื้นที่ประมวลผลที่เลือกได้อยู่นอกไทยทั้งหมด ต้องมีฐานทางกฎหมายและมาตรการคุ้มครองที่เพียงพอ หรือพิจารณาโมเดล open-weight ที่รันในประเทศแทน

ติดตามข่าวและบทวิเคราะห์ AI อื่น ๆ ได้ที่[หมวด AI](/ai/)

## คำถามที่พบบ่อย

### ต้นทุน AI ขององค์กรจะลดลงตามราคาโมเดลใหม่หรือไม่?

ลดลงได้มากแต่ไม่เท่าราคาป้าย ตัวอย่างคือ Claude Haiku 5.5 ถูกกว่า Haiku 4.5 ถึง 90% ต่อโทเคน แต่ Anthropic ประเมินว่าค่าใช้งานเฉลี่ยลดราว 75% เพราะ tokenizer ใหม่นับโทเคนมากขึ้นและบางคำขอยาวเกิน 100,000 โทเคน ต้นทุน AI จริงจึงต้องวัดจากงานและข้อมูลภาษาไทยของแต่ละองค์กร

### Claude Haiku 5.5 กับ GPT-6 Luna ราคาต่างกันอย่างไร?

ณ 8 ตุลาคม 2026 ราคามาตรฐานของทั้งสองรุ่นเท่ากัน คือขาเข้า 0.10 ดอลลาร์ ขาเข้าที่แคช 0.01 ดอลลาร์ และขาออก 0.50 ดอลลาร์ต่อล้านโทเคน ที่ต่างกันคือเกณฑ์บริบทยาว Haiku 5.5 แพงขึ้น 5 เท่าเมื่อ prompt เกิน 100,000 โทเคน ส่วน GPT-6 Luna ขึ้นเป็น 0.20 และ 0.75 ดอลลาร์เมื่อเกิน 272K โทเคน ต้นทุน AI ของงานเอกสารยาวจึงต่างกันมาก

### ราคา Gemini 3.8 Flash จะขึ้นเมื่อไร?

หน้าราคาของ Google ระบุว่า Gemini 3.8 Flash คิด 0.75 ดอลลาร์ขาเข้าและ 3.75 ดอลลาร์ขาออกต่อล้านโทเคนถึง 31 ธันวาคม 2026 และเพิ่มเป็น 1.50 และ 7.50 ดอลลาร์ตั้งแต่ 1 มกราคม 2027 องค์กรที่ตั้งงบปีหน้าจึงควรใช้ราคาใหม่คำนวณต้นทุน AI

### รัน Mistral Large 4 เองถูกกว่าใช้ API หรือไม่?

ขึ้นกับปริมาณงานและข้อกำหนดด้านข้อมูล Mistral Large 4 มีพารามิเตอร์รวม 1.05 ล้านล้านตัว ตามการคำนวณอย่างง่าย น้ำหนักที่ 8 บิตใหญ่ราว 1 TB ต้องใช้ GPU หลายตัว ขณะที่ API รุ่นพรีวิวคิดราคาลดพิเศษ 0.68 ดอลลาร์ขาเข้าและ 2.09 ดอลลาร์ขาออกต่อล้านโทเคน การรันเองจึงลดต้นทุน AI ได้เมื่องานมีปริมาณสูงต่อเนื่อง หรือเมื่อข้อมูลต้องอยู่ในองค์กร

### องค์กรไทยควรถามผู้ให้บริการ AI เรื่อง PDPA อย่างไร?

ควรถามว่าข้อมูลถูกประมวลผลและเก็บไว้ที่ใด นานเท่าไร ถูกนำไปปรับปรุงโมเดลหรือไม่ และเลือก endpoint ระบุพื้นที่ได้หรือไม่ ซึ่ง OpenAI และ Claude บน Bedrock กับ Google Cloud คิดเพิ่ม 10% ส่วน Gemini API แผนฟรีนำเนื้อหาไปปรับปรุงผลิตภัณฑ์ จึงต้องรวมค่าใช้จ่ายเหล่านี้ในต้นทุน AI ตั้งแต่ต้น


## แหล่งอ้างอิง

- [Pricing](https://platform.claude.com/docs/en/about-claude/pricing) — Anthropic
- [Introducing Claude Haiku 5.5](https://www.anthropic.com/claude-haiku-5-5) — Anthropic
- [Pricing | OpenAI API](https://developers.openai.com/api/docs/pricing) — OpenAI
- [Gemini Developer API pricing](https://ai.google.dev/gemini-api/docs/pricing) — Google
- [Mistral Large 4](https://docs.mistral.ai/models/mistral-large-4-0) — Mistral AI
- [Introducing Mistral Large 4](https://mistral.ai/news/mistral-large-4/) — Mistral AI
