Tools & Tutorials

เลือกโมเดล AI ผิดชั้น จ่ายแพงกว่า 10 เท่า — แผนที่ 10 งานที่ควรรู้

AIM Academy 2 กันยายน 25690
แผนที่เปรียบเทียบต้นทุนโมเดล AI ที่แตกต่างกัน แสดงความแพงของการเลือกโมเดลผิดชั้นกับการจ่ายเงินมากเกินความจำเป็น

TL;DR

TL;DR
  • เกณฑ์เลือกโมเดล AI ที่ถูกต้องคือดูว่างานหนักฝั่ง Input หรือ Output ไม่ใช่ดูว่างานยากหรือง่าย
  • งานตอบสั้นที่มีรูปทรงตายตัว เช่น ติดแท็ก คัดรีวิว ควรใช้ Haiku 4.5 ซึ่งถูกกว่า Fable 5.1 ถึง 10 เท่า
  • งานที่ต้องเขียนออกมามาก เช่น บทความ ตาราง JSON ควรใช้ Sonnet 5 ขึ้นไปเพื่อคุณภาพที่คุ้มค่า
  • ทุกครั้งที่กดส่งข้อความ ระบบส่งประวัติแชทและ System Prompt ทั้งหมดซ้ำ ทำให้มีค่าเปิดเครื่องทุกรอบ
  • Haiku 4.5 มีข้อจำกัดด้าน context window (200K token) และ knowledge cutoff (Feb 2025) ซึ่งต้องพิจารณาก่อนใช้

คุณเลือกโมเดล AI ด้วยคำถามเดียว

งานนี้ยากไหม

ยาก เปิดตัวฉลาด

ไม่ยาก ใช้ตัวไว

เกณฑ์นี้ฟังดูสมเหตุสมผล

แต่มันคือเกณฑ์ที่ทำให้บิลบานปลาย

และทำให้งานง่ายบางงานพังโดยไม่รู้ตัว

ผมไล่อ่านเอกสารราคาและสเปกของ Anthropic

ทั้งชุด แล้วเจอว่าคนที่จ่ายน้อยกว่าไม่ได้ดู

ที่ความยากเลย เค้าดูอีกอย่างเดียว

.

เลือกโมเดลผิดชั้น จ่ายแพงกว่า 10 เท่า

.

𝟏. เส้นแบ่งอยู่ที่ปริมาณ ไม่ใช่ความยาก

ค่าใช้จ่ายของ AI แยกเป็นสองฝั่งเสมอ

Input คือทุกอย่างที่คุณป้อนเข้าไป

Output คือทุกอย่างที่มันผลิตออกมา

รวมการคิดในหัวก่อนตอบด้วย

และทุกรุ่นราคา Output แพงกว่า Input

5 เท่าเป๊ะ ไม่มีข้อยกเว้น

คำถามก่อนเลือกโมเดลจึงไม่ใช่ "งานนี้ยากไหม"

แต่เป็น "งานนี้หนักฝั่งไหน"

พอเปลี่ยนคำถาม การเลือกจะเหลือแค่ 3 กฎ

.

𝟐. งานตอบสั้น คืองานที่คำตอบมีรูปทรงตายตัว

ตรงนี้คนเข้าใจผิดกันเยอะที่สุด

"ตอบสั้น" ไม่ได้แปลว่าคำถามง่าย

แต่แปลว่าสิ่งที่มันต้องพิมพ์ออกมามีน้อย

และรู้หน้าตาล่วงหน้าอยู่แล้ว

ป้ายหมวด ตัวเลข ชื่อสินค้า ใช่หรือไม่ใช่

กลุ่มลูกค้าร้อนหรือเย็น เหล่านี้คือรูปทรงตายตัว

ลองดูงานอ่านสัญญา 80 หน้า

เพื่อตอบว่ามีข้อต่ออายุอัตโนมัติไหม

คำถามยากมาก เอกสารหนักมาก

แต่คำตอบคือหนึ่งบรรทัด

นั่นคืองานตอบสั้นเต็มตัว

งานติดแท็กแชท 2,000 ห้อง งานคัดรีวิว

งานดึงเลขจากใบเสนอราคาสแกน อยู่กลุ่มเดียวกัน

Haiku 4.5 คิดค่า Output ที่ $5 ต่อล้าน token

Fable 5.1 คิดที่ $50 ต่อล้าน token

ต่างกัน 10 เท่า กับป้ายที่ออกมาเหมือนกัน

ถ้าเป็นงานเป็นชุดที่ไม่มีใครนั่งรอผล

ยิงผ่าน Batch ลดได้อีกครึ่งหนึ่ง

มีข้อยกเว้นข้อเดียว ผมไม่ปิดไว้

งานตอบสั้นที่ผิดไม่ได้ เช่น สัญญา ตัวเลขการเงิน

ให้อยู่ชั้นบนตามเดิม เพราะราคาของความผิดหนึ่งครั้ง

สูงกว่าส่วนต่างค่าโมเดลทั้งปี

.

𝟑. งานตอบยาว รวมทุกอย่างที่มันต้องเขียนออกมา

คนมักนึกถึงแค่บทความยาว ๆ

แต่ทุกชิ้นงานที่มันผลิตออกมาเป็นตัวอักษร

นับเป็นฝั่ง Output ทั้งหมด

ตารางเปรียบเทียบ 200 แถว

ไฟล์ JSON ที่คุณเอาไปวางในระบบ

สคริปต์คลิปสั้น 10 ตัว

โครงสไลด์ 30 หน้า

ชุด Prompt ที่แจกทีมทั้งชุด

ของพวกนี้ดูเหมือน "การส่งไฟล์"

แต่ในทางเทคนิคคือการพิมพ์ทุกช่องออกมาทีละตัว

จุดที่แพงเงียบที่สุดคือการขอหลายเวอร์ชัน

สั่งว่า "ขอ 5 แบบให้เลือก" คือการซื้อของ

ราคาแพงที่สุด 5 ก้อน ทั้งที่คุณใช้จริงก้อนเดียว

ทางที่ถูกกว่าคือขอแบบเดียวให้ดี

แล้วสั่งแก้เฉพาะจุดที่ไม่ชอบ

เส้นพื้นของงานกลุ่มนี้ผมวางไว้ที่ Sonnet 5

ต่ำกว่านี้คุณจะเห็นความต่างตั้งแต่ย่อหน้าแรก

เห็นมั้ยฮะว่ามันคนละเรื่องกับข้อ 2

.

𝟒. หนักสองฝั่ง ตัวบนถูกกว่า

งานที่เดินหลายสเต็ปต่อกัน วางระบบอัตโนมัติ

คุม agent ทำสไลด์จากเอกสารกองใหญ่

งานพวกนี้หนักทั้งสองฝั่ง เพราะทุกรอบใหม่

ต้องเอาของรอบเก่ากลับเข้าไปเป็น Input ทั้งหมด

ตัวล่างที่พลาดแล้วต้องสั่งซ้ำ 3 รอบ

แพงกว่าตัวบนที่ทำจบในรอบเดียวเสมอ

เอกสารของ Anthropic เองแนะนำให้เริ่มที่

Opus 5 กับงานส่วนใหญ่ แล้วค่อยขยับขึ้น

Fable 5.1 เมื่องานต้องเดินยาวจริง ๆ

.

𝟓. ค่าเปิดเครื่อง ที่จ่ายทุกครั้งแม้คุณถามสั้น

ข้อนี้คือสิ่งที่ทำให้กฎ 3 ข้อข้างบนทำงาน

ทุกครั้งที่คุณส่งข้อความ ระบบไม่ได้ส่งแค่

สิ่งที่คุณเพิ่งพิมพ์

มันส่งของเดิมไปด้วยทั้งกอง

คำสั่งประจำที่ตั้งไว้ เครื่องมือที่ต่อพ่วง

เอกสารอ้างอิง และประวัติแชทตั้งแต่ข้อความแรก

ต่อให้คุณพิมพ์คำว่า "โอเค" แค่สองตัวอักษร

ก้อนนั้นก็ถูกส่งไปเต็มก้อนเหมือนเดิม

ผมเรียกมันว่าค่าเปิดเครื่อง

และตัวฉลาดคิดค่าเปิดเครื่องแพงกว่าตัวไว 10 เท่า

เพราะฝั่ง Input ของ Fable 5.1 อยู่ที่ $10

ต่อล้าน token ส่วน Haiku 4.5 อยู่ที่ $1

บวกอีกชั้นคือตัวฉลาดคิดก่อนตอบ

และการคิดนั้นถูกคิดเงินเป็น Output

แปลว่าคำถามสั้นบนตัวฉลาด ไม่ได้ถูกลง

ตามความสั้นของคำถามอย่างที่คุณรู้สึก

ย้ำให้ชัด นี่ไม่ใช่ค่าธรรมเนียมต่อครั้ง

Anthropic ไม่ได้เก็บค่าเปิดใช้งาน

มันคือของเดิมที่ถูกส่งซ้ำ บวกกับการคิด

สิ่งที่ทำได้จริงมีสองอย่าง

หนึ่ง caching ทำให้ก้อนคงที่นี้ถูกลง

บน Fable 5.1 จาก $10 เหลือ $0.25 ต่อล้าน token

แต่ความจำนี้มีอายุ 5 นาที ทิ้งช่วงนานก็จ่ายเต็มใหม่

สอง เลิกถามจุกจิกทีละคำถามบนตัวฉลาด

รวบให้จบในรอบเดียว เพราะทุกครั้งที่กดส่ง

คุณจ่ายค่าเปิดเครื่องใหม่หนึ่งรอบเสมอ

.

𝟔. สามกับดักของตัวไวที่ไม่มีในตารางราคา

หนึ่ง Haiku 4.5 รู้โลกแค่ Feb 2025

ส่วน Fable 5.1 รู้ถึง Jun 2026

ถามเรื่องใหม่กับตัวไว คุณจะได้คำตอบของปีที่แล้ว

สอง Haiku 4.5 รับได้ 200K token

อีก 3 รุ่นรับได้ถึง 1M

ไฟล์กองใหญ่ใส่ไม่ลงตั้งแต่แรก

สาม Haiku 4.5 ต้องมีบริบทยาวเกิน 4,096 token

ถึงจะจำไว้ใช้ซ้ำได้

แคตตาล็อกสินค้าสั้นกว่านั้น คุณจ่ายค่าเปิดเครื่อง

เต็มทุกครั้งที่ลูกค้าทัก โดยไม่รู้เลยว่าจ่ายซ้ำอยู่

ตัวไวเหมาะกับงานที่ข้อมูลมาจากสิ่งที่คุณป้อน

ไม่ใช่งานที่ต้องพึ่งความจำของตัวโมเดล

.

𝟕. แผนที่ 10 งาน เอาไปวางบนโต๊ะได้เลย

ตอบแชทลูกค้า ปิดการขาย → Haiku 4.5

ติดแท็กแชท คัดรีวิว คัดคอมเมนต์ → Haiku 4.5

สรุปไฟล์ยอดขายหลายสาขา → Sonnet 5

แปลเอกสาร เกลาข้อความยาว → Sonnet 5

ค้นข้อมูลสด เช็คของใหม่ → Sonnet 5

เขียนแคปชั่น โพสต์ broadcast → Opus 5

วิเคราะห์ผลแอด ตัวเลข dashboard → Opus 5

อ่านสัญญายาว หาข้อเสี่ยง → Opus 5

ทำสไลด์ ทำโครงคอร์สจากเอกสารกอง → Opus 5

วางระบบอัตโนมัติ คุม agent → Fable 5.1

ผมการันตีให้ไม่ได้ว่าแผนที่นี้ตรงกับทุกธุรกิจ

เพราะปริมาณงานแต่ละบ้านไม่เท่ากัน

แต่การันตีได้ว่าเกณฑ์ที่ใช้สร้างมันคงที่

ผลลัพธ์มีรูปทรงตายตัวไหม ต้องเขียนออกมามากแค่ไหน

เดินกี่สเต็ป และจ่ายค่าเปิดเครื่องกี่รอบ

สี่ข้อนี้ตอบได้ คุณเลือกเองได้ทุกงาน

.

ผลที่คุณจะเห็นภายในเดือนเดียว

งานคัดงานแยกที่เคยกินตัวแพง ย้ายลงมาอยู่ตัวไว

งานเขียนที่เคยได้ของกลาง ๆ ขยับขึ้นไปอยู่ตัวที่ควรอยู่

บิลลด งานดีขึ้น พร้อมกัน

คำถามที่อยากให้คุณลองตอบกับตัวเอง

งานประจำของคุณตอนนี้ อยู่ผิดชั้นกี่อย่าง

ถ้าอยากวางระบบให้ทีมเลือกโมเดลถูกชั้น

ตั้งแต่งานแรกของวัน ผมสอนไว้ในคอร์สฟรี

ทักมารับได้เลย

LINE OA: @drgim

https://lin.ee/fwFJNd2

โทร 065-649-5145

#หมอกิม #AIMAcademy #เลือกโมเดลAI #ลดต้นทุนAI #AIforSME

How-to

HOW-TO

Q&A

Q&A

Related Assets

ASSETS

ปั้น AI ให้เก่งในพริบตา

คลัง AI Asset พร้อมใช้กว่า 300 ตัว — ก็อปวางใน ChatGPT / Claude / Gemini แล้วใช้ได้เลย ไม่ต้องเขียนเอง

เปิดคลัง AI Asset ฟรี
AI ฉบับเจ้าของร้าน

อยากเข้าใจลึกกว่านี้?

ebook อ่านจบ 2 ชม. ได้ระบบ AI ใช้จริง — ฿199

ศึกษาเพิ่มด้วยตัวเอง