Workstation Logo
ผลิตภัณฑ์
AI LabsOpenAI AgentsClaude AgentsGrok BotWorkstation CRM (WSL CRM)การตลาดผลิตภัณฑ์ทั้งหมด
โซลูชัน AI
เวิร์กสเตชัน AIAI SME PackagesAI ส่วนตัวคลัสเตอร์ GPUEdge AIแล็บ AI องค์กรAI ตามอุตสาหกรรม
บริการ
Platform ModernisationDigital EngineeringData Foundations & AIAutonomous Operationsที่ปรึกษา AIระบบอัตโนมัติ DevOpsความมั่นคงปลอดภัยไซเบอร์การพัฒนาซอฟต์แวร์การสร้างเอเจนต์การตั้งค่า MLOps
เกี่ยวกับเรา
พาร์ทเนอร์เรื่องราวลูกค้า
บทความ
เอกสาร
WSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7
บล็อก
ติดต่อเราLogin
Workstation

เวิร์กสเตชัน AI ซอฟต์แวร์มัลติเอเจนต์ AI โครงสร้างพื้นฐาน GPU และโซลูชันเอเจนต์อัจฉริยะสำหรับธุรกิจยุคใหม่

ติดต่อเรา

โซลูชัน AI

เวิร์กสเตชัน AIAI SME PackagesAI ส่วนตัวคลัสเตอร์ GPUEdge AIแล็บ AI องค์กรAI ตามอุตสาหกรรม

ผลิตภัณฑ์

ผลิตภัณฑ์ทั้งหมดWSL CRM และ ERPการตลาดOpenAI AgentsWSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7

บริษัท

เกี่ยวกับเราทำไมต้อง Workstationพาร์ทเนอร์เรื่องราวลูกค้าราคาติดต่อ

แหล่งข้อมูล

บทความเอกสารประกอบบล็อกค้นหาแผนผังเว็บไซต์
สำนักงานสหราชอาณาจักร
77-79 Marlowes, Hemel Hempstead HP1 1LFเส้นทาง - ออกทางแยกที่ 20 จาก M25 Outer Londonเลขทะเบียนบริษัท: 11641870จ. - ศ.: 9:00 - 18:00 น. GMT
+44 7515 356 146
สำนักงานเบลเยียม
Workstation SRL, Rue Vanderkindere 34, 1180 Uccle, BrusselsBE 0751.518.683จ. - ศ.: 9:00 - 18:00 น. CET
+32 492 45 67 46
สำนักงานอินเดีย
#159 Sector 9, Pocket 1, DDA Flats, 110077 Dwarka, New Delhi
+91 98881 98841

© 2026 Workstation AI สงวนลิขสิทธิ์

ความเป็นส่วนตัวคุกกี้ข้อกำหนดการให้บริการแผนผังเว็บไซต์

Loading blog...

Home / Blog
AnthropicAILLMCodingFinOps

เปรียบเทียบโมเดล Claude: Haiku vs Sonnet vs Opus vs Fable 5 (Mythos 5)

คู่มือสั้นเลือกชั้นโมเดล Claude ที่ถูก พร้อมเราเตอร์ cheap-to-frontier

Balinder Walia8 กรกฎาคม 25692 min read

คู่มือสั้น ใช้งานได้จริงเรื่องชั้นโมเดล Claude สำหรับการเจาะลึกเต็มพร้อมพิมพ์เขียว routing แพทเทิร์น prompting และ playbook token-budget อ่าน บทความใหญ่.

การเปรียบเทียบโมเดล Claude: Haiku, Sonnet, Opus, Fable 5, Mythos 5

เวอร์ชันหนึ่งย่อหน้า การเลือกโมเดล Claude ส่วนใหญ่เป็นการแลกระหว่าง ความหน่วง, ต้นทุน, และ งานต้องการให้โมเดลอยู่ในโฟลวนานแค่ไหน. ใช้ claude-haiku-4-5 สำหรับงานเจตนาที่เร็วและถูก, claude-sonnet-5 เพื่อความสมดุลความเร็ว/คุณภาพที่ดีที่สุด, claude-opus-4-8 สำหรับ agentic coding ที่ซับซ้อนและงานองค์กร และสงวน claude-fable-5 (และ gated claude-mythos-5) สำหรับงานที่ยากจริง ๆ ระยะยาว ที่ใช้ชั่วโมงหรือวัน

ไลน์อัปโมเดลในพริบตา

โมเดล เหมาะสำหรับ หน้าต่างบริบท เอาต์พุตสูงสุด ราคา (input / output) พฤติกรรม thinking
Claude Fable 5 (claude-fable-5) เอเจนต์รันยาวและปัญหาที่ยากที่สุดยังไม่แก้ 1M tokens 128K tokens $10 / $50 per MTok Adaptive thinking always on
Claude Opus 4.8 (claude-opus-4-8) Agentic coding ที่ซับซ้อนและงานองค์กร 1M tokens 128K tokens $5 / $25 per MTok Adaptive thinking always on
Claude Sonnet 5 (claude-sonnet-5) สมดุลความเร็ว/คุณภาพดีที่สุด 1M tokens 128K tokens $3 / $15 per MTok Adaptive thinking always on
Claude Haiku 4.5 (claude-haiku-4-5-20251001) โมเดลเร็วที่สุดสำหรับงานถูก ปริมาณสูง 200K tokens 64K tokens $1 / $5 per MTok Extended thinking available (adaptive off)

Claude Mythos 5 (claude-mythos-5) คือโมเดลแบบ gated ที่ใช้สเปกและราคาเดียวกับ Fable 5 แต่ไม่มี safety classifiers ที่ Fable 5 ใช้ ความพร้อมจำกัดเฉพาะพาร์ทเนอร์ที่อนุมัติผ่าน Project Glasswing

เลือกโมเดลที่ถูก (กฎเร็ว)

  • Haiku 4.5: routing, classification, extraction และเวิร์กโฟลว์ใดก็ตามที่ต้องการคำตอบเร็วและแบกรับงบ output-token สูงไม่ได้
  • Sonnet 5: การเขียนโค้ดประจำวันและงานเอกสารที่ต้องการคุณภาพสูงโดยไม่ใช้ราคา Opus/Fable
  • Opus 4.8: agentic coding ที่ซับซ้อน การวิเคราะห์องค์กร และการดีบักที่ยากขึ้นซึ่งต้องการงานยาวและอิสระกว่า
  • Fable 5: ปัญหาที่ยาก ระยะยาว ที่ใช้ชั่วโมงหรือวัน โดยเฉพาะเมื่อโมเดลต้องรักษาเป้าหมาย มอบหมายงานย่อย และคงความสอดคล้อง

Effort และ thinking: ผลต่อต้นทุนอย่างไร

บน API, effort คือตัวควบคุมหลักของ trade-off ระหว่างความฉลาด ความหน่วง และต้นทุนบน Fable 5 และ Mythos 5 สำหรับ Opus 4.8 และ Sonnet 5 คุณตั้ง effort อย่างชัดเจนได้เมื่อต้องการโปรไฟล์ cost/latency อื่น

นัยปฏิบัติ: ค่าเริ่มต้นทุกคำขอเป็น effort สูงสุด มักเป็นวิธีเร็วที่สุดในการเผางบด้วย output tokens

กลยุทธ์โทเคนที่ใช้ได้ทุกชั้น

Claude output tokens คือส่วนที่แพง กฎง่าย ๆ คือ: จำกัดความยาวเอาต์พุต, พรอมต์แบบ TLDR-first, และใช้ prompt caching เพื่อให้ prefix ที่เสถียร (system instructions และ tool schemas) ถูกใช้ซ้ำ

  • ใช้โมเดลถูกที่สุดที่ทำจบได้ เราเตอร์ (Haiku -> Sonnet/Opus -> Fable) มักลดต้นทุนอย่างมากโดยยังรักษาคุณภาพสูง
  • ตั้งขีดจำกัดเอาต์พุต ในโปรดักชัน ให้ตั้ง max output / token cap เสมอ คำตอบไร้ขอบเขตคืออุบัติเหตุด้านงบ
  • ใช้สรุปอย่างมีกลยุทธ์ แทนที่จะส่งทรานสคริปต์เต็มทุกเทิร์น ให้เก็บหน่วยความจำ “lessons” แบบกะทัดรัดแล้วอัปเดตเฉพาะส่วนนั้น

พิมพ์เขียวเราเตอร์ง่าย ๆ

  1. จำแนกเจตนาและความซับซ้อนโดยประมาณด้วย claude-haiku-4-5.
  2. ส่งงาน “ยากปกติ” ไปยัง claude-sonnet-5 (หรือ claude-opus-4-8 เมื่อคาดว่าจะมี agentic coding ที่หนักขึ้น)
  3. เลื่อนระดับไป claude-fable-5 เฉพาะเมื่องานชัดเจนว่าระยะยาวหรือล้มเหลวบนชั้นล่าง
  4. ถ้า Fable 5 ปฏิเสธผ่าน safety classifiers ให้ถอยไป Opus 4.8 (API รองรับการยิงใหม่พร้อม fallbacks เมื่อตั้งค่าไว้)

อ่านเพิ่ม (อย่างเป็นทางการ)

  • ภาพรวมโมเดล
  • แนะนำ Fable 5 และ Mythos 5
  • Prompting Claude Fable 5