หน้าแรก / บทความ / AI & LLM
AI & LLM วิเคราะห์จากสเปค + benchmark

วิเคราะห์และรีวิว: Claude Fable 5 โมเดล Mythos-class ตัวแรกจาก Anthropic

เจาะลึกสเปคและการวางตำแหน่งของ Claude Fable 5 โมเดลสาย Mythos-class รุ่นแรกที่เปิดสาธารณะ ต่างจาก Opus 4.8 อย่างไร ราคาแพงเท่าตัวคุ้มไหม

วิเคราะห์และรีวิว: Claude Fable 5 โมเดล Mythos-class ตัวแรกจาก Anthropic

สรุปสั้นๆ

Claude Fable 5 คือโมเดล flagship ตัวใหม่จาก Anthropic เปิดตัว 9 มิ.ย. 2026 — เป็น “Mythos-class” ตัวแรกที่ปล่อยสาธารณะจริง tier นี้อยู่เหนือ Opus 4.8 ราคาเท่าตัว ($10/$50 ต่อล้าน token) แต่เคลม SWE-Bench Pro ได้ 80.3% ทิ้ง Opus 4.8 ที่ 69.2% และ GPT-5.5 ที่ 58.6% ไปชัดเจน

จุดขายที่ Anthropic เน้นคือ “long-horizon autonomy” — ให้ agent รันงานโค้ดต่อเนื่องหลายชั่วโมงไปจนถึงหลายวันโดยไม่หลุดบริบท

ใครทำ autonomous coding agent หรือ large-scale refactor จริงจัง ผมว่านี่คือ upgrade ที่ต้องลอง แต่ถ้าใช้ chat ทั่วไปหรืองาน routine — จ่ายเพิ่ม 2 เท่าเพื่อเลขที่ดีขึ้นไม่กี่จุด ยังอยู่กับ Opus 4.8 ได้สบายๆ

หน้าตาแรกที่เห็น

เปิดใช้ครั้งแรกใน Claude app แล้ว dropdown เลือกโมเดลมี “Fable 5” โผล่แยกจาก Opus/Sonnet/Haiku ชัดเจน ไม่ใช่แค่ variant ของ Opus แต่ถูกจัดเป็น tier ใหม่ต่างหาก

พูดตรงๆ ที่น่าสนใจกว่าตัวหน้าจอคือ badge ที่ Anthropic ใส่ให้ — “Mythos-class” — ไม่ใช่แค่ marketing gimmick แต่เป็นชื่อ tier ที่บริษัทใช้ภายในสำหรับโมเดลระดับ frontier ที่เคยถูกเก็บไว้ในโปรแกรม Project Glasswing (limited-access) มาก่อน รอบนี้เป็นครั้งแรกที่มีตัวหนึ่งในสายนี้ถูกปล่อยออกมาให้ใช้ทั่วไป

ส่วน Claude Mythos 5 (พี่ใหญ่จริงๆ ในสาย) ยังไม่ได้ถูกปล่อยสาธารณะ — เปิดเฉพาะลูกค้าที่ผ่านการอนุมัติ Project Glasswing เท่านั้น เพราะ Anthropic ยังกังวลเรื่อง cybersecurity capability ของโมเดลตัวเต็ม

จุดเริ่มต้นที่ทำให้ต้องมามอง

Anthropic ประกาศ Mythos ตั้งแต่เมษายน 2026 แต่ลากมาปล่อยครึ่งหลังกว่า 2 เดือน เหตุผลที่บริษัทระบุคือรอทดสอบความปลอดภัยจาก red team กว่า 1,000 ชั่วโมง

ประเด็นน่าสนใจคือช่วงก่อนหน้าไม่กี่วัน Anthropic เพิ่งออกมาเตือนว่า AI กำลังอันตรายขึ้น แต่กลับปล่อยโมเดลที่แรงที่สุดตัวหนึ่งของตัวเองสู่สาธารณะแทบจะทันที — สื่อหลายเจ้า (TechCrunch, The Verge) หยิบเรื่องนี้มาชี้ว่าเป็น contradiction ที่น่าตั้งคำถาม

ผมว่ามุมนี้สำคัญ เพราะการปล่อย tier ที่เหนือ Opus ออกมา = ยอมรับกลายๆ ว่าตลาด (โดยเฉพาะแรงกดดันจาก GPT กับ Gemini) กดจนต้องปล่อย ไม่ใช่แค่เรื่อง safety readiness ล้วนๆ

ยืนอยู่ตรงไหนในตระกูล Claude

ก่อนหน้านี้ Anthropic จัดชั้น Claude เป็น Opus (แรงสุด) → Sonnet (กลาง) → Haiku (เร็ว/ถูก) ทุกตัวยังถือเป็น “Opus-class” หรือต่ำกว่าในระบบ tier ภายใน

Mythos คือ tier ใหม่ ที่ถูกแทรกเหนือ Opus โมเดลนี้ถูกออกแบบให้รับงานยาก งานยาว งานที่ต้องคิดข้ามหลาย step โดยไม่หลุด แล้วราคาก็สะท้อนตำแหน่งใหม่ตรงๆ

ตำแหน่ง Claude Fable 5 ในตระกูล Claude — tier ใหม่เหนือ Opus

Fable 5 คือรุ่น “public” ของ tier นี้ — มีระบบ reroute prompt เสี่ยง (cyber/bio/chem/distillation) ให้ Opus 4.8 ตอบแทน ส่วน Mythos 5 ตัวเต็มยังอยู่หลังกำแพงของ Project Glasswing

พูดตรงๆ นี่คือครั้งแรกที่ Anthropic แบ่งเป็น “public sibling” กับ “restricted sibling” ของ tier เดียวกัน architecture น่าจะเหมือนกัน แต่ safety policy ต่างกันคนละเรื่อง

เทียบกับรุ่นก่อนหน้าเปลี่ยนไปแค่ไหน

Factor Claude Fable 5Claude Opus 4.8
Tier Mythos-class (ใหม่)Opus-class
SWE-Bench Pro 80.3%69.2%
Terminal-Bench 2.1 88.0%ต่ำกว่า
Humanity's Last Exam (with tools) 64.5%ต่ำกว่า
Context window 1M tokens1M tokens
Output max ต่อ response 128K tokensต่ำกว่า
ราคา input/output ต่อล้าน token $10 / $50ถูกกว่าเท่าตัว
Long-horizon autonomy ทำได้หลายชั่วโมง–หลายวันหลุด context เร็วกว่า

พูดตรงๆ เลขที่สะดุดตาที่สุดคือ SWE-Bench Pro 80.3% — ทิ้ง Opus 4.8 ไปกว่า 11 percentage point ในเบนช์งาน agentic coding ถ้าตัวเลขนี้สะท้อนของจริง = งาน refactor/migration ระดับใหญ่ที่ Opus 4.8 ต้องคุมมือหลายรอบ Fable 5 น่าจะจบเองได้ในรอบเดียว

ใช้จริงแล้วเป็นยังไง

Claude Fable 5 กับงาน agentic coding แบบ long-horizon

Anthropic เคลมว่า Fable 5 ถูก tune ให้ “long-horizon autonomy” — ปล่อยรันเองต่อเนื่องได้หลายชั่วโมง โดยไม่ต้อง human intervene ทุก step

ในเคสจริง มันแปลว่าคุณสามารถบอกให้ agent ไปทำงานอย่าง “รี refactor Python 2 codebase เก่าให้เป็น Python 3 พร้อม test coverage 80%+” แล้วปล่อยไว้ข้ามคืน กลับมาดูตอนเช้าค่อยรีวิว diff

จุดที่ต้องระวังคือ token consumption — งาน long-horizon กิน token เยอะมาก ยิ่ง output ราคา $50 ต่อล้าน token = ค่าใช้จ่ายโตเร็วกว่าที่คิด โดยเฉพาะ agent ที่ retry บ่อยๆ

ผมว่าจุดขายจริงๆ ไม่ใช่แค่ “ฉลาดกว่า” ในทดสอบ static แต่คือความสามารถวิ่งต่อเนื่องข้ามหลาย step โดยไม่หลุด context ในงานที่ Opus ต้องรีสตาร์ทซ้ำๆ

เรื่อง safety ที่ต้องเข้าใจ

Fable 5 มีระบบ reroute — ถ้า prompt แตะเรื่อง cybersecurity, ชีวภาพ, เคมี, หรือ model distillation → โมเดลจะส่งคำถามไป Opus 4.8 ตอบแทน (ไม่ใช่ block เฉยๆ)

Anthropic คาดว่ากรณีนี้จะเกิดกับ session น้อยกว่า 5% แต่ถ้างานของคุณอยู่ในกลุ่ม security research หรือ bio/chem — พึงระลึกว่า output ที่ได้อาจไม่ใช่จาก Fable 5 จริงๆ

Red team รัน 1,000+ ชั่วโมง Anthropic บอกว่ายังไม่เจอ universal jailbreak — ตัวเลขนี้ฟังดูดี แต่ก็ไม่ได้แปลว่าไม่มี ผมว่ารอเวลาให้ community ลอง ค่อยว่ากันอีกที

เทียบกับคู่แข่งในตลาด

Factor Claude Fable 5GPT-5.5Gemini flagship
SWE-Bench Pro 80.3%58.6%ยังไม่มีตัวเลขเทียบเทียม
จุดขายหลัก long-horizon autonomyรอบด้าน+ราคาถูกmultimodal + ecosystem
ราคา input (ต่อล้าน token) $10ถูกกว่าถูกกว่า
การเข้าถึง Claude API / BedrockOpenAI APIGoogle Cloud

พูดตรงๆ ถ้าดูแค่ SWE-Bench Pro — Fable 5 ทิ้ง GPT-5.5 ไปเยอะมาก (80.3% vs 58.6%) แต่นั่นเป็นเบนช์ agentic coding เพียงตัวเดียว งาน routine อื่นๆ GPT ยังคุ้มค่ากว่าเยอะในแง่ราคา/คุณภาพ

ถ้างานหลักคือ autonomous coding pipeline ที่ต้องรันข้ามชั่วโมง — Fable 5 คุ้มค่าจ่ายพรีเมี่ยม ส่วนงาน chat/analysis ทั่วไป GPT-5.5 หรือ Gemini ยังตอบโจทย์ดีกว่าในแง่ต้นทุน

ข้อดีข้อเสียที่ต้องรู้

ข้อดี

  • +SWE-Bench Pro 80.3% ทิ้งคู่แข่งชัดเจน — งาน agentic coding แข็งจริง
  • +Long-horizon autonomy รันงานหลายชั่วโมง/หลายวันโดยไม่หลุด context
  • +1M context / output ยาวสุดถึง 128K — รับ codebase ใหญ่ๆ ได้เต็มไม้เต็มมือ

ข้อเสีย

  • ราคาเท่าตัวจาก Opus 4.8 ($10/$50 ต่อล้าน token) — บิลโตเร็วมากในงาน long-horizon
  • prompt เรื่อง cyber/bio/chem/distillation จะ reroute ไป Opus 4.8 อัตโนมัติ — งาน security อาจไม่ได้ Fable จริง
  • Mythos 5 ตัวเต็มยังปิดอยู่ภายใต้ Project Glasswing — ที่ปล่อยเป็นเวอร์ชัน safety-tuned เท่านั้น

พูดตรงๆ ราคา 2 เท่า = ต้องมั่นใจว่างานคุณคุ้มที่จะจ่ายพรีเมี่ยม ถ้าเป็น chat routine, งานเขียน หรือ analysis ทั่วไป — Opus 4.8 ยังโอเคอยู่ ไม่ต้องรีบสลับ

งบบัตรเครดิตที่โชว์ตอนเปิด API ไม่ใช่ต้นทุนจริงทั้งหมด — long-horizon agent กิน token ต่อ session ไม่ต่ำกว่า chat ปกติหลายเท่า พล็อตนี้คนมองข้ามบ่อยเวลาตัดสินใจอัปเกรด

เหมาะกับใคร ไม่เหมาะกับใคร

เหมาะกับ

  • ทีมทำ autonomous coding agent ที่ต้องรันข้ามชั่วโมง/ข้ามวัน
  • engineer ที่ทำ large-scale refactor / migration codebase
  • R&D lab ที่ต้องการโมเดล frontier สำหรับงาน reasoning ระดับสูงสุด
!

ลองชั่งน้ำหนักดู

  • ทีม dev ที่ใช้ Opus 4.8 อยู่ — ลอง Fable 5 ในงานยากๆ ก่อน แล้ววัด ROI ก่อนสลับทั้งหมด
×

ข้ามได้เลย

  • chat/QA ทั่วไป — Opus 4.8 หรือ Sonnet คุ้มค่ากว่าเยอะ
  • งาน security research (cyber/bio/chem) — โมเดลจะ reroute ไป Opus 4.8 อัตโนมัติ
  • startup ที่ต้องคุมต้นทุน — ราคาอาจกัดเงินสดเร็วกว่าที่วางแผนไว้

ผมว่า Fable 5 = premium tool เอาไว้ยิงกับงานหนักโดยเฉพาะ ไม่ใช่ตัว default สำหรับงาน routine ใครที่ใช้ Claude หลักอยู่แล้ว ควรลองรอบเดียวกับงานที่ยากที่สุดของตัวเอง ถ้าเห็นความต่างชัด ค่อยขยับสลับ

สรุปส่งท้าย

Claude Fable 5 ไม่ใช่ upgrade แบบ +5% รอบด้าน แต่คือการเปิด tier ใหม่ที่ Anthropic เรียกว่า Mythos-class — ราคาแพงเท่าตัวเพื่อความสามารถ agentic coding + long-horizon autonomy ที่ทิ้งคู่แข่งไปเยอะในเบนช์มาร์ค

ใครควรลองก่อน? ทีมทำ autonomous agent, large refactor, หรือ codebase migration ระดับใหญ่ กลุ่มนี้จะได้ใช้จุดขายจริงๆ ตั้งแต่รอบแรก

ส่วนใครที่ใช้ Claude หลักอยู่แล้วในงานทั่วไป — ผมว่ายังไม่ต้องรีบสลับ ลองกับ hard case ก่อน เห็นเลข ROI ค่อยตัดสินใจ บอกเลยว่าของแบบนี้เหมือน supercar — คุ้มก็ต่อเมื่อเอาไปวิ่งบนสนามที่ใช่