Claude Opus 5 với Claude Fable 5: So sánh benchmark, giá và khuyến nghị lựa chọn
Claude Opus 5 đạt hiệu năng tương đương Claude Fable 5 nhưng chỉ với một nửa giá, 5 USD/25 USD so với 10 USD/50 USD mỗi triệu token, khiến đây trở thành lựa chọn mặc định tốt hơn cho gần như mọi trường hợp sử dụng.
Infinity phân tích dữ liệu benchmark chính thức từ Anthropic và nhận thấy Opus 5 thực sự vượt qua Fable 5 trên Frontier-Bench v0.1 (43,3% so với 33,7%) và SWE-bench Verified (96,0% so với 95,0%), trong khi Fable 5 chỉ nhỉnh hơn ở SWE-bench Pro (80,3% so với 79,2%).
Tóm tắt các điểm chính
- Opus 5 ra mắt ngày 24/7/2026 với giá 5 USD/25 USD mỗi triệu token, Fable 5 ra mắt ngày 9/6/2026 với giá đúng gấp đôi
- Trên GDPval-AA v2 đo công việc tri thức, Opus 5 đạt 1.861 điểm Elo, vượt Fable 5 (1.747), chênh lệch 114 điểm
- Fable 5 mang classifier an toàn nặng hơn, chặn cả khai thác lẫn tác vụ tấn công mạng rộng, khiến hiệu năng trên eval cyber về 0% khi classifier kích hoạt
- Opus 5 đạt điểm 2,3 trên audit hành vi lệch chuẩn, mức alignment tốt nhất từ trước đến nay của Anthropic
- Với workload nặng (100 triệu token input, 25 triệu token output mỗi tháng), Opus 5 tiết kiệm 1.125 USD so với Fable 5
Claude Opus 5 là gì?
Claude Opus 5 là mô hình mới nhất của Anthropic trong tầng Opus, ra mắt ngày 24/7/2026, có giá giống hệt phiên bản tiền nhiệm Opus 4.8. Anthropic mô tả đây là một mô hình chu đáo và chủ động, xây dựng cho việc sử dụng hàng ngày, hiện là mô hình mặc định trên Claude Max và mô hình mạnh nhất trên Claude Pro. Đặc điểm nổi bật của mô hình này là tính kiên trì agentic: tự xác minh công việc của mình và lặp lại đến khi tác vụ thực sự thành công, thay vì dừng lại ở một câu trả lời có vẻ hợp lý.
Claude Fable 5 là gì?
Claude Fable 5 là mô hình lớp Mythos được Anthropic điều chỉnh để an toàn cho sử dụng phổ thông, ra mắt ngày 9/6/2026, giá 10 USD mỗi triệu token input và 50 USD mỗi triệu token output. Mô hình từng bị tạm rút ngày 12/6/2026 để tuân thủ lệnh kiểm soát xuất khẩu của Mỹ, và Anthropic khôi phục quyền truy cập ngày 1/7/2026 sau khi lệnh được dỡ bỏ.
Anthropic định vị Fable 5 cao hơn tầng Opus về năng lực thuần túy, và tại thời điểm ra mắt, đây là mô hình state-of-the-art trên gần như mọi benchmark được test, khoảng cách càng lớn khi tác vụ càng dài và phức tạp. Tính năng đặc trưng của mô hình này là một bộ classifier định tuyến các yêu cầu bị đánh dấu liên quan đến an ninh mạng, sinh học và distillation sang Opus 4.8 thay vì trả lời trực tiếp.
So sánh Claude Opus 5 và Claude Fable 5
Opus 5 và Fable 5 nằm trong biên độ sai số của nhau trên phần lớn benchmark, nhưng Opus 5 đạt điều đó với chi phí chỉ bằng một nửa.
| Tính năng | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Ngày ra mắt | 24/7/2026 | 9/6/2026 |
| Giá input (mỗi triệu token) | 5 USD | 10 USD |
| Giá output (mỗi triệu token) | 25 USD | 50 USD |
| SWE-bench Verified | 96,0% * | 95,0% |
| SWE-bench Pro | 79,2% | 80,3% * |
| Frontier-Bench v0.1 | 43,3% * | 33,7% |
| ARC-AGI 3 | 30,2% * | chưa công bố |
| GDPval-AA v2 (Elo) | 1.861 * | 1.747 |
| Cơ chế an toàn | Classifier cyber nhẹ hơn | Classifier cyber/sinh học/distillation rộng hơn |
| Khả dụng | Mọi nền tảng và gói dịch vụ | Mọi nền tảng, triển khai theo giai đoạn cho người dùng phổ thông |
*dẫn đầu tổng thể hiện tại trên benchmark này
Coding và workflow agentic
Coding là mảng phần lớn người dùng thực sự triển khai hai mô hình này, và đây cũng là nơi khoảng cách giá cả trông ít hợp lý nhất. Trên SWE-bench Verified, Opus 5 đạt 96,0% so với 95,0% của Fable 5, chênh một điểm nghiêng về mô hình rẻ hơn. Trên Frontier-Bench v0.1, eval đo coding trong terminal, Opus 5 bứt xa hơn nữa với 43,3% so với 33,7%.

Fable 5 giành lại một chiến thắng sít sao trên SWE-bench Pro, đạt 80,3% so với 79,2% của Opus 5. Đó là khoảng chênh một điểm theo chiều ngược lại, cho thấy hai mô hình này gần như ngang nhau ở công việc kỹ thuật cấp repository. Đội ngũ Cognition báo cáo rằng Opus 5 tiệm cận hiệu năng ngang Fable 5 với chi phí chỉ bằng một nửa trên eval FrontierCode 1.1 của họ, khớp với những gì số liệu công khai cho thấy.
| Benchmark | Opus 5 | Fable 5 | Ghi chú |
|---|---|---|---|
| SWE-bench Verified | 96,0% | 95,0% | Do nhà cung cấp báo cáo |
| SWE-bench Pro | 79,2% | 80,3% | Chiến thắng coding duy nhất của Fable 5 |
| Frontier-Bench v0.1 | 43,3% | 33,7% | Coding trong terminal, Opus 5 hơn 9,6 điểm phần trăm |
| Terminal-Bench 2.1 | Chưa công bố | 88,0% | Điểm Opus 5 chưa được công bố |
Infinity tổng hợp bảng số liệu trên và nhận thấy Opus 5 hoặc ngang bằng hoặc vượt qua Fable 5 trên gần như mọi benchmark coding đã công bố, ngoại trừ duy nhất SWE-bench Pro. Chính khung diễn giải của Anthropic cũng cho biết Opus 5 đã tăng hơn gấp đôi điểm Frontier-Bench của Opus 4.8 với chi phí thấp hơn mỗi task, và mô hình này cũng vượt Fable 5 ở chính benchmark đó. Với coding, mô hình đắt tiền hơn không mang lại thêm giá trị gì.
Tác vụ agentic và computer-use
Cả hai mô hình đều được xây dựng cho công việc agentic dài hơi, nên khía cạnh này quan trọng nếu người dùng đang chạy pipeline tự động thay vì prompt một lượt. Ở đây, hành vi tự xác minh chủ động của Opus 5 chính là yếu tố phân biệt mà benchmark chỉ nắm bắt được một phần.
Trên ARC-AGI 3, eval yêu cầu mô hình giải bài toán mới lạ, Opus 5 nhảy từ 1,5% của Opus 4.8 lên 30,2%, gần gấp bốn lần mô hình tốt thứ nhì (GPT-5.6 Sol ở mức 7,8%). Đáng tiếc, Anthropic không công bố điểm số nào cho Fable 5 trên benchmark này, nên không thể so sánh trực tiếp hai mô hình.
Trên OSWorld 2.0, benchmark computer-use, Opus 5 (70,6%) thay thế Fable 5 (66,1%) trở thành mô hình dẫn đầu tổng thể, và trên AutomationBench của Zapier, Opus 5 đạt tỷ lệ pass 100% trên một chuỗi tác vụ ngăn churn mà các mô hình trước đó hoàn toàn không thể hoàn thành.
Infinity nhận thấy Opus 5 thắng thế rõ rệt trên các tác vụ agentic tính theo mỗi đô la chi phí bỏ ra.
Reasoning và công việc tri thức
Công việc tri thức vốn là sân nhà marketing của Fable 5, nên lẽ ra mô hình này phải dẫn đầu ở đây, nhưng thực tế không phải vậy. Trên GDPval-AA v2, benchmark Elo đo công việc tri thức, Opus 5 đạt 1.861 điểm so với 1.747 của Fable 5. Đó là khoảng chênh 114 điểm Elo nghiêng về mô hình rẻ hơn.
Fable 5 vẫn giữ lợi thế thực chất ở các bài toán reasoning khoa học khó nhất, dài hơi nhất, và Anthropic khẳng định rõ ràng năng lực lớp Mythos vẫn mạnh hơn cho nghiên cứu sinh học tự động chạy dài hạn. Nhưng với các tác vụ phân tích và tri thức mà phần lớn đội ngũ thực sự chạy hàng ngày, điểm GDPval-AA cao hơn của Opus 5 đồng nghĩa trả gấp đôi cho Fable 5 chỉ để nhận về kết quả kém hơn.
So sánh Cơ chế an toàn và hành vi từ chối giữa hai mô hình
Đây là khía cạnh hai mô hình thực sự phân kỳ, và cũng là lý do thực chất khiến Fable 5 tồn tại như một sản phẩm riêng. Đây cũng là khía cạnh dễ bị hiểu sai nhất, vì hai thứ khác nhau đều được gọi là "an toàn" ở đây, và chúng đo hai đầu đối lập của vấn đề.
Thứ nhất là khả năng chống lạm dụng: một hệ thống classifier bên ngoài đứng trước mô hình và định tuyến lại các yêu cầu nguy hiểm trước khi chúng đến được mô hình. Thứ hai là alignment: cách bản thân mô hình hành xử, bao gồm việc có lừa dối, thực hiện hành động liều lĩnh không thể đảo ngược, hay có thể bị thuyết phục để lạm dụng hay không. Một mô hình có thể đạt điểm tốt ở khía cạnh này nhưng vẫn cần hỗ trợ nặng ở khía cạnh kia, vì classifier không bảo vệ trước việc mô hình đi chệch hướng, mà bảo vệ trước việc người dùng khai thác được điều gì đó có hại từ mô hình.
Fable 5 là mô hình lớp Mythos mang hệ thống classifier nặng hơn trong hai mô hình. Classifier của Fable 5 bao phủ ba mảng, và khi kích hoạt, yêu cầu sẽ được chuyển về Opus 4.8: an ninh mạng (cả khai thác lẫn các tác vụ tấn công mạng rộng hơn đều bị chặn, khiến hiệu năng của Fable 5 trên eval cyber về 0% khi classifier hoạt động), sinh học và hóa học (phần lớn yêu cầu liên quan mặc định được chuyển về Opus 4.8), và distillation (các yêu cầu bị đánh dấu là nỗ lực trích xuất năng lực của Fable 5 sẽ bị định tuyến khác đi). Anthropic điều chỉnh các classifier này khá thận trọng: dữ liệu ban đầu cho thấy hơn 95% phiên làm việc với Fable 5 không kích hoạt bất kỳ fallback nào.
Opus 5 mang một phiên bản nhẹ hơn của cùng hệ thống. Classifier cyber của Opus 5 cho phép tìm lỗ hổng trong source code nhưng chặn quét dựa trên binary, penetration testing, và sinh exploit, và Anthropic kỳ vọng chúng sẽ kích hoạt ít hơn khoảng 85% so với Fable 5.
Trên audit hành vi tự động, Opus 5 đạt điểm 2,3 về hành vi lệch chuẩn, mức mà Anthropic gọi là mô hình có alignment tốt nhất từ trước đến nay, vượt cả Opus 4.8, Sonnet 5 và Fable 5.
Infinity nhận định đây là một sự phân nhánh, không phải một bảng điểm phân định thắng thua. Với coding tổng quát, công việc tri thức và computer-use, Opus 5 là mô hình có alignment tốt, ít gây cản trở hơn. Còn ở biên giới của một lĩnh vực được giám sát chặt, như nghiên cứu bảo mật tấn công hay sinh học dài hạn, Fable 5 (hoặc Mythos 5 qua Cyber Verification Program) là công cụ mạnh hơn, và hành vi từ chối nặng hơn chính là cái giá để tiếp cận năng lực đó.
Giá thực tế phải trả cho Opus 5 và Fable 5
Fable 5 có giá đúng gấp đôi Opus 5 ở cả input lẫn output. Fast mode của Opus 5, chạy với tốc độ gấp khoảng 2,5 lần mặc định, có giá 10 USD input và 50 USD output, đúng bằng mức giá tiêu chuẩn của Fable 5.
| Mức giá | Opus 5 | Fable 5 |
|---|---|---|
| Input, mỗi triệu token | 5,00 USD | 10,00 USD |
| Output, mỗi triệu token | 25,00 USD | 50,00 USD |
| Input Fast mode, mỗi triệu token | 10,00 USD | Không áp dụng |
| Output Fast mode, mỗi triệu token | 50,00 USD | Không áp dụng |
Cả hai mô hình đều dùng chung tokenizer mới hơn của Anthropic, xuất hiện cùng thế hệ Opus 4.7, nên cùng một văn bản sẽ tốn số lượng token input như nhau trên cả hai mô hình, và chưa nhà cung cấp nào công bố một so sánh số lượng token có kiểm soát giữa hai mô hình cho cùng một tác vụ.
| Khối lượng hàng tháng | Opus 5 | Fable 5 | Chênh lệch |
|---|---|---|---|
| Nhẹ: 1 triệu token in / 250.000 token out | 11,25 USD | 22,50 USD | Opus 5 tiết kiệm 11,25 USD (50%) |
| Nặng: 100 triệu token in / 25 triệu token out | 1.125 USD | 2.250 USD | Opus 5 tiết kiệm 1.125 USD (50%) |
Ở mức workload nặng, đó là chênh lệch 1.125 USD mỗi tháng cho một tính năng production hoặc một agent chạy liên tục, và benchmark cho thấy không phải đánh đổi gì về coding hay công việc tri thức để có được khoản tiết kiệm đó.

Tuy vậy, nên xem các con số tổng này như một so sánh mức giá hơn là một dự báo chi phí chính xác. Opus 5 có thể tốn hơn Opus 4.8 trong thực tế vì có xu hướng sinh ra nhiều thinking token hơn, nhưng điều này không thay đổi bức tranh chung: Opus 5 vẫn sẽ là mô hình rẻ hơn đáng kể trong phần lớn trường hợp.
Khi nào nên chọn Opus 5, khi nào nên chọn Fable 5?
Với phần lớn người đọc, đây là một quyết định ngắn gọn: Opus 5 là lựa chọn mặc định, còn Fable 5 là ngoại lệ.
| Trường hợp sử dụng | Khuyến nghị | Lý do |
|---|---|---|
| Coding agent cấp repository | Opus 5 | Ngang bằng hoặc vượt Fable 5 trên SWE-bench, dẫn đầu Frontier-Bench với chi phí bằng một nửa |
| Công việc tri thức và phân tích hàng ngày | Opus 5 | Elo GDPval-AA v2 cao hơn (1.861 so với 1.747) với giá bằng một nửa |
| Workload production khối lượng lớn | Opus 5 | Khoản tiết kiệm 50% cộng dồn vượt 1.000 USD/tháng ở tầng nặng |
| Bài toán mới lạ và reasoning trừu tượng | Opus 5 | Điểm ARC-AGI 3 đạt 30,2%, gấp ba mô hình tốt thứ nhì |
| Nghiên cứu sinh học tự động chạy dài hạn | Fable 5 | Năng lực lớp Mythos vẫn mạnh hơn cho công việc cụ thể này |
| Workflow cần cơ chế an toàn bao phủ rộng | Fable 5 | Classifier bao phủ cyber, sinh học và distillation rộng hơn |
Nên chọn Opus 5 nếu:
- Đang xây dựng công cụ coding hoặc agentic và muốn hiệu năng tốt nhất tính theo mỗi đô la, vì mô hình này vượt Fable 5 trên Frontier-Bench và hòa trên SWE-bench.
- Đang chạy workload khối lượng lớn nơi mức giảm giá 50% chuyển thành ngân sách thực chất, và benchmark xác nhận không mất gì về chất lượng.
- Muốn mô hình có alignment tốt nhất hiện có, dựa trên điểm audit hành vi lệch chuẩn 2,3, tốt nhất từ trước đến nay của Anthropic.
- Cần hành vi từ chối nhẹ hơn cho nghiên cứu bảo mật hợp pháp, vì classifier của mô hình này kích hoạt ít hơn khoảng 85% so với Fable 5.

Nên chọn Fable 5 nếu:
- Công việc là nghiên cứu sinh học tự động chạy dài hạn, lĩnh vực duy nhất Anthropic cho biết năng lực lớp Mythos vẫn dẫn đầu.
- Hoặc cần cụ thể độ bao phủ classifier rộng hơn trên cả cyber, sinh học và distillation mà hệ thống an toàn của Fable 5 cung cấp.
Infinity khuyến nghị dùng Opus 5 trừ khi có lý do cụ thể để không làm vậy. Mô hình này ngang bằng hoặc vượt Fable 5 trên coding, thắng benchmark Elo về công việc tri thức, gấp ba lần cả nhóm về reasoning mới lạ, và làm tất cả những điều đó với chi phí chỉ bằng một nửa trong khi đạt điểm alignment tốt nhất của Anthropic.
Fable 5 rõ ràng không phải một mô hình tệ. Chỉ là không được xây dựng cho phần lớn công việc mà các đội ngũ thực sự làm. Mô hình mang cơ chế an toàn nặng hơn và giữ lợi thế thực chất ở biên giới công việc tự động chạy dài hạn như nghiên cứu sinh học, nhưng ngoài mảng hẹp đó, trả gấp đôi cho Fable 5 đồng nghĩa trả gấp đôi để đạt điểm số thấp hơn một chút trên các benchmark quan trọng cho coding và phân tích.
Bắt đầu với Claude Opus 5 và Claude Fable 5 như thế nào?
Cả hai mô hình đều khả dụng rộng rãi trên các ứng dụng Claude, API, các nền tảng cloud lớn, và các coding agent của Anthropic. Khác biệt thực tế khá hẹp và chủ yếu thể hiện ở cấp độ gói dịch vụ dành cho người dùng phổ thông.
| Nền tảng | Opus 5 | Fable 5 |
|---|---|---|
| Ứng dụng người dùng phổ thông | Ứng dụng Claude (bao gồm trong Pro, Max, Team, Enterprise; mặc định trên Max, mạnh nhất trên Pro) | Ứng dụng Claude (Max & Team Premium: bao gồm, giới hạn 50% mỗi tuần; Pro & Team Standard: chỉ dùng usage credit) |
| API chính chủ | Anthropic API | Anthropic API |
| Nền tảng cloud | Amazon Bedrock, Vertex AI, Microsoft Foundry | Amazon Bedrock, Vertex AI, Microsoft Foundry |
| Coding agent | Claude Code, Claude Cowork | Claude Code, Claude Cowork |
| Model ID trên API | claude-opus-5 | claude-fable-5 |
Khoảng cách rõ ràng nhất: trên gói Pro và Team Standard, Fable 5 hoàn toàn không được bao gồm. Mô hình này chạy theo usage credit trả tiền theo mức sử dụng ở giá API, trong khi Opus 5 được bao gồm sẵn trong các gói đó.
Dùng Opus 5 và Fable 5 trong coding agent như thế nào?
Cả hai mô hình đều chọn được trong Claude Code, chuyển đổi giữa chúng chỉ là thay đổi model string trong request hoặc cấu hình agent. Vì chia sẻ chung SDK, việc chuyển một agent đang hoạt động từ mô hình này sang mô hình kia chỉ là một dòng thay đổi:
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-opus-5", # đổi thành "claude-fable-5"
max_tokens=1024,
messages=[{"role": "user", "content": "Refactor this function..."}],
)
print(response.content.text)
Lưu ý: Opus 5 mặc định trả về thinking block, nên truy cập trực tiếp
response.content.textcó thể gây lỗi AttributeError khi block đầu tiên là thinking block.
Kết luận
Infinity nhận thấy điều đáng chú ý nhất là so sánh này đảo ngược logic tầng mô hình thông thường. Thông thường, mô hình mới hơn, rẻ hơn sẽ đánh đổi một phần năng lực để lấy khả năng tiếp cận. Ở đây, Anthropic phát hành một mô hình rẻ hơn nhưng cũng là lựa chọn năng lực tốt hơn cho gần như mọi tác vụ phổ thông, điều này gợi ý mức giá của Fable 5 đang mua nhiều hơn cho vị thế an toàn và huyết thống Mythos của nó, hơn là hiệu năng thuần túy.
Nguồn: Infinity - đơn vị cung cấp giải pháp Digital Marketing tích hợp cho doanh nghiệp — từ thiết kế website chuẩn SEO & UX/UI, dịch vụ AI SEO (GEO/AEO), PR Digital, sáng tạo nội dung số, quảng cáo trực tuyến (SEM/Ads) đến phân tích dữ liệu Marketing. Với nền tảng nghiên cứu và dữ liệu thực chiến, chúng tôi giúp doanh nghiệp xây dựng chiến lược thương hiệu bền vững và tăng trưởng có hệ thống trong kỷ nguyên AI.
All rights reserved