0

Claude Opus 5 với Claude Fable 5: So sánh benchmark, giá và khuyến nghị lựa chọn

Claude Opus 5 đạt hiệu năng tương đương Claude Fable 5 nhưng chỉ với một nửa giá, 5 USD/25 USD so với 10 USD/50 USD mỗi triệu token, khiến đây trở thành lựa chọn mặc định tốt hơn cho gần như mọi trường hợp sử dụng.

Infinity phân tích dữ liệu benchmark chính thức từ Anthropic và nhận thấy Opus 5 thực sự vượt qua Fable 5 trên Frontier-Bench v0.1 (43,3% so với 33,7%) và SWE-bench Verified (96,0% so với 95,0%), trong khi Fable 5 chỉ nhỉnh hơn ở SWE-bench Pro (80,3% so với 79,2%).

Tóm tắt các điểm chính

  • Opus 5 ra mắt ngày 24/7/2026 với giá 5 USD/25 USD mỗi triệu token, Fable 5 ra mắt ngày 9/6/2026 với giá đúng gấp đôi
  • Trên GDPval-AA v2 đo công việc tri thức, Opus 5 đạt 1.861 điểm Elo, vượt Fable 5 (1.747), chênh lệch 114 điểm
  • Fable 5 mang classifier an toàn nặng hơn, chặn cả khai thác lẫn tác vụ tấn công mạng rộng, khiến hiệu năng trên eval cyber về 0% khi classifier kích hoạt
  • Opus 5 đạt điểm 2,3 trên audit hành vi lệch chuẩn, mức alignment tốt nhất từ trước đến nay của Anthropic
  • Với workload nặng (100 triệu token input, 25 triệu token output mỗi tháng), Opus 5 tiết kiệm 1.125 USD so với Fable 5

Claude Opus 5 là gì?

Claude Opus 5 là mô hình mới nhất của Anthropic trong tầng Opus, ra mắt ngày 24/7/2026, có giá giống hệt phiên bản tiền nhiệm Opus 4.8. Anthropic mô tả đây là một mô hình chu đáo và chủ động, xây dựng cho việc sử dụng hàng ngày, hiện là mô hình mặc định trên Claude Max và mô hình mạnh nhất trên Claude Pro. Đặc điểm nổi bật của mô hình này là tính kiên trì agentic: tự xác minh công việc của mình và lặp lại đến khi tác vụ thực sự thành công, thay vì dừng lại ở một câu trả lời có vẻ hợp lý.

Claude Fable 5 là gì?

Claude Fable 5 là mô hình lớp Mythos được Anthropic điều chỉnh để an toàn cho sử dụng phổ thông, ra mắt ngày 9/6/2026, giá 10 USD mỗi triệu token input và 50 USD mỗi triệu token output. Mô hình từng bị tạm rút ngày 12/6/2026 để tuân thủ lệnh kiểm soát xuất khẩu của Mỹ, và Anthropic khôi phục quyền truy cập ngày 1/7/2026 sau khi lệnh được dỡ bỏ.

Anthropic định vị Fable 5 cao hơn tầng Opus về năng lực thuần túy, và tại thời điểm ra mắt, đây là mô hình state-of-the-art trên gần như mọi benchmark được test, khoảng cách càng lớn khi tác vụ càng dài và phức tạp. Tính năng đặc trưng của mô hình này là một bộ classifier định tuyến các yêu cầu bị đánh dấu liên quan đến an ninh mạng, sinh học và distillation sang Opus 4.8 thay vì trả lời trực tiếp.

So sánh Claude Opus 5 và Claude Fable 5

Opus 5 và Fable 5 nằm trong biên độ sai số của nhau trên phần lớn benchmark, nhưng Opus 5 đạt điều đó với chi phí chỉ bằng một nửa.

Tính năng Claude Opus 5 Claude Fable 5
Ngày ra mắt 24/7/2026 9/6/2026
Giá input (mỗi triệu token) 5 USD 10 USD
Giá output (mỗi triệu token) 25 USD 50 USD
SWE-bench Verified 96,0% * 95,0%
SWE-bench Pro 79,2% 80,3% *
Frontier-Bench v0.1 43,3% * 33,7%
ARC-AGI 3 30,2% * chưa công bố
GDPval-AA v2 (Elo) 1.861 * 1.747
Cơ chế an toàn Classifier cyber nhẹ hơn Classifier cyber/sinh học/distillation rộng hơn
Khả dụng Mọi nền tảng và gói dịch vụ Mọi nền tảng, triển khai theo giai đoạn cho người dùng phổ thông

*dẫn đầu tổng thể hiện tại trên benchmark này

Coding và workflow agentic

Coding là mảng phần lớn người dùng thực sự triển khai hai mô hình này, và đây cũng là nơi khoảng cách giá cả trông ít hợp lý nhất. Trên SWE-bench Verified, Opus 5 đạt 96,0% so với 95,0% của Fable 5, chênh một điểm nghiêng về mô hình rẻ hơn. Trên Frontier-Bench v0.1, eval đo coding trong terminal, Opus 5 bứt xa hơn nữa với 43,3% so với 33,7%.

Coding benchmarks comparison

Fable 5 giành lại một chiến thắng sít sao trên SWE-bench Pro, đạt 80,3% so với 79,2% của Opus 5. Đó là khoảng chênh một điểm theo chiều ngược lại, cho thấy hai mô hình này gần như ngang nhau ở công việc kỹ thuật cấp repository. Đội ngũ Cognition báo cáo rằng Opus 5 tiệm cận hiệu năng ngang Fable 5 với chi phí chỉ bằng một nửa trên eval FrontierCode 1.1 của họ, khớp với những gì số liệu công khai cho thấy.

Benchmark Opus 5 Fable 5 Ghi chú
SWE-bench Verified 96,0% 95,0% Do nhà cung cấp báo cáo
SWE-bench Pro 79,2% 80,3% Chiến thắng coding duy nhất của Fable 5
Frontier-Bench v0.1 43,3% 33,7% Coding trong terminal, Opus 5 hơn 9,6 điểm phần trăm
Terminal-Bench 2.1 Chưa công bố 88,0% Điểm Opus 5 chưa được công bố

Infinity tổng hợp bảng số liệu trên và nhận thấy Opus 5 hoặc ngang bằng hoặc vượt qua Fable 5 trên gần như mọi benchmark coding đã công bố, ngoại trừ duy nhất SWE-bench Pro. Chính khung diễn giải của Anthropic cũng cho biết Opus 5 đã tăng hơn gấp đôi điểm Frontier-Bench của Opus 4.8 với chi phí thấp hơn mỗi task, và mô hình này cũng vượt Fable 5 ở chính benchmark đó. Với coding, mô hình đắt tiền hơn không mang lại thêm giá trị gì.

Tác vụ agentic và computer-use

Cả hai mô hình đều được xây dựng cho công việc agentic dài hơi, nên khía cạnh này quan trọng nếu người dùng đang chạy pipeline tự động thay vì prompt một lượt. Ở đây, hành vi tự xác minh chủ động của Opus 5 chính là yếu tố phân biệt mà benchmark chỉ nắm bắt được một phần.

Trên ARC-AGI 3, eval yêu cầu mô hình giải bài toán mới lạ, Opus 5 nhảy từ 1,5% của Opus 4.8 lên 30,2%, gần gấp bốn lần mô hình tốt thứ nhì (GPT-5.6 Sol ở mức 7,8%). Đáng tiếc, Anthropic không công bố điểm số nào cho Fable 5 trên benchmark này, nên không thể so sánh trực tiếp hai mô hình.

Trên OSWorld 2.0, benchmark computer-use, Opus 5 (70,6%) thay thế Fable 5 (66,1%) trở thành mô hình dẫn đầu tổng thể, và trên AutomationBench của Zapier, Opus 5 đạt tỷ lệ pass 100% trên một chuỗi tác vụ ngăn churn mà các mô hình trước đó hoàn toàn không thể hoàn thành.

Infinity nhận thấy Opus 5 thắng thế rõ rệt trên các tác vụ agentic tính theo mỗi đô la chi phí bỏ ra.

Reasoning và công việc tri thức

Công việc tri thức vốn là sân nhà marketing của Fable 5, nên lẽ ra mô hình này phải dẫn đầu ở đây, nhưng thực tế không phải vậy. Trên GDPval-AA v2, benchmark Elo đo công việc tri thức, Opus 5 đạt 1.861 điểm so với 1.747 của Fable 5. Đó là khoảng chênh 114 điểm Elo nghiêng về mô hình rẻ hơn.

Fable 5 vẫn giữ lợi thế thực chất ở các bài toán reasoning khoa học khó nhất, dài hơi nhất, và Anthropic khẳng định rõ ràng năng lực lớp Mythos vẫn mạnh hơn cho nghiên cứu sinh học tự động chạy dài hạn. Nhưng với các tác vụ phân tích và tri thức mà phần lớn đội ngũ thực sự chạy hàng ngày, điểm GDPval-AA cao hơn của Opus 5 đồng nghĩa trả gấp đôi cho Fable 5 chỉ để nhận về kết quả kém hơn.

So sánh Cơ chế an toàn và hành vi từ chối giữa hai mô hình

Đây là khía cạnh hai mô hình thực sự phân kỳ, và cũng là lý do thực chất khiến Fable 5 tồn tại như một sản phẩm riêng. Đây cũng là khía cạnh dễ bị hiểu sai nhất, vì hai thứ khác nhau đều được gọi là "an toàn" ở đây, và chúng đo hai đầu đối lập của vấn đề.

Thứ nhất là khả năng chống lạm dụng: một hệ thống classifier bên ngoài đứng trước mô hình và định tuyến lại các yêu cầu nguy hiểm trước khi chúng đến được mô hình. Thứ hai là alignment: cách bản thân mô hình hành xử, bao gồm việc có lừa dối, thực hiện hành động liều lĩnh không thể đảo ngược, hay có thể bị thuyết phục để lạm dụng hay không. Một mô hình có thể đạt điểm tốt ở khía cạnh này nhưng vẫn cần hỗ trợ nặng ở khía cạnh kia, vì classifier không bảo vệ trước việc mô hình đi chệch hướng, mà bảo vệ trước việc người dùng khai thác được điều gì đó có hại từ mô hình.

Fable 5 là mô hình lớp Mythos mang hệ thống classifier nặng hơn trong hai mô hình. Classifier của Fable 5 bao phủ ba mảng, và khi kích hoạt, yêu cầu sẽ được chuyển về Opus 4.8: an ninh mạng (cả khai thác lẫn các tác vụ tấn công mạng rộng hơn đều bị chặn, khiến hiệu năng của Fable 5 trên eval cyber về 0% khi classifier hoạt động), sinh học và hóa học (phần lớn yêu cầu liên quan mặc định được chuyển về Opus 4.8), và distillation (các yêu cầu bị đánh dấu là nỗ lực trích xuất năng lực của Fable 5 sẽ bị định tuyến khác đi). Anthropic điều chỉnh các classifier này khá thận trọng: dữ liệu ban đầu cho thấy hơn 95% phiên làm việc với Fable 5 không kích hoạt bất kỳ fallback nào.

Opus 5 mang một phiên bản nhẹ hơn của cùng hệ thống. Classifier cyber của Opus 5 cho phép tìm lỗ hổng trong source code nhưng chặn quét dựa trên binary, penetration testing, và sinh exploit, và Anthropic kỳ vọng chúng sẽ kích hoạt ít hơn khoảng 85% so với Fable 5.

Trên audit hành vi tự động, Opus 5 đạt điểm 2,3 về hành vi lệch chuẩn, mức mà Anthropic gọi là mô hình có alignment tốt nhất từ trước đến nay, vượt cả Opus 4.8, Sonnet 5 và Fable 5.

Infinity nhận định đây là một sự phân nhánh, không phải một bảng điểm phân định thắng thua. Với coding tổng quát, công việc tri thức và computer-use, Opus 5 là mô hình có alignment tốt, ít gây cản trở hơn. Còn ở biên giới của một lĩnh vực được giám sát chặt, như nghiên cứu bảo mật tấn công hay sinh học dài hạn, Fable 5 (hoặc Mythos 5 qua Cyber Verification Program) là công cụ mạnh hơn, và hành vi từ chối nặng hơn chính là cái giá để tiếp cận năng lực đó.

Giá thực tế phải trả cho Opus 5 và Fable 5

Fable 5 có giá đúng gấp đôi Opus 5 ở cả input lẫn output. Fast mode của Opus 5, chạy với tốc độ gấp khoảng 2,5 lần mặc định, có giá 10 USD input và 50 USD output, đúng bằng mức giá tiêu chuẩn của Fable 5.

Mức giá Opus 5 Fable 5
Input, mỗi triệu token 5,00 USD 10,00 USD
Output, mỗi triệu token 25,00 USD 50,00 USD
Input Fast mode, mỗi triệu token 10,00 USD Không áp dụng
Output Fast mode, mỗi triệu token 50,00 USD Không áp dụng

Cả hai mô hình đều dùng chung tokenizer mới hơn của Anthropic, xuất hiện cùng thế hệ Opus 4.7, nên cùng một văn bản sẽ tốn số lượng token input như nhau trên cả hai mô hình, và chưa nhà cung cấp nào công bố một so sánh số lượng token có kiểm soát giữa hai mô hình cho cùng một tác vụ.

Khối lượng hàng tháng Opus 5 Fable 5 Chênh lệch
Nhẹ: 1 triệu token in / 250.000 token out 11,25 USD 22,50 USD Opus 5 tiết kiệm 11,25 USD (50%)
Nặng: 100 triệu token in / 25 triệu token out 1.125 USD 2.250 USD Opus 5 tiết kiệm 1.125 USD (50%)

Ở mức workload nặng, đó là chênh lệch 1.125 USD mỗi tháng cho một tính năng production hoặc một agent chạy liên tục, và benchmark cho thấy không phải đánh đổi gì về coding hay công việc tri thức để có được khoản tiết kiệm đó.

Pricing comparison

Tuy vậy, nên xem các con số tổng này như một so sánh mức giá hơn là một dự báo chi phí chính xác. Opus 5 có thể tốn hơn Opus 4.8 trong thực tế vì có xu hướng sinh ra nhiều thinking token hơn, nhưng điều này không thay đổi bức tranh chung: Opus 5 vẫn sẽ là mô hình rẻ hơn đáng kể trong phần lớn trường hợp.

Khi nào nên chọn Opus 5, khi nào nên chọn Fable 5?

Với phần lớn người đọc, đây là một quyết định ngắn gọn: Opus 5 là lựa chọn mặc định, còn Fable 5 là ngoại lệ.

Trường hợp sử dụng Khuyến nghị Lý do
Coding agent cấp repository Opus 5 Ngang bằng hoặc vượt Fable 5 trên SWE-bench, dẫn đầu Frontier-Bench với chi phí bằng một nửa
Công việc tri thức và phân tích hàng ngày Opus 5 Elo GDPval-AA v2 cao hơn (1.861 so với 1.747) với giá bằng một nửa
Workload production khối lượng lớn Opus 5 Khoản tiết kiệm 50% cộng dồn vượt 1.000 USD/tháng ở tầng nặng
Bài toán mới lạ và reasoning trừu tượng Opus 5 Điểm ARC-AGI 3 đạt 30,2%, gấp ba mô hình tốt thứ nhì
Nghiên cứu sinh học tự động chạy dài hạn Fable 5 Năng lực lớp Mythos vẫn mạnh hơn cho công việc cụ thể này
Workflow cần cơ chế an toàn bao phủ rộng Fable 5 Classifier bao phủ cyber, sinh học và distillation rộng hơn

Nên chọn Opus 5 nếu:

  • Đang xây dựng công cụ coding hoặc agentic và muốn hiệu năng tốt nhất tính theo mỗi đô la, vì mô hình này vượt Fable 5 trên Frontier-Bench và hòa trên SWE-bench.
  • Đang chạy workload khối lượng lớn nơi mức giảm giá 50% chuyển thành ngân sách thực chất, và benchmark xác nhận không mất gì về chất lượng.
  • Muốn mô hình có alignment tốt nhất hiện có, dựa trên điểm audit hành vi lệch chuẩn 2,3, tốt nhất từ trước đến nay của Anthropic.
  • Cần hành vi từ chối nhẹ hơn cho nghiên cứu bảo mật hợp pháp, vì classifier của mô hình này kích hoạt ít hơn khoảng 85% so với Fable 5.

Decision guide

Nên chọn Fable 5 nếu:

  • Công việc là nghiên cứu sinh học tự động chạy dài hạn, lĩnh vực duy nhất Anthropic cho biết năng lực lớp Mythos vẫn dẫn đầu.
  • Hoặc cần cụ thể độ bao phủ classifier rộng hơn trên cả cyber, sinh học và distillation mà hệ thống an toàn của Fable 5 cung cấp.

Infinity khuyến nghị dùng Opus 5 trừ khi có lý do cụ thể để không làm vậy. Mô hình này ngang bằng hoặc vượt Fable 5 trên coding, thắng benchmark Elo về công việc tri thức, gấp ba lần cả nhóm về reasoning mới lạ, và làm tất cả những điều đó với chi phí chỉ bằng một nửa trong khi đạt điểm alignment tốt nhất của Anthropic.

Fable 5 rõ ràng không phải một mô hình tệ. Chỉ là không được xây dựng cho phần lớn công việc mà các đội ngũ thực sự làm. Mô hình mang cơ chế an toàn nặng hơn và giữ lợi thế thực chất ở biên giới công việc tự động chạy dài hạn như nghiên cứu sinh học, nhưng ngoài mảng hẹp đó, trả gấp đôi cho Fable 5 đồng nghĩa trả gấp đôi để đạt điểm số thấp hơn một chút trên các benchmark quan trọng cho coding và phân tích.

Bắt đầu với Claude Opus 5 và Claude Fable 5 như thế nào?

Cả hai mô hình đều khả dụng rộng rãi trên các ứng dụng Claude, API, các nền tảng cloud lớn, và các coding agent của Anthropic. Khác biệt thực tế khá hẹp và chủ yếu thể hiện ở cấp độ gói dịch vụ dành cho người dùng phổ thông.

Nền tảng Opus 5 Fable 5
Ứng dụng người dùng phổ thông Ứng dụng Claude (bao gồm trong Pro, Max, Team, Enterprise; mặc định trên Max, mạnh nhất trên Pro) Ứng dụng Claude (Max & Team Premium: bao gồm, giới hạn 50% mỗi tuần; Pro & Team Standard: chỉ dùng usage credit)
API chính chủ Anthropic API Anthropic API
Nền tảng cloud Amazon Bedrock, Vertex AI, Microsoft Foundry Amazon Bedrock, Vertex AI, Microsoft Foundry
Coding agent Claude Code, Claude Cowork Claude Code, Claude Cowork
Model ID trên API claude-opus-5 claude-fable-5

Khoảng cách rõ ràng nhất: trên gói Pro và Team Standard, Fable 5 hoàn toàn không được bao gồm. Mô hình này chạy theo usage credit trả tiền theo mức sử dụng ở giá API, trong khi Opus 5 được bao gồm sẵn trong các gói đó.

Dùng Opus 5 và Fable 5 trong coding agent như thế nào?

Cả hai mô hình đều chọn được trong Claude Code, chuyển đổi giữa chúng chỉ là thay đổi model string trong request hoặc cấu hình agent. Vì chia sẻ chung SDK, việc chuyển một agent đang hoạt động từ mô hình này sang mô hình kia chỉ là một dòng thay đổi:

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-opus-5",  # đổi thành "claude-fable-5"
    max_tokens=1024,
    messages=[{"role": "user", "content": "Refactor this function..."}],
)
print(response.content.text)

Lưu ý: Opus 5 mặc định trả về thinking block, nên truy cập trực tiếp response.content.text có thể gây lỗi AttributeError khi block đầu tiên là thinking block.

Kết luận

Infinity nhận thấy điều đáng chú ý nhất là so sánh này đảo ngược logic tầng mô hình thông thường. Thông thường, mô hình mới hơn, rẻ hơn sẽ đánh đổi một phần năng lực để lấy khả năng tiếp cận. Ở đây, Anthropic phát hành một mô hình rẻ hơn nhưng cũng là lựa chọn năng lực tốt hơn cho gần như mọi tác vụ phổ thông, điều này gợi ý mức giá của Fable 5 đang mua nhiều hơn cho vị thế an toàn và huyết thống Mythos của nó, hơn là hiệu năng thuần túy.

Nguồn: Infinity - đơn vị cung cấp giải pháp Digital Marketing tích hợp cho doanh nghiệp — từ thiết kế website chuẩn SEO & UX/UI, dịch vụ AI SEO (GEO/AEO), PR Digital, sáng tạo nội dung số, quảng cáo trực tuyến (SEM/Ads) đến phân tích dữ liệu Marketing. Với nền tảng nghiên cứu và dữ liệu thực chiến, chúng tôi giúp doanh nghiệp xây dựng chiến lược thương hiệu bền vững và tăng trưởng có hệ thống trong kỷ nguyên AI.


All rights reserved

Viblo
Hãy đăng ký một tài khoản Viblo để nhận được nhiều bài viết thú vị hơn.
Đăng kí