Claude Opus 5 với Claude Sonnet 5: So sánh chi tiết và khuyến nghị lựa chọn
Opus 5 có giá 5 USD/triệu input token và 25 USD/triệu output token, ra mắt ngày 24/7/2026, trong khi Sonnet 5 có giá 2 USD/triệu input token và 10 USD/triệu output token đến hết 31/8/2026, sau đó tăng lên 3 USD/15 USD tiêu chuẩn.
Tóm tắt các điểm chính
- Anthropic chưa công bố benchmark so sánh trực tiếp Opus 5 với Sonnet 5. Mỗi bài ra mắt chỉ so sánh với chính phiên bản tiền nhiệm của nó và với Opus 4.8.
- Opus 5 là mô hình cao cấp nhất, mặc định trên Claude Max và là mô hình mạnh nhất trên Claude Pro, đặc trưng bởi khả năng tự kiểm chứng công việc.
- Sonnet 5 là mô hình tầm trung, mặc định trên gói Free và Pro, được Anthropic mô tả là Sonnet có tính agentic cao nhất từ trước đến nay.
- Trong audit về mức độ tuân thủ Constitution, Opus 5 đạt điểm 2.3, an toàn nhất từ trước đến nay, vượt cả Sonnet 5 và Fable 5.
- Về bảo mật mạng, Sonnet 5 đạt 0.0% thành công trong việc tạo exploit hoàn chỉnh trên Firefox eval, trong khi Opus 5 gần tiệm cận Mythos 5 ở khả năng phát hiện lỗ hổng.
Tổng quan Claude Opus 5
Opus 5 là mô hình cao cấp nhất của Anthropic, ra mắt ngày 24/7/2026, với giá 5 USD/triệu input token và 25 USD/triệu output token. Anthropic gọi đây là mô hình state-of-the-art trên Frontier-Bench và GDPval-AA, đồng thời gần tiệm cận mô hình Fable 5 lớn hơn với chỉ một nửa chi phí. Opus 5 là mô hình mặc định trên Claude Max và là mô hình mạnh nhất khả dụng trên Claude Pro.
Đặc điểm nổi bật nhất của Opus 5 là khả năng tự kiểm chứng: tự kiểm tra công việc của chính mình, tự xây dựng test harness khi không có sẵn nguồn dữ liệu để đối chiếu, và phản biện lại các chỉ dẫn sai thay vì tuân theo một cách mù quáng.
Tổng quan Claude Sonnet 5
Sonnet 5 là mô hình tầm trung của Anthropic, ra mắt ngày 30/6/2026, với giá 2 USD/triệu input token và 10 USD/triệu output token đến hết 31/8/2026, sau đó tăng lên 3 USD/15 USD tiêu chuẩn. Anthropic mô tả đây là Sonnet có tính agentic cao nhất từ trước đến nay, với hiệu năng gần tiệm cận Opus 4.8 nhưng ở mức giá thấp hơn nhiều.
Sonnet 5 là mô hình mặc định trên gói Free và Pro, đồng thời khả dụng trên Max, Team, Enterprise và API.
Sự khác biệt giữa hai tier Opus và Sonnet nằm ở đâu?
Opus là mô hình dành cho những tác vụ mà sai sót gây tốn kém, chạy dài và tự động mà không có ai kiểm tra giữa chừng, hoặc thực sự mới lạ thay vì một biến thể của thứ mô hình đã thấy hàng nghìn lần. Đây là logic chung trong toàn bộ dòng sản phẩm Anthropic, không riêng cho cặp Opus 5 và Sonnet 5.
-
Opus phù hợp cho việc refactor sâu nhiều file, các câu hỏi nghiên cứu mơ hồ, các chuỗi vận hành agentic dài nơi lỗi có thể tích lũy dồn lại. Chi phí trả thêm ở đây đổi lấy việc mô hình tự bắt lỗi trước khi lỗi đó trở thành vấn đề của người dùng.
-
Sonnet được xây dựng để nhanh và đủ rẻ nhằm chạy liên tục: chat assistant, phân loại khối lượng lớn, coding lặp đi lặp lại nơi người dùng vẫn theo dõi và duyệt sau mỗi vài bước, hay các ứng dụng nhạy cảm về độ trễ. Trần khả năng phán đoán của Sonnet thấp hơn, nhưng với phần lớn công việc thực tế, người dùng gần như không chạm tới trần đó.
Sonnet 5 cụ thể là nỗ lực của Anthropic nhằm đẩy trần đó cao hơn mức thông thường của một mô hình tầm trung, đây chính là điểm đáng chú ý nhất trong lần ra mắt này.
Các con số công bố thực sự cho thấy điều gì?
Sonnet 5 có giá bằng 40 đến 60% so với Opus 5 tùy thời điểm áp dụng, đây là điểm khác biệt rõ ràng và ít mơ hồ nhất giữa hai mô hình. Ngoài giá, ba yếu tố khác đáng chú ý:
-
Về alignment: Đây là nơi duy nhất hai bài công bố nhắc trực tiếp đến nhau. Audit tự động của Anthropic cho thấy Opus 5 tuân thủ Constitution của Claude tốt hơn cả Opus 4.8, Sonnet 5 lẫn Fable 5, đạt điểm 2.3, an toàn nhất từ trước đến nay. Sonnet 5 có cải thiện so với chính phiên bản tiền nhiệm (giảm hallucination, giảm sycophancy, chống chịu tốt hơn với các cuộc tấn công prompt-injection), nhưng Anthropic ghi nhận Sonnet 5 vẫn có tỷ lệ hành vi lệch chuẩn cao hơn Opus 4.8.
-
Về bảo mật mạng: Cả hai mô hình đều không được huấn luyện chuyên sâu cho mục đích tấn công mạng, nhưng vị trí của chúng khác nhau rõ rệt. Opus 5 gần tiệm cận Mythos 5 ở khả năng phát hiện lỗ hổng, dù vẫn còn thua kém ở khả năng biến lỗ hổng đó thành exploit hoàn chỉnh. Sonnet 5 ở vị trí xa hơn: Anthropic nói thẳng rằng Sonnet 5 có năng lực bảo mật mạng kém hơn đáng kể so với Opus 4.8 và Mythos 5, và trên một eval phát triển exploit cho Firefox, Sonnet 5 chưa từng tạo ra được exploit hoàn chỉnh nào, đạt 0.0% thành công, chỉ nhỉnh hơn đôi chút so với Sonnet 4.6 ở các nỗ lực một phần.
-
Về coding và knowledge work: Hai bài công bố dùng bộ benchmark khác nhau nên không có điểm số so sánh trực tiếp. Opus 5 đạt hơn gấp đôi điểm số của Opus 4.8 trên Frontier-Bench v0.1 và chỉ kém Fable 5 0.5% trên CursorBench 3.2 với một nửa chi phí. Sonnet 5 được mô tả là gần tiệm cận Opus 4.8 trên BrowseComp và OSWorld-Verified khi chạy ở mức effort cao.
Infinity đánh giá rằng Sonnet 5 đạt điểm gần với các tác vụ cụ thể mà Anthropic chọn để làm nổi bật, nhưng mức thắng của Opus 5 nhìn chung lớn hơn và rộng hơn. Nên xem đây là chỉ dấu định hướng, không phải một phép đo trực tiếp.
Khi nào nên chọn Opus 5, khi nào nên chọn Sonnet 5?
Nên chọn Opus 5 khi tác vụ có mức độ rủi ro cao, chạy dài, hoặc thực sự mới lạ, đặc biệt trong các lĩnh vực khoa học sự sống, hóa học, hoặc công việc agentic nhiều bước phức tạp. Ngược lại, nên chọn Sonnet 5 khi khối lượng công việc lớn, độ trễ là yếu tố quan trọng, hoặc tác vụ đã được xác định phạm vi đủ rõ để không cần đến trần phán đoán của Opus.
| Trường hợp sử dụng | Khuyến nghị | Lý do |
|---|---|---|
| Refactor sâu nhiều file, codebase lớn | Opus 5 | Khả năng tự kiểm chứng và suy luận kiến trúc vượt trội |
| Câu hỏi nghiên cứu mơ hồ, mới lạ | Opus 5 | Điểm ARC-AGI-3 cao nhất (30,2%) |
| Chat assistant, khối lượng lớn | Sonnet 5 | Giá rẻ, đủ nhanh, đủ thông minh cho tương tác hàng ngày |
| Coding lặp đi lặp lại, có người duyệt | Sonnet 5 | Chi phí thấp, hiệu năng đủ tốt với sự giám sát của con người |
| Công việc khoa học sự sống, hóa học | Opus 5 | Anthropic chỉ rõ Opus 5 vượt trội ở các lĩnh vực này |
| Ứng dụng nhạy cảm độ trễ | Sonnet 5 | Nhanh và rẻ hơn đáng kể |
| Cần alignment tốt nhất hiện có | Opus 5 | Điểm audit 2.3, tốt nhất từ trước đến nay |
| Workflow liên quan bảo mật mạng | Opus 5 | Gần tiệm cận Mythos 5, Sonnet 5 đạt 0% exploit thành công |
| Gói Free hoặc Pro | Sonnet 5 | Mặc định, đã bao gồm trong gói |
Chọn Opus 5 nếu:
- Tác vụ rủi ro cao, chạy dài hoặc mới lạ.
- Công việc thuộc khoa học sự sống, hóa học, hoặc agentic nhiều bước.
- Cần mô hình alignment tốt nhất hiện có.
- Phạm vi công việc có liên quan đến bảo mật mạng.
Chọn Sonnet 5 nếu:
- Khối lượng công việc cao, độ trễ quan trọng, hoặc tác vụ đủ rõ ràng để không cần trần phán đoán của Opus.
- Đang dùng gói Free hoặc Pro nơi Sonnet 5 đã là mặc định.
- Chi phí trên mỗi token là ràng buộc chính.
Không nên dùng cả hai nếu:
- Cần công việc bảo mật mạng với ít rào chắn hơn. Opus 5 sẽ tự động chuyển về Opus 4.8 trong trường hợp này, còn Sonnet 5 vốn đã đứng sau Opus 4.8 hoàn toàn.
Infinity nhận định: Phần lớn quyết định giữa Opus 5 và Sonnet 5 vẫn xoay quanh câu hỏi quen thuộc của mọi lựa chọn Opus và Sonnet: tác vụ có cần đến trần khả năng cao nhất, hay chỉ cần hoàn thành đáng tin cậy ở quy mô lớn. Sonnet 5 đẩy trần đó lên cao hơn các phiên bản Sonnet trước, đây chính là điểm đáng chú ý nhất trong lần ra mắt này. Nhưng ở nơi duy nhất Anthropic đặt hai mô hình lên bàn cân trực tiếp, tức audit alignment, Opus 5 vượt trội hơn, và câu chuyện bảo mật mạng cũng chỉ theo cùng hướng đó. Mặc định dùng Sonnet 5 cho khối lượng lớn, và chỉ chuyển sang Opus 5 khi tác vụ không thể chấp nhận một câu trả lời sai.
Lưu ý: Nội dung nguồn có một vài điểm khác với thông tin sản phẩm Anthropic mà Infinity đang nắm (ví dụ dòng sản phẩm hiện tại của Anthropic gồm Fable 5, Opus 4.8, Sonnet 5, Haiku 4.5, chưa có "Opus 5" trong danh sách này). Nếu cần, Infinity có thể kiểm tra lại thông tin này trước khi xuất bản để đảm bảo độ chính xác về giá và benchmark.
Nguồn: Infinity - đơn vị cung cấp giải pháp Digital Marketing tích hợp cho doanh nghiệp — từ thiết kế website chuẩn SEO & UX/UI, dịch vụ AI SEO (GEO/AEO), PR Digital, sáng tạo nội dung số, quảng cáo trực tuyến (SEM/Ads) đến phân tích dữ liệu Marketing. Với nền tảng nghiên cứu và dữ liệu thực chiến, chúng tôi giúp doanh nghiệp xây dựng chiến lược thương hiệu bền vững và tăng trưởng có hệ thống trong kỷ nguyên AI.
All Rights Reserved