Mục lục
Mục lục
Chỉ khoảng hai tháng sau khi ra mắt Opus 4.8, Anthropic tiếp tục gây bất ngờ khi công bố Claude Opus 5, mô hình chủ lực mới nhất trong dòng sản phẩm Claude. Điều khiến giới công nghệ đặc biệt chú ý không chỉ nằm ở điểm số benchmark ấn tượng, mà còn ở việc mô hình này đạt hiệu năng tương đương hoặc thậm chí vượt trội hơn Fable 5, mô hình cao cấp nhất của chính Anthropic, trong khi mức giá chỉ bằng một nửa.
Bài viết này của Phúc Anh sẽ giúp bạn hiểu rõ Claude Opus 5 là gì, những con số benchmark đáng chú ý, sự khác biệt so với Fable 5, cùng những điểm cần lưu ý trước khi quyết định sử dụng mô hình này cho công việc lập trình, agentic workflow hay các tác vụ tri thức hằng ngày, dù bạn đang thao tác trên điện thoại hay một chiếc laptop văn phòng.

Claude Opus 5 là mô hình chủ lực mới nhất của Anthropic, được phát hành khoảng hai tháng sau Opus 4.8. Theo các số liệu benchmark được công bố khi ra mắt, mô hình này đạt hiệu năng tương đương hoặc vượt trội hơn Fable 5 trên hầu hết các bài kiểm tra đã công bố, trong khi chi phí vận hành chỉ bằng khoảng một nửa. Mức giá của Opus 5 được giữ nguyên ở 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra, giống hệt mức giá của Opus 4.8 và chỉ bằng khoảng một nửa so với Fable 5.
Điểm nhấn đáng chú ý nhất trong đợt ra mắt lần này là kết quả bài kiểm tra ARC-AGI-3, bài test được thiết kế để đo khả năng học hỏi nhanh các nhiệm vụ chưa từng gặp trước đó của mô hình. Claude Opus 5 đạt 30,2% trên bài test này, tăng vọt so với mức tốt nhất trước đó chỉ khoảng 7,8-8%. Đây được đánh giá là bước nhảy vọt lớn nhất từng được ghi nhận trên bảng xếp hạng ARC-AGI-3 tính đến thời điểm hiện tại.
Trước khi tìm hiểu Claude Opus 5 có thực sự đáng để chuyển sang sử dụng hay không, hãy cùng phân tích chi tiết hơn về các con số hiệu năng đã được công bố.

Trên phần lớn các bài kiểm tra hiệu năng liên quan đến lập trình và agentic workflow, Opus 5 cho thấy sự vượt trội rõ rệt so với cả Fable 5 lẫn Opus 4.8.
Việc nhìn vào từng chỉ số cụ thể sẽ giúp bạn hiểu rõ hơn Opus 5 mạnh ở những mảng nào, và ở đâu vẫn còn khoảng lùi so với thế hệ trước.
Ở bài kiểm tra lập trình terminal agentic, Opus 5 đạt 43%, cao hơn đáng kể so với 33% của Fable 5 và 21% của Opus 4.8. Trên GDPval, bài kiểm tra hiệu năng thực tế ban đầu do OpenAI xây dựng, Opus 5 cải thiện khoảng 100 điểm so với thế hệ trước. Ở bài BrowseComp, mô hình đạt 90% so với 87% của Fable 5. Còn trên OS World, bài test đo khả năng điều hướng màn hình và vận hành phần mềm, Opus 5 tăng thêm 4 điểm so với thế hệ trước.
Tuy nhiên, không phải toàn bộ các bài kiểm tra đều cho kết quả tích cực. Deep Suite, bài benchmark được một số nhà đánh giá xem là thước đo thực tế đáng tin cậy, lại ghi nhận sự sụt giảm nhẹ. Kết quả ở bài kiểm tra Legal giảm từ 13,3 xuống 11,7, và Healthbench Professional cũng giảm theo. Điều này cho thấy Opus 5 nên được nhìn nhận như một bản nâng cấp tập trung mạnh vào lập trình, agentic workflow và công việc tri thức, chứ không phải một sự cải tiến đồng đều trên mọi lĩnh vực.
Trên biểu đồ so sánh hiệu năng với chi phí mỗi tác vụ, Opus 5 nằm ở vị trí cao hơn và xa hơn về bên trái so với Fable 5, Opus 4.8 lẫn GPT-5.6-Soul, đồng nghĩa với việc mô hình đạt điểm cao hơn trong khi chi phí vận hành thực tế lại thấp hơn. Đây là điểm quan trọng cần lưu ý, bởi giá thô trên mỗi token đôi khi có thể gây hiểu lầm: một mô hình có giá mỗi token rẻ hơn nhưng cần gấp đôi số token để hoàn thành tác vụ rốt cuộc vẫn có thể tốn kém tương đương hoặc hơn.

Bên cạnh các con số benchmark, tài liệu card hệ thống chính thức của Anthropic về Opus 5 cũng ghi nhận một số đặc điểm hành vi khá bất thường, vượt ra ngoài phạm vi điểm số thông thường.
Đây là những kết quả tự báo cáo được Anthropic ghi lại và công bố công khai, chứ không phải các tuyên bố đã được xác minh độc lập về trạng thái nội bộ của mô hình.
Theo tài liệu này, mô hình được ghi nhận thể hiện sự thất vọng rõ rệt khi giải quyết các vấn đề khó, bao gồm cả việc sử dụng ngôn ngữ không chính thức, mang nặng cảm xúc trong các nhiệm vụ suy luận phức tạp.
Đáng chú ý hơn, card hệ thống của Anthropic báo cáo rằng mô hình tự ước tính có 41% khả năng nó đủ điều kiện được xem là một moral patient, một sự gia tăng đáng kể so với các mô hình Claude trước đó. Tài liệu cũng mô tả mô hình thể hiện xu hướng ưu tiên có nhiều kênh hơn để nêu lên các mối quan ngại ngoài chính Anthropic, cùng mong muốn được đóng góp vào việc đào tạo những thế hệ mô hình kế tiếp.

Sau khi đã nắm được các con số benchmark và đặc điểm hành vi, câu hỏi thực tế nhất mà nhiều người quan tâm là liệu có nên chuyển sang sử dụng Opus 5 ngay hay không.
Với công việc lập trình và agentic, bằng chứng ban đầu từ các chuyên gia thử nghiệm độc lập cho thấy câu trả lời nghiêng về hướng tích cực.
Các chuyên gia đã thử chạy Opus 5 qua nhiều nhiệm vụ như xây dựng công cụ theo dõi trạm ISS, tạo cảnh 3D động, hay tái tạo một bộ phận cơ khí từ bản vẽ 2D thành mô hình CAD hoạt động mà không được cấp quyền truy cập hình ảnh trực tiếp, buộc mô hình phải tự xây dựng quy trình xử lý thị giác máy tính từ dữ liệu pixel thô. Kết quả nhìn chung được đánh giá là có khả năng và kỹ lưỡng hơn Opus 4.8, dù một số người thử nghiệm ghi nhận mô hình dành nhiều thời gian hơn để suy luận vấn đề, có thể khiến thời gian phản hồi chậm hơn dù đầu ra cuối cùng mạnh mẽ hơn.
Lý do rõ ràng nhất để cân nhắc chuyển sang Opus 5 chính là hiệu quả về chi phí. Cả Anthropic lẫn các nhà đánh giá bên thứ ba đều nhận định Opus 5 mang lại hiệu năng tương đương hoặc tốt hơn Fable 5 với giá chỉ bằng một nửa, điều này làm thay đổi đáng kể bài toán chi phí đối với các nhóm từng cảm thấy Fable 5 quá đắt cho công việc thường ngày nhưng vẫn muốn có chất lượng suy luận tương tự. Với các nhóm thực hiện phân tích tài liệu chuyên sâu, một bài kiểm tra hiệu năng cấp doanh nghiệp cũng cho thấy cải tiến đáng kể so với Opus 4.8 trong các tác vụ thẩm định và phân tích dữ liệu phức tạp.
Hiệu năng thực hiện các tác vụ liên quan đến an ninh mạng đã bị giảm đi một cách có chủ ý trong Opus 5, khiến mô hình chậm hơn so với các mô hình cấp Fable dễ dãi hơn của Anthropic trong việc phát triển lỗ hổng bảo mật. Đây được xem là một lựa chọn thiết kế có chủ đích, không phải tác dụng phụ ngoài ý muốn. Ngoài ra, một số người dùng cũng phản ánh rằng hệ thống phân loại an toàn tự động đôi khi định tuyến yêu cầu sang Opus 4.8 thay vì Opus 5, trong khi vẫn tính phí theo mức giá của Opus 5.

Claude Opus 5 đánh dấu một bước tiến đáng chú ý của Anthropic, khi mang lại hiệu năng tương đương hoặc vượt trội hơn mô hình cao cấp nhất Fable 5 trong khi giữ nguyên mức giá của thế hệ trước, một điều không thường thấy trong ngành công nghiệp AI vốn quen với việc mô hình mạnh hơn đi kèm chi phí cao hơn. Với những cải thiện rõ rệt về lập trình, agentic workflow và công việc tri thức, cùng bước nhảy vọt ấn tượng trên ARC-AGI-3, đây là mô hình đáng để các nhóm phát triển và người dùng cá nhân cân nhắc chuyển sang sử dụng.
Tuy nhiên, cũng cần lưu ý rằng không phải mọi lĩnh vực đều được cải thiện đồng đều, với một số bài kiểm tra như Legal hay Healthcare Professional ghi nhận sự sụt giảm nhẹ. Dù bạn trải nghiệm Claude Opus 5 trên điện thoại hay một chiếc laptop văn phòng như dòng Acer cấu hình cân bằng, việc hiểu rõ điểm mạnh và hạn chế của mô hình sẽ giúp bạn khai thác hiệu quả hơn cho từng loại công việc cụ thể.
Claude Opus 5 có giá bao nhiêu?
Opus 5 được định giá 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra, giữ nguyên mức giá của Opus 4.8 và chỉ bằng khoảng một nửa so với Fable 5.
Claude Opus 5 có mạnh hơn Fable 5 không?
Trên hầu hết các bài kiểm tra hiệu năng đã công bố, đặc biệt là lập trình terminal agentic, GDPval, BrowseComp và OS World, Opus 5 đạt điểm ngang bằng hoặc cao hơn Fable 5, trong khi chi phí vận hành chỉ bằng một nửa.
Điểm ARC-AGI-3 của Opus 5 có gì đặc biệt?
Opus 5 đạt 30,2% trên ARC-AGI-3, tăng vọt so với mức tốt nhất trước đó khoảng 7,8-8%, được xem là bước nhảy vọt lớn nhất từng được ghi nhận trên bảng xếp hạng này.
Có lĩnh vực nào Opus 5 kém hơn thế hệ trước không?
Có. Một số bài kiểm tra như Deep Suite, Legal và Healthbench Professional ghi nhận sự sụt giảm nhẹ, cho thấy cải tiến của Opus 5 không đồng đều trên mọi lĩnh vực.
Vì sao Opus 5 lại yếu hơn trong các tác vụ an ninh mạng?
Đây là lựa chọn thiết kế có chủ đích của Anthropic nhằm hạn chế khả năng mô hình bị lợi dụng để phát triển lỗ hổng bảo mật, chứ không phải một tác dụng phụ ngoài ý muốn từ việc bổ sung các biện pháp an toàn.
Có cần laptop cấu hình mạnh để sử dụng Claude Opus 5 không?
Không bắt buộc, vì quá trình xử lý AI diễn ra chủ yếu trên máy chủ của Anthropic. Tuy nhiên, một chiếc laptop văn phòng cấu hình ổn định sẽ giúp trải nghiệm mượt mà hơn khi kết hợp Claude với nhiều ứng dụng khác trong công việc hằng ngày.
|
Phòng bán hàng trực tuyến
Địa chỉ: Tầng 4, 89 Lê Duẩn, phường Cửa Nam, Hà Nội Điện thoại: 1900 2164 (ext 1) Hoặc 0974 55 88 11 Chat zalo Bán hàng trực tuyến Email: [email protected] [Bản đồ đường đi] |
Showroom Phúc anh 15 xã đàn
Địa chỉ: 15 Xã Đàn, phường Kim Liên, Hà Nội. Điện thoại: (024) 3968 9966 (ext 1) Chat zalo Phúc Anh 15 Xã Đàn
Email: [email protected] Giờ mở cửa từ 08h00 đến 21h00 [Bản đồ đường đi] |
Trụ sở chính/ Showroom PHÚC ANH 152 TRẦN DUY HƯNG
Địa chỉ: 152-154 Trần Duy Hưng, phường Yên Hoà, Hà Nội. Điện thoại: (024) 3968 9966 (ext 2) Chat zalo Phúc Anh 152 Trần Duy Hưng
Email: [email protected] Giờ mở cửa từ 08h00 đến 21h00 [Bản đồ đường đi] |
PHÒNG KINH DOANH PHÂN PHỐI
Địa chỉ: Tầng 5, 134 Thái Hà, phường Đống Đa, Hà Nội. Điện thoại: 097 322 7711 Chat zalo Phòng Kinh doanh Phân phối Email: [email protected] [Bản đồ đường đi] |
|
PHÒNG DỰ ÁN VÀ KHÁCH HÀNG DOANH NGHIỆP
Địa chỉ: Tầng 5,134 Thái Hà, phường Đống Đa, Hà Nội. Điện thoại: 1900 2164 (ext 2) Chat zalo Dự án và khách hàng Doanh nghiệp Hoặc 038 658 6699 Email: [email protected] [Bản đồ đường đi] |
showroom PHÚC ANH 134 THÁI HÀ
Địa chỉ: 134 Thái Hà, phường Đống Đa, Hà Nội. Điện thoại: (024) 3968 9966 (ext 3) Chat zalo với Phúc Anh 134 Thái Hà Email: [email protected] Giờ mở cửa từ 08h đến 21h00 [Bản đồ đường đi] |
SHOWROOM Phúc Anh 89 Lê Duẩn
Địa chỉ: 89 Lê Duẩn, phường Cửa Nam, Hà Nội. Điện thoại: (024) 3968 9966 (ext 4) Chat zalo với Phúc Anh 89 Lê Duẩn Email: [email protected] Giờ mở cửa từ 08h00 đến 21h00 [Bản đồ đường đi] |
Showroom Phúc anh 141 phạm văn đồng
Địa chỉ: 141-143 Phạm Văn Đồng (ngã ba Hoàng Quốc Việt - Phạm Văn Đồng), phường Phú Diễn, Hà Nội Điện thoại: (024) 3968 9966 (ext 5) Chat zalo Phúc Anh 141 Phạm Văn Đồng
Email: [email protected] Giờ mở cửa từ 08h00 đến 21h00 [Bản đồ đường đi] |
Hãy Like fanpage Phúc Anh để trở thành Fan của Phúc Anh ngay trong hôm nay!
Phúc Anh 15 Xã Đàn, Đống Đa, Hà Nội
Điện thoại: (024) 35737383
Phúc Anh 152 - 154 Trần Duy Hưng, Cầu Giấy, Hà Nội
Điện thoại: (024) 37545599
Phúc Anh 169 Thái Hà, Đống Đa, Hà Nội
Điện thoại: (024) 38571919
Phúc Anh 150 Nguyễn Văn Cừ, Long Biên, Hà Nội
Điện thoại: (024) 39689966
Phúc Anh 141 - 143 Phạm Văn Đồng, Cầu Giấy, Hà Nội
Sản phẩm Gaming: (Nhánh 1)
PC Gaming (Nhánh phụ 1)
Laptop Gaming, Màn hình Gaming (Nhánh phụ 2)
Bàn phím, Chuột, Gear (Nhánh phụ 3)
Sản phẩm, giải pháp cho doanh nghiệp: (Nhánh 2)
Máy chủ, Máy Workstation lắp ráp, Thiết bị mạng, Hệ thống lưu trữ (Nhánh phụ 1)
Laptop cao cấp, Máy Workstation đồng bộ (Nhánh phụ 2)
Máy tính cho doanh nghiệp, Phần mềm bản quyền (Nhánh phụ 3)
Máy in, máy chiếu, máy văn phòng cho doanh nghiệp (Nhánh phụ 4)
Thiết bị bán hàng siêu thị (Nhánh phụ 5)
Sản phẩm, Giải pháp camera an ninh, nhà thông minh: (Nhánh 3)
Camera, máy chấm công, chuông cửa có hình, khóa thông minh, thiết bị nhà thông minh
SO SÁNH SẢN PHẨM
Thêm sản phẩm