Claude Opus 5 nâng mạnh hiệu năng lập trình và xử lý công việc
Anthropic đã chính thức phát hành Claude Opus 5 trên các nền tảng của hãng. Mô hình AI mới được định hướng phục vụ các tác vụ lập trình, tự động hóa quy trình doanh nghiệp, nghiên cứu khoa học và điều khiển máy tính với hiệu quả cao hơn.
![]() |
| Claude Opus 5 ra mắt, AI lập trình mạnh hơn nhưng vẫn giữ nguyên giá |
Claude Opus 5 vẫn giữ nguyên mức giá 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra, tương tự Claude Opus 4.8. Người dùng cũng có thể lựa chọn chế độ xử lý nhanh hơn với tốc độ tăng khoảng 2,5 lần, nhưng chi phí sẽ gấp đôi.
Theo Anthropic, Claude Opus 5 được thiết kế để trở thành mô hình AI sử dụng hằng ngày thay vì chỉ phục vụ các tác vụ tính toán chuyên sâu. Ở nhiều bài kiểm tra chuẩn, Claude Opus 5 cho thấy sự cải thiện đáng kể. Trên Frontier-Bench v0.1 dành cho kỹ thuật phần mềm, mô hình đạt hiệu năng cao gấp đôi Claude Opus 4.8 với chi phí xử lý thấp hơn. Trong bài kiểm tra CursorBench 3.2, Claude Opus 5 chỉ kém 0,5% so với mô hình dẫn đầu nhưng chi phí chỉ bằng một nửa.
Khả năng giải quyết các vấn đề mới cũng được nâng lên rõ rệt khi Claude Opus 5 đạt điểm số trên ARC-AGI 3 cao gấp ba lần mô hình đứng thứ hai. Trên Zapier AutomationBench, mô hình hoàn thành các tác vụ kinh doanh với tỷ lệ thành công cao hơn khoảng 1,5 lần so với đối thủ trong khi mức chi phí tương đương.
Ở bài kiểm tra OSWorld 2.0 về khả năng điều khiển máy tính, Claude Opus 5 tiếp tục vượt qua nhiều hệ thống AI khác và đạt kết quả cao hơn Claude Fable 5 với chi phí chỉ hơn một phần ba.
Cải thiện nghiên cứu khoa học, tăng cường an toàn AI
Anthropic cũng ghi nhận nhiều cải tiến trong nghiên cứu khoa học, đặc biệt ở lĩnh vực khoa học sự sống. Trong bài kiểm tra nội bộ về hóa học hữu cơ, Claude Opus 5 đạt điểm cao hơn Claude Opus 4.8 tới 10,2 điểm phần trăm khi suy luận cấu trúc phân tử từ dữ liệu quang phổ. Với các bài toán liên quan đến ảnh hưởng của biến đổi trình tự protein đối với chức năng sinh học, mô hình cũng cải thiện thêm 7,7 điểm phần trăm.
Theo Anthropic, Claude Opus 5 có khả năng tự kiểm tra kết quả, tự điều chỉnh phương pháp và thử lại nhiều lần nếu cách tiếp cận ban đầu chưa hiệu quả. Trong một thử nghiệm, mô hình đã tự xây dựng quy trình thị giác máy tính để trích xuất dữ liệu từ ảnh và dựng thành công chi tiết máy dưới dạng mô hình 3D trên phần mềm FreeCAD, trong khi các mô hình cạnh tranh đều thất bại trong cùng điều kiện.
Về an toàn, Anthropic cho biết Claude Opus 5 là mô hình tuân thủ các nguyên tắc an toàn tốt nhất của hãng hiện nay, với tỷ lệ hành vi lừa dối thấp hơn nhiều mô hình gần đây. Tuy nhiên, để hạn chế rủi ro trong lĩnh vực an ninh mạng, Anthropic đã tăng cường cơ chế kiểm soát đối với các yêu cầu như quét lỗ hổng, kiểm thử xâm nhập và tạo mã khai thác. Những tác vụ này sẽ được hệ thống tự động chuyển sang Claude Opus 4.8 xử lý.
Cùng thời điểm ra mắt Claude Opus 5, Anthropic cũng giới thiệu thêm một số tính năng thử nghiệm dành cho nhà phát triển, trong đó có khả năng thay đổi công cụ ngay trong cuộc hội thoại mà không làm mất bộ nhớ đệm của prompt và tự động chuyển các yêu cầu API nhạy cảm sang mô hình khác để xử lý. Hiện Claude Opus 5 đã trở thành mô hình mặc định dành cho người dùng gói Claude Max và là mô hình mạnh nhất mà người dùng gói Claude Pro có thể sử dụng.