Claude dẫn dắt 26% hoạt động R&D
Trong bài viết trên blog ngày 17/9, Anthropic cho biết công ty đang sử dụng thang đo tự động hóa do Epoch AI phát triển để đánh giá mức độ tham gia của Claude vào quá trình nghiên cứu và phát triển AI. Thang đo này gồm 5 cấp độ, từ AL0 - không có sự tham gia của AI, đến AL5 - AI vận hành hoàn toàn tự chủ và không cần con người can thiệp.
Theo Anthropic, tính đến tháng 8, khoảng 26% hoạt động nghiên cứu và phát triển mô hình đạt AL4, mức được xác định là “AI dẫn dắt”. Ở cấp độ này, Claude có thể hoàn thành phần lớn nhiệm vụ từ đầu đến cuối dựa trên các chỉ dẫn ở cấp độ cao, trong khi con người chủ yếu thực hiện vai trò giám sát.
![]() |
| Claude tham gia phát triển chính phiên bản AI kế nhiệm |
Đáng chú ý, hơn 90% công việc được đo lường đạt AL3, tương ứng với mức “AI hợp tác”. Claude có thể đảm nhiệm những phần việc lớn trong quá trình nghiên cứu nhưng vẫn hoạt động dưới sự hướng dẫn chặt chẽ của con người.
Anthropic nhấn mạnh Claude hiện chưa vận hành hoàn toàn tự chủ trong bất kỳ phần công việc nào được đo lường. Tuy nhiên, mức độ tham gia của AI đã tăng mạnh trong thời gian ngắn. Hồi tháng 3, chỉ khoảng 1% hoạt động R&D của công ty đạt AL4.
Sự thay đổi này cho thấy Claude đang đảm nhiệm ngày càng nhiều công việc trong chính quá trình nghiên cứu, phát triển và cải tiến các mô hình AI của Anthropic.
AI tiến gần khả năng tự cải tiến?
Anthropic cho rằng việc các mô hình AI tham gia ngày càng sâu vào quá trình phát triển chính chúng đặt ra những câu hỏi mới về khả năng con người hiểu và kiểm soát các hệ thống tiên tiến. Công ty cho rằng các phòng thí nghiệm AI cần tăng cường đo lường, công khai dữ liệu và tạo điều kiện để xã hội có thêm thông tin khi thảo luận về cách sử dụng những công nghệ này. Theo Anthropic, việc công khai số liệu về mức độ tự động hóa có thể giúp đánh giá rõ hơn khoảng cách giữa năng lực mà các phòng thí nghiệm AI đang đạt được và những gì công chúng có thể quan sát.
Một vấn đề được Anthropic đặc biệt đề cập là “tự cải tiến đệ quy”, tức khả năng một mô hình AI tham gia phát triển phiên bản kế nhiệm mạnh hơn. Theo công ty, theo dõi mức độ AI tham gia vào hoạt động R&D sẽ giúp có thêm cơ sở để đánh giá các phòng thí nghiệm đang tiến gần khả năng này đến đâu.
Anthropic công khai số liệu mới trong bối cảnh ngành công nghệ tiếp tục tranh luận về tốc độ phát triển và vấn đề an toàn AI. Nhà nghiên cứu Jacob Coxon, người từng làm việc tại Anthropic và OpenAI, gần đây cảnh báo các công ty AI đang tiến tới những hệ thống có khả năng tự cải tiến. Đây là quan điểm cá nhân của Coxon.
CEO Anthropic Dario Amodei cũng cho rằng cần làm chậm quá trình phát triển AI để tăng cường an toàn. Trong khi đó, một số lãnh đạo công nghệ có quan điểm khác về cách quản lý tốc độ phát triển lĩnh vực này. Việc Claude tham gia ngày càng sâu vào R&D vì vậy không chỉ là một bước tiến về khả năng tự động hóa, mà còn đặt ra câu hỏi về mức độ giám sát cần thiết khi AI bắt đầu đóng vai trò lớn hơn trong việc tạo ra các thế hệ AI tiếp theo.