Làn sóng giảm giá trong ngành AI đang nóng lên khi các phòng thí nghiệm hàng đầu của Mỹ, trong đó có OpenAI và Anthropic, được cho là đang đẩy mạnh tung ra những mô hình có chi phí thấp hơn nhằm giữ chân nhóm khách hàng doanh nghiệp ngày càng nhạy cảm với giá.
Diễn biến này xuất hiện trong bối cảnh chi phí sử dụng AI tăng nhanh, buộc nhiều doanh nghiệp phải kiểm soát ngân sách, giới hạn mức dùng hoặc tìm đến các lựa chọn rẻ hơn. Đây cũng là cơ hội để các nhà phát triển Trung Quốc như Moonshot hay DeepSeek mở rộng tệp người dùng, từ Thung lũng Silicon cho tới thị trường châu Âu.
![]() |
| OpenAI là một trong những ông lớn của AI Mỹ đại hạ giá mô hình AI |
Theo thông tin được công bố gần đây, OpenAI đã giảm tới 80% giá GPT-5.6 Luna, mô hình được hãng mô tả là “nhanh nhất và có chi phí dễ tiếp cận nhất”. Trong khi đó, Anthropic ra mắt Claude Opus 5 với thông điệp nhấn mạnh “trí thông minh tiên tiến” nhưng mức giá chỉ bằng một nửa so với Fable 5, mô hình mạnh nhất của công ty.
Theo chỉ số giá token của Silicon Data, các động thái trên đã kéo mức giá mà khách hàng phải trả cho nhóm mô hình từ các phòng thí nghiệm AI hàng đầu của Mỹ xuống gần một phần tư kể từ giữa tháng 7. Token là đơn vị dữ liệu được các mô hình ngôn ngữ xử lý và cũng là cơ sở để nhiều nhà cung cấp tính phí khách hàng. Đợt giảm giá này cho thấy một thay đổi đáng chú ý trong chiến lược của các tập đoàn AI Mỹ, vốn trước đây chủ yếu cạnh tranh bằng hiệu năng của các mô hình “đóng” độc quyền. Trong khi đó, các mô hình “mở” ngày càng mạnh từ Trung Quốc — cho phép nhà phát triển tải xuống, tinh chỉnh và triển khai linh hoạt — đang tạo thêm sức ép lên mặt bằng giá.
Áp lực này càng trở nên đáng chú ý khi OpenAI và Anthropic được cho là đang chuẩn bị cho các kế hoạch IPO với mức định giá có thể lên tới hàng nghìn tỷ USD. Với nhà đầu tư, câu hỏi trọng tâm lúc này là liệu những khoản chi khổng lồ cho hạ tầng và nghiên cứu AI có thể chuyển hóa thành lợi nhuận bền vững hay không.
Về phía khách hàng, nhóm người dùng AI doanh nghiệp cũng đang chịu áp lực rõ rệt hơn. Một số khách hàng của Anthropic và OpenAI đã được chuyển từ hình thức đăng ký trọn gói sang mô hình thanh toán theo mức sử dụng, tức doanh nghiệp phải trả tiền dựa trên lượng tài nguyên tính toán thực tế tiêu thụ.
Khi hóa đơn tăng lên, không ít doanh nghiệp bắt đầu đặt trần sử dụng AI hoặc thử nghiệm các lựa chọn thay thế có chi phí thấp hơn. DoorDash và Airbnb là những ví dụ được nhắc tới khi các công ty này cho biết đã bắt đầu sử dụng một số mô hình do Trung Quốc phát triển nhằm kiểm soát chi phí vận hành.
Sự dịch chuyển này diễn ra cùng thời điểm các phòng thí nghiệm Trung Quốc liên tục công bố sản phẩm mới, qua đó thu hẹp khoảng cách hiệu năng với những mô hình hàng đầu của Mỹ. Điều này làm dấy lên lo ngại trong ngành công nghệ Mỹ rằng các nhà phát triển trong nước có thể mất khách hàng, ngay cả khi vẫn phải chi mạnh để duy trì lợi thế công nghệ.
Trên thực tế, các nhà cung cấp AI thường đưa ra nhiều dòng mô hình với mức năng lực và giá bán khác nhau. Chi phí sử dụng cũng thay đổi tùy phiên bản mô hình và thiết lập “nỗ lực” mà khách hàng lựa chọn. Thông thường, người dùng bị tính phí theo token đầu vào — phần dữ liệu đưa vào mô hình — và token đầu ra, tức nội dung do mô hình tạo ra.
Các đợt giảm giá mới nhất của các phòng thí nghiệm Mỹ chủ yếu tập trung vào phân khúc tầm trung, qua đó giúp sản phẩm của họ cạnh tranh hơn với những lựa chọn đến từ Trung Quốc. Chẳng hạn, OpenAI đã hạ giá GPT-5.6 Luna từ 1 USD xuống 0,20 USD cho mỗi triệu token đầu vào và từ 6 USD xuống 1,20 USD cho mỗi triệu token đầu ra.
Với Anthropic, Opus 5 được giới thiệu ở mức 5 USD cho mỗi triệu token đầu vào và 25 USD cho mỗi triệu token đầu ra, tức chỉ bằng một nửa so với Fable 5. Tuần này, công ty cũng đã hủy kế hoạch tăng giá đối với mô hình Sonnet 5, vốn dự kiến có hiệu lực từ tháng 9.
Dù vậy, giá token niêm yết không phải lúc nào cũng phản ánh đầy đủ chi phí thực tế khi so sánh giữa các mô hình AI.
Một mô hình mạnh hơn đôi khi có thể hoàn thành cùng một tác vụ với số token ít hơn hoặc cần ít lần thử hơn. Vì vậy, một mô hình nhìn qua có vẻ đắt hơn xét theo giá token niêm yết vẫn có thể đem lại tổng chi phí thấp hơn nếu hiệu quả xử lý tốt hơn.
Bên cạnh đó, nhiều mô hình có thể vận hành ở các mức “nỗ lực” khác nhau. Thiết lập này quyết định lượng sức mạnh tính toán được dùng để trả lời một yêu cầu, từ đó tác động trực tiếp đến cả hiệu suất lẫn chi phí cuối cùng của từng tác vụ.
Theo Artificial Analysis, đơn vị chuyên đánh giá mô hình trong các lĩnh vực như toán học, khoa học, lập trình và suy luận, Opus 5 của Anthropic ở mức nỗ lực “trung bình” cho hiệu suất và chi phí trên mỗi tác vụ tương đương Kimi K3 của Moonshot ở mức nỗ lực “tối đa”. Trong khi đó, GPT-5.6 Luna của OpenAI ở mức nỗ lực “tối đa” có hiệu suất gần tương tự V4 Flash của DeepSeek ở cùng mức thiết lập, nhưng chi phí trên mỗi tác vụ lại cao gấp đôi.
Anthropic và OpenAI đều từ chối bình luận về vấn đề này.
Một nguồn tin thân cận với Anthropic cho biết mức giá thấp hơn của Opus 5 so với sản phẩm chủ lực Fable 5 xuất phát từ cách “hệ thống mô hình của công ty được xây dựng”, thay vì liên quan trực tiếp đến động thái của đối thủ cạnh tranh.
Ở góc nhìn của người dùng doanh nghiệp, Mantas Lukauskas, trưởng nhóm công nghệ AI tại Hostinger — nhà cung cấp dịch vụ lưu trữ website đã sử dụng các mô hình ngôn ngữ lớn từ năm 2020 — nhận định giá của những mô hình tốt nhất hiện vẫn “ổn định hoặc đang tăng”. Theo ông, các điều chỉnh giá gần đây là “bài kiểm tra thực sự đầu tiên” để xem liệu những tập đoàn như Anthropic và OpenAI có thể bảo vệ mức giá của các sản phẩm tiên tiến nhất hay không. “Các phòng thí nghiệm của Mỹ đang cắt giảm ở phân khúc tầm trung và bảo vệ phân khúc cao cấp”, ông nói.