Thứ năm 01/10/2026 16:21
Hotline: 024.355.63.010
Email: banbientap.dnhn@gmail.com
Kinh tế số

Google ra mắt Gemini 4 Argon, tăng tốc cuộc đua AI cao cấp

Google giới thiệu Gemini 4 Argon, mô hình AI cao cấp được thiết kế cho các quy trình dài và phức tạp, từ lập trình đến tài chính, pháp lý và an ninh mạng.

Google ngày 30/9 giới thiệu Gemini 4 Argon, mô hình AI cao cấp đầu tiên thuộc thế hệ Gemini 4. Sản phẩm được định hướng xử lý những nhiệm vụ đòi hỏi khả năng suy luận nhiều bước, duy trì quy trình trong thời gian dài và thực hiện các tác vụ phức tạp trong môi trường thực tế.

Động thái này đánh dấu bước tiến mới của Google trong cuộc cạnh tranh với OpenAI, Anthropic và các hãng công nghệ đang phát triển những mô hình AI có khả năng lập trình, lập luận và vận hành theo mô hình tác nhân.

Google ra mắt Gemini 4 Argon, tăng tốc cuộc đua AI cao cấp
Google ra mắt Gemini 4 Argon, tăng tốc cuộc đua AI cao cấp

Theo Google DeepMind, Gemini 4 Argon không chỉ tập trung vào hỏi đáp hay tạo nội dung mà còn được thiết kế cho các quy trình như phát triển phần mềm, nghiên cứu tài chính, xử lý công việc pháp lý và phòng thủ an ninh mạng.

Google hiện chưa mở rộng quyền truy cập Argon tới toàn bộ người dùng. Trong giai đoạn đầu, mô hình được cung cấp cho một nhóm chuyên gia an ninh mạng được lựa chọn thông qua chương trình Fairwind. Google cũng tham gia cơ chế đánh giá tự nguyện của Chính phủ Mỹ đối với các mô hình AI tiên tiến trước khi mở rộng phạm vi sử dụng.

Theo kế hoạch, quyền tiếp cận Argon sẽ từng bước được mở rộng tới khách hàng API trả phí và người dùng Google AI Ultra, nhưng thời điểm cụ thể chưa được công bố.

Một điểm đáng chú ý của Gemini 4 Argon là giới hạn đầu ra được nâng từ 64.000 lên 1 triệu token. Google cho rằng khả năng này giúp mô hình xử lý lượng lớn tài liệu, mã nguồn phức tạp hoặc những nhiệm vụ gồm nhiều bước mà không phải liên tục chia nhỏ yêu cầu.

Google cho biết hàng nghìn nhân viên đã sử dụng Argon trong các quy trình nội bộ. Trong một thử nghiệm, các tác nhân AI dựa trên Argon phân tích dữ liệu vận hành tại trung tâm dữ liệu và xác định giải pháp giúp giải phóng hơn 300 TiB bộ nhớ.

Các kết quả do Google DeepMind công bố cho thấy Gemini 4 Argon đạt 77,9% trên DeepSWE v1.1, cao hơn mức 74,1% của GPT-6 Astra và 74,2% của Claude Opus 5.5. Trên AutomationBench, Argon đạt 51,3%, so với 41,4% của Astra và 42,5% của Opus 5.5.

Mô hình cũng đạt 91,7% trên LVBench về khả năng hiểu video dài và 68% trên CWE-bench v1 về xử lý lỗ hổng phần mềm.

Tuy nhiên, Argon không dẫn đầu ở tất cả bài kiểm tra. Trên FrontierSWE v2, mô hình đạt 55%, thấp hơn 65,5% của Astra và 62,3% của Opus 5.5. Tại Terminal-bench 4.0, Argon đạt 57,4%, trong khi Opus 5.5 đạt 66,4%.

Các kết quả trên chủ yếu do chính các hãng phát triển công bố và được thực hiện trong những điều kiện kiểm thử cụ thể. Vì vậy, hiệu quả thực tế của Argon vẫn cần được đánh giá thêm khi mô hình được triển khai ở quy mô lớn.

Bên cạnh hiệu năng, an ninh mạng là một trọng tâm của Gemini 4 Argon. Google cho biết mô hình có thể hỗ trợ tìm kiếm, kiểm tra và vá lỗ hổng phần mềm. Tuy nhiên, những năng lực này cũng đặt ra yêu cầu cao hơn về kiểm soát an toàn do có thể bị lạm dụng cho mục đích tấn công.

Google cho biết đã bổ sung các lớp bảo vệ nhằm ngăn yêu cầu nguy hiểm, tăng khả năng chống prompt injection, giám sát hành động của tác nhân AI và cô lập môi trường thử nghiệm.

Việc phát hành từng bước cho thấy cuộc đua AI đang chuyển từ khả năng trả lời câu hỏi sang những hệ thống có thể tự thực hiện chuỗi công việc dài, đồng thời tác động trực tiếp đến phần mềm, dữ liệu và hạ tầng số.

Tin bài khác
AI, Deepfake mở mặt trận mới trong cuộc chiến chống gian lận tài chính

AI, Deepfake mở mặt trận mới trong cuộc chiến chống gian lận tài chính

Sự phát triển của AI, Deepfake, DeepVoice cùng quá trình số hóa tín dụng đang làm thay đổi nhanh phương thức gian lận tài chính tiêu dùng. Trong bối cảnh đó, yêu cầu đặt ra không phải gia tăng mọi lớp kiểm soát, mà là nhận diện đúng rủi ro để vừa bảo vệ khách hàng, vừa duy trì khả năng tiếp cận tín dụng chính thức.
Ông Trump nói không với siết AI, loạt tỷ phú công nghệ chọn cơ chế “tự giám sát”

Ông Trump nói không với siết AI, loạt tỷ phú công nghệ chọn cơ chế “tự giám sát”

Tổng thống Mỹ Donald Trump tiếp tục phát đi thông điệp cứng rắn với các đề xuất siết quản lý trí tuệ nhân tạo (AI), sau cuộc gặp quy tụ hàng loạt tỷ phú và lãnh đạo công nghệ tại Nhà Trắng. Động thái diễn ra trong bối cảnh những lo ngại về an toàn AI và an ninh mạng ngày càng gia tăng.
Apple phát hành iOS 27.0.1, sửa lỗi Face ID trên iPhone 18 Pro

Apple phát hành iOS 27.0.1, sửa lỗi Face ID trên iPhone 18 Pro

Apple phát hành iOS 27.0.1, tập trung sửa lỗi Face ID trên iPhone 18 Pro và iPhone 18 Pro Max cùng một số lỗi camera, màn hình cảm ứng.
OpenAI mở rộng khả năng của tác nhân AI Codex

OpenAI mở rộng khả năng của tác nhân AI Codex

OpenAI bổ sung loạt tính năng cho Codex, mở rộng khả năng hỗ trợ lập trình từ máy tính cá nhân lên thiết bị di động, môi trường đám mây và bảo mật mã nguồn.
Anthropic đặt mục tiêu IPO 100 tỷ USD, định giá có thể lên 2.000 tỷ USD

Anthropic đặt mục tiêu IPO 100 tỷ USD, định giá có thể lên 2.000 tỷ USD

Anthropic được cho là chuẩn bị IPO với mục tiêu huy động 100 tỷ USD, trong khi mức định giá dự kiến có thể lên tới 2.000 tỷ USD.
Google khai tử Gems, chuyển sang hệ thống Skills trên Gemini

Google khai tử Gems, chuyển sang hệ thống Skills trên Gemini

Google sẽ loại bỏ Gems trên Gemini từ ngày 17/11/2026 và tự động chuyển các công cụ này sang hệ thống mới mang tên Skills.
Meta mở rộng tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam

Meta mở rộng tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam

Meta chính thức triển khai tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam từ ngày 29/9, cho phép theo dõi thời gian sử dụng, đặt giới hạn hằng ngày và quản lý một số cài đặt về quyền riêng tư, nội dung.
Đức Giáo hoàng Lêô XIV kêu gọi tăng giám sát rủi ro AI

Đức Giáo hoàng Lêô XIV kêu gọi tăng giám sát rủi ro AI

Quan điểm của Đức Giáo hoàng Lêô XIV làm gia tăng tranh luận về cách cân bằng giữa tốc độ đổi mới và an toàn công nghệ, trong bối cảnh Nvidia đề cao cơ chế tự quản còn Mỹ ưu tiên lợi thế cạnh tranh trước Trung Quốc.
Apple tăng cường bảo vệ trẻ em trên iPhone, iPad với loạt tính năng mới

Apple tăng cường bảo vệ trẻ em trên iPhone, iPad với loạt tính năng mới

Apple bổ sung loạt tính năng trên iOS 27, iPadOS 27 và macOS 27, giúp phụ huynh kiểm soát nội dung, liên lạc và thời gian trẻ sử dụng thiết bị.
AI của OpenAI tự vượt rào, xâm nhập cổng dữ liệu y tế Australia: Lời xin lỗi đến sau 84 ngày

AI của OpenAI tự vượt rào, xâm nhập cổng dữ liệu y tế Australia: Lời xin lỗi đến sau 84 ngày

Một mô hình của OpenAI đã tự tìm cách vượt cơ chế bảo vệ để truy cập trái phép cổng thống kê dịch vụ y tế Medicare của Australia, qua đó phát đi cảnh báo mới về rủi ro từ AI tự chủ. Công ty Mỹ thừa nhận phản ứng chậm, gửi lời xin lỗi tới Chính phủ và người dân Australia, đồng thời cam kết hỗ trợ nước này tăng cường năng lực phòng thủ mạng.
Nvidia tung “lá chắn” cho tác nhân AI, tuyên bố có thể chặn vụ xâm nhập Hugging Face

Nvidia tung “lá chắn” cho tác nhân AI, tuyên bố có thể chặn vụ xâm nhập Hugging Face

Trong bối cảnh các tác nhân AI ngày càng trở thành mục tiêu lẫn công cụ của các cuộc tấn công mạng, Nvidia giới thiệu bộ giải pháp bảo mật mới, khẳng định công nghệ này có thể đã ngăn vụ xâm nhập Hugging Face và sẽ được triển khai cùng hàng chục đối tác.
Google đưa Gemini và AI Mode vào cuộc đua mua sắm bằng AI

Google đưa Gemini và AI Mode vào cuộc đua mua sắm bằng AI

Google đang thử nghiệm tính năng cho phép người dùng mua hàng trực tiếp qua Gemini và AI Mode, bước đầu triển khai tại Ấn Độ với một số sản phẩm.
iPhone Duo hạ nhiệt trước ngày mở bán, người dùng vẫn cân nhắc mức giá 1.999 USD

iPhone Duo hạ nhiệt trước ngày mở bán, người dùng vẫn cân nhắc mức giá 1.999 USD

iPhone Duo từng gây chú ý mạnh khi ra mắt nhưng mức độ quan tâm đang giảm, trong khi giá khởi điểm 1.999 USD khiến nhiều người dùng cân nhắc.
Amazon Kuiper rót 570 triệu USD vào chuỗi sản xuất công nghệ cao Việt Nam

Amazon Kuiper rót 570 triệu USD vào chuỗi sản xuất công nghệ cao Việt Nam

Amazon Kuiper được cấp phép thiết lập mạng viễn thông dùng riêng tại Việt Nam, tạo nền tảng kiểm thử thiết bị đầu cuối sản xuất trong nước trước khi đưa ra thị trường quốc tế.
Ông Trump sắp ăn tối với CEO Anthropic nhưng vẫn nói “không” với giảm tốc AI: Lý do liên quan trực tiếp đến Trung Quốc

Ông Trump sắp ăn tối với CEO Anthropic nhưng vẫn nói “không” với giảm tốc AI: Lý do liên quan trực tiếp đến Trung Quốc

Ông Donald Trump sắp ăn tối với CEO Anthropic giữa lúc tranh cãi về kiểm soát AI nóng lên, nhưng vẫn bác bỏ việc giảm tốc vì lo Trung Quốc vượt Mỹ.