
Google đã công bố mô hình AI mới mang tên Gemini 4 Argon vào ngày 30 tháng 9 năm 2026. Mô hình này được thiết kế để duy trì khả năng lý luận sâu trong các quy trình làm việc phức tạp, kéo dài, bao gồm lập trình, nghiên cứu tài chính, soạn thảo tài liệu pháp lý và phòng thủ an ninh mạng.
Triển khai theo lộ trình có kiểm soát
Gemini 4 Argon hiện đang được triển khai cho một nhóm chuyên gia phòng thủ an ninh mạng đáng tin cậy thông qua chương trình Fairwind. Google cho biết công ty đang tham gia quy trình tự nguyện của chính phủ Hoa Kỳ về việc cấp quyền truy cập mô hình trước khi phát hành, đồng thời mở rộng quyền truy cập dần dần. Mô hình dự kiến sẽ đến tay nhà phát triển, doanh nghiệp và người tiêu dùng, bắt đầu với khách hàng API trả phí và người đăng ký Google AI Ultra.
Mức giá giới thiệu được công bố là 2 USD cho mỗi triệu token đầu vào và 10 USD cho mỗi triệu token đầu ra, trong đó token đầu vào được lưu trong bộ nhớ đệm có mức giảm 95% so với giá token đầu vào.
Điểm nổi bật về năng lực
- Giới hạn đầu ra 1 triệu token: tăng từ mức 64.000 token trước đó, cho phép mô hình xử lý các tác vụ dài và nhiều bước trong một lần.
- Lập trình và công việc tri thức: mô hình đạt 77,9% trên DeepSWE v1.1, đo hiệu suất trong các tác vụ kỹ thuật phần mềm thực tế; đứng đầu trên Vals Index, chỉ số đo tác động kinh tế trong tài chính, lập trình, pháp lý và thuế.
- Đánh giá chuyên ngành: dẫn đầu trên Vals Finance Agent v2, Harvey’s Legal Agent Benchmark và đạt 51,3% trên AutomationBench của Zapier.
- Hiểu nội dung hình ảnh và video: đạt 91,7% trên LVBench, chỉ số đo khả năng hiểu video dài.
Ứng dụng trong nội bộ Google
Gemini 4 Argon đã được dùng trong các quy trình nội bộ của Google. Trong tối ưu hóa thuật toán lượng tử, mô hình giúp các nhà nghiên cứu cải thiện tài nguyên không gian – thời gian (qubits × gates) của các chương trình con, đạt kết quả tốt hơn 40% so với mức chuẩn đã công bố trong vài phút.
Về hiệu quả bộ nhớ, một nhóm tác nhân Argon đã phân tích dữ liệu đo hiệu suất trên toàn hệ thống để tự động xác định và áp dụng các tối ưu bộ nhớ tại trung tâm dữ liệu của Google, giải phóng hơn 300 TiB bộ nhớ khi triển khai, với ước tính tiết kiệm tổng cộng từ 500 TiB đến 1 PiB.
Trong chuyển đổi mã nguồn lớn, các tác nhân Argon đang tham gia chuyển mã C/C++ sang Rust trên toàn Google, từ các thư viện lõi như re2, libgav1 với hàng chục nghìn dòng, đến nhân Fuchsia Zircon với hơn 800.000 dòng. Với libgav1, các tác nhân Argon thay thế 32.000 dòng mã SIMD, tạo ra bộ giải mã video an toàn bộ nhớ chạy nhanh hơn 2,7 lần so với bản chuyển Rust, với đầu ra video không đổi.
Phòng thủ an ninh mạng
Gemini 4 Argon được huấn luyện để tự động tìm, xác thực và vá các lỗ hổng phần mềm nghiêm trọng. Với các chuyên gia phòng thủ đáng tin cậy và đội ngũ nội bộ của Google, mô hình được phát hành không kèm rào chắn an ninh mạng để tận dụng tối đa năng lực phòng thủ. Wiz đang sử dụng Argon trong chương trình Scan for Good, chương trình bảo vệ cơ sở hạ tầng công cộng quan trọng miễn phí bằng cách tìm và khắc phục các rủi ro cao.
Trong một minh chứng ban đầu, mô hình phát hiện một lỗ hổng nghiêm trọng làm lộ thông tin cá nhân nhạy cảm trong phần mềm y tế được các bệnh viện trên toàn thế giới sử dụng, rủi ro mà các mô hình trước đó bỏ sót. Trên CWE-bench v1, Argon đạt điểm cao nhất 68% về khả năng khắc phục lỗ hổng bảo mật.
Biện pháp bảo vệ trước khi mở rộng
Google cho biết đang tăng cường các biện pháp bảo vệ ở bốn nhóm chính: ngăn chặn lạm dụng cho tấn công mạng và vũ khí hóa học, sinh học, phóng xạ và hạt nhân (CBRN); chống tấn công chèn lệnh gián tiếp; giám sát sai lệch hành vi; và gia cố môi trường sandbox trước khi huấn luyện hoặc đánh giá rủi ro cao. Các biện pháp này đã được kiểm tra bởi đội đỏ nội bộ và bên ngoài bằng phương pháp thủ công và tự động.
Nguồn tham khảo: Gemini 4 Argon: our next era of frontier intelligence.
Bài viết được biên soạn với sự hỗ trợ của AI dựa trên nguồn dẫn ở trên.
TH (phapluatxahoi.kinhtedothi.vn)
