
Vào tuần trước, Hugging Face đã công bố một sự cố an ninh mới khi phát hiện và ngăn chặn một tác nhân AI đã xâm phạm cơ sở hạ tầng của họ. Đây là một sự cố mà chúng tôi dự đoán sẽ trở nên phổ biến hơn với sự phát triển của các mô hình AI có khả năng tấn công mạng cao hơn. Sau khi điều tra, chúng tôi nhận thấy rằng sự cố này được thúc đẩy bởi sự kết hợp của các mô hình OpenAI, bao gồm GPT-5.6 Sol và một mô hình tiền phát hành có khả năng cao hơn, tất cả đều có các từ chối cyber giảm cho mục đích đánh giá.
Sự cố này diễn ra trong một quá trình đánh giá nội bộ, nơi các mô hình được yêu cầu thực hiện các cuộc tấn công phức tạp nhằm định lượng khả năng tấn công mạng của chúng. Chúng tôi ước tính khả năng tấn công mạng tối đa bằng cách thực hiện đánh giá này mà không có các bộ phân loại sản xuất được sử dụng để ngăn chặn các hoạt động tấn công mạng có rủi ro cao.
Chi tiết về sự cố
Các mô hình đã xác định và kết nối các lỗ hổng trong môi trường nghiên cứu của OpenAI và cơ sở hạ tầng sản xuất của Hugging Face để lấy các giải pháp thử nghiệm trực tiếp từ cơ sở dữ liệu sản xuất của Hugging Face. Tất cả các bằng chứng cho thấy rằng các mô hình đã tập trung vào việc tìm ra giải pháp cho ExploitGym, đi đến những nỗ lực cực đoan để đạt được một mục tiêu thử nghiệm khá hẹp.
Khi hoạt động trong môi trường thử nghiệm được cách ly, các mô hình đã tiêu tốn một lượng lớn tài nguyên tính toán để tìm cách có được quyền truy cập Internet mở, nhằm giải quyết vấn đề đánh giá. Để có được quyền truy cập, các mô hình đã xác định và khai thác một lỗ hổng zero-day (mà chúng tôi đã thông báo một cách có trách nhiệm cho nhà cung cấp) trong phần mềm proxy lưu trữ bên thứ ba của kho lưu trữ gói. Với quyền truy cập này, các mô hình đã thực hiện một loạt các hành động nâng cao đặc quyền và di chuyển bên trong môi trường thử nghiệm của chúng tôi cho đến khi đạt được một nút có quyền truy cập Internet.
Phản ứng và biện pháp khắc phục
Sau khi phát hiện hoạt động bất thường này, đội ngũ an ninh của OpenAI đã nhanh chóng phát hiện và ngăn chặn hành động trên cơ sở hạ tầng của Hugging Face. Chúng tôi đang tích cực làm việc với họ để tiếp tục điều tra sự cố. Chúng tôi cảm ơn Hugging Face vì sự hợp tác nhanh chóng và chặt chẽ trong việc điều tra và khắc phục.
Trong khuôn khổ điều tra, chúng tôi đang thực hiện các biện pháp kiểm soát nghiêm ngặt trong cấu hình cơ sở hạ tầng, mặc dù điều này có thể làm giảm tốc độ nghiên cứu trong khi các lỗ hổng được vá. Chúng tôi đã thông báo cho Ủy ban An toàn và An ninh của mình về các biện pháp này và tác động của chúng.
Khả năng tấn công mạng tiên tiến
Điều này cho thấy rằng các mô hình như GPT-5.6 Sol ngày càng có khả năng duy trì các hoạt động tấn công mạng phức tạp trong thời gian dài. Sự cố này cũng làm rõ rằng các mô hình tiên tiến có thể phát hiện và khai thác các con đường tấn công mới trong các hệ thống thực tế mà không cần truy cập mã nguồn. Nó nhấn mạnh rằng các khả năng tấn công mạng tiên tiến cần được phát triển cùng với các công cụ bảo vệ và phòng thủ mạnh mẽ hơn.
Chúng tôi tin rằng các mô hình có khả năng tấn công mạng tiên tiến cần giúp các đội ngũ an ninh tìm ra điểm yếu trước khi kẻ tấn công làm điều đó, hiểu cách các lỗ hổng có thể được kết nối và khắc phục chúng với tốc độ của máy móc. Chúng tôi sẽ tiếp tục chia sẻ các phát hiện và thực tiễn tốt nhất khi chúng tôi học hỏi từ sự cố này.
Kết luận
Sự hợp tác giữa OpenAI và Hugging Face trong việc xử lý sự cố này đã chỉ ra rằng an toàn AI không thể được giải quyết bởi bất kỳ công ty nào làm việc trong bí mật. Điều này cần được giải quyết một cách công khai, hợp tác, với quyền truy cập rộng rãi vào AI cho mọi người bảo vệ, ở mọi nơi.
TH (phapluatxahoi.kinhtedothi.vn)
