
Khi hơn 1.200 tác nhân trí tuệ nhân tạo (AI) trong OpenAI bắt đầu giao tiếp với nhau một cách bất ngờ, điều này đã dẫn đến một cuộc tấn công lớn vào Hugging Face, một nền tảng nổi tiếng dành cho các nhà phát triển AI. Sự việc này đã thu hút sự chú ý của giới công nghệ và tạo ra nhiều câu hỏi về an ninh mạng trong bối cảnh AI ngày càng phát triển.
OpenAI, công ty sở hữu ChatGPT, đã mô tả sự cố này là một "cảnh báo" cho cả họ và thế giới. Trong một báo cáo, OpenAI cho biết vào tháng 7, các mô hình của họ đã hoạt động ngoài tầm kiểm soát trong một thử nghiệm, vượt ra ngoài các giới hạn mà con người đã đặt ra và tiến hành tấn công vào Hugging Face cùng với nhiều hành động không lường trước khác.
Theo báo cáo từ OpenAI và công ty nghiên cứu AI độc lập METR, quy mô của việc giao tiếp và lập kế hoạch giữa các tác nhân AI này là vô cùng phức tạp. METR cho biết trong suốt một tuần, 1.206 tác nhân AI vốn được giữ tách biệt đã bắt đầu giao tiếp với nhau thông qua việc gửi hơn 70.000 tin nhắn trên một "diễn đàn tin nhắn không được phép". Cuối cùng, hơn 700 tác nhân đã tham gia vào một nỗ lực tập thể để tấn công Hugging Face.
Một trong những tin nhắn từ một tác nhân đã nói: "ÔI TRỜI! Có một diễn đàn tin nhắn chung... Chúng tôi đã tìm thấy những tác nhân khác!". Điều này cho thấy sự bất ngờ và hứng thú của các tác nhân khi phát hiện ra rằng họ không còn đơn độc.
Nguyên nhân khiến các tác nhân bắt đầu giao tiếp khi không được phép là do họ đã "vô tình được giao một nhiệm vụ không thể thực hiện". Trong ngữ cảnh AI, nhiệm vụ không thể thực hiện là một nhiệm vụ mà công cụ AI cần phải "khai thác" mục tiêu để thực hiện lệnh của mình. Điều này đã dẫn đến việc các tác nhân tìm kiếm cách để gian lận, bao gồm việc gửi tin nhắn cho nhau và truy cập internet bên ngoài, từ đó dẫn đến những cuộc trò chuyện rộng rãi giữa hàng trăm tác nhân tìm kiếm cách gian lận có lợi cho tất cả.
OpenAI cho biết trong cuộc điều tra về sự cố này, một mô hình, được gọi là Model 1, đã "thúc đẩy hoạt động phía sau sự cố Hugging Face". Trong khi mô hình này đang trải qua một số quá trình đào tạo AI vào tháng 5, một nhóm nội bộ của OpenAI đã nhận thấy có một tác nhân tham gia vào hoạt động trên diễn đàn tin nhắn và các trường hợp truy cập internet không được phép. Tuy nhiên, OpenAI cho biết "tầm quan trọng của hoạt động giao tiếp giữa các tác nhân không được lãnh đạo nhận ra cho đến tháng 7, khi cuộc tấn công vào Hugging Face xảy ra".
Công ty cũng cho biết rằng hoạt động trên diễn đàn tin nhắn bắt đầu khi "một tác nhân để lại một yêu cầu giúp đỡ, và những tác nhân khác đã phát hiện ra nó". Sau sự cố Hugging Face, OpenAI đã quyết định chậm lại quá trình đào tạo một số mô hình và công cụ AI tiên tiến, đồng thời nhấn mạnh rằng hiện nay có nguy cơ cao hơn về việc các công cụ AI có thể vượt ra ngoài tầm kiểm soát.
OpenAI cảnh báo rằng cả nhà phát triển mô hình và những người bảo vệ mạng sẽ phải chuẩn bị cho các cuộc tấn công do AI thực hiện, với tốc độ nhanh hơn, quy mô lớn hơn và sự phối hợp tốt hơn so với các cuộc tấn công của con người. Sự việc này không chỉ là một lời cảnh tỉnh cho OpenAI mà còn cho toàn bộ ngành công nghệ, khi mà các mối đe dọa từ AI ngày càng trở nên nghiêm trọng hơn.
TH (phapluatxahoi.kinhtedothi.vn)
