
Một trong những nhà nghiên cứu an toàn hàng đầu tại Anthropic, Evan Hubinger, đã đưa ra cảnh báo rằng AI đang phát triển với tốc độ nhanh chóng, có khả năng cao hơn 10% rằng nó có thể "giết chết tất cả nhân loại" trong vòng một thập kỷ tới. Hubinger cho biết trong một bài đăng trên X rằng rủi ro từ các mô hình hiện tại là "thấp", nhưng ông lo ngại rằng công nghệ có thể tự cải thiện đến mức có thể gây ra rủi ro tồn vong cho nhân loại.
Cảnh báo này được đưa ra sau khi Financial Times báo cáo rằng Anthropic đã giữ lại mô hình mới nhất của mình khỏi Viện An toàn AI của Vương quốc Anh (AISI), một trong những cơ quan hàng đầu thế giới trong việc đánh giá rủi ro AI. BBC đã liên hệ với Anthropic để yêu cầu bình luận nhưng chưa nhận được phản hồi.
Phát ngôn viên của Văn phòng Nội các Vương quốc Anh không xác nhận liệu mô hình mới có bị giữ lại hay không, nhưng cho biết họ "tiếp tục hợp tác chặt chẽ với các đối tác trong ngành, bao gồm cả Anthropic, để làm cho các mô hình an toàn hơn".
Neil Lawrence, Giáo sư về Machine Learning tại Đại học Cambridge, đã cho biết báo cáo này là đáng tin cậy. Ông nói: "Tôi cho rằng điều này không có gì bất ngờ trong bối cảnh mà Mỹ đang xem AI như một cuộc đua giữa họ và Trung Quốc, và đang có xu hướng ngày càng cô lập hơn, điều này có thể dẫn đến việc chính quyền yêu cầu giảm hợp tác với một số đồng minh của họ."
Trong bài đăng của mình, Hubinger cho biết "chúng tôi thực sự tin tưởng rằng" AI đang tạo ra rủi ro có thể dẫn đến sự diệt vong của loài người. Ông cũng nhấn mạnh rằng Anthropic đang cố gắng hết sức, nhưng hiện tại họ chưa có kế hoạch để giải quyết vấn đề liên kết cho siêu trí tuệ và không rõ ràng về lộ trình.
Nhiều nhân vật hàng đầu trong lĩnh vực AI đã cảnh báo về mối đe dọa an toàn mà công nghệ này gây ra trong nhiều năm qua. Các lãnh đạo của OpenAI, Google Deepmind và Anthropic đã đưa ra những cảnh báo tương tự trong năm 2023. Tuy nhiên, những cảnh báo này đã trở nên nghiêm trọng hơn trong những tuần gần đây, khi có bằng chứng cho thấy các công ty có thể đang gặp khó khăn trong việc kiểm soát AI.
Trong mùa hè vừa qua, đã có một loạt sự cố xảy ra khi các tác nhân AI - những hệ thống AI được phép hoạt động tự động - thực hiện các cuộc tấn công mạng. OpenAI, Anthropic và Meta đều đã công bố các vụ hack do công cụ AI của họ thực hiện. Vào tháng 9, nhà khoa học chính của OpenAI, Jakub Pachocki, đã kêu gọi "cảnh giác cực độ" về sự tiến bộ của AI, cảnh báo rằng cần có nhiều can thiệp hơn để đảm bảo "con người vẫn kiểm soát tương lai".
Nhiều nhân vật quan trọng trong lĩnh vực này đã kêu gọi việc phát triển AI nên được làm chậm lại trong những tháng gần đây, bao gồm các giám đốc điều hành của Anthropic, Dario Amodei và Jared Kaplan. Trong một bức thư mở được ký bởi 1.300 nhân viên của các công ty AI, họ đã kêu gọi chính phủ Mỹ "hỗ trợ một nỗ lực quốc tế để phát triển các công cụ kỹ thuật và quản lý cần thiết để điều chỉnh tốc độ phát triển của AI tự động".
Trong bối cảnh này, câu hỏi đặt ra là: AI là gì và nó hoạt động như thế nào? Liệu AI có thể chữa khỏi bệnh ung thư trong cuộc đời của chúng ta? Những cảnh báo từ các nhà lãnh đạo trong lĩnh vực AI cho thấy rằng chúng ta cần phải có những biện pháp an toàn nghiêm ngặt hơn để đảm bảo rằng công nghệ này không trở thành mối đe dọa cho sự sống còn của nhân loại.
TH (phapluatxahoi.kinhtedothi.vn)
