Bỏ qua menu

Trang thông tin điện tử tổng hợp

RSS

Anthropic cập nhật chính sách sử dụng, cấm hành vi lạm dụng với Claude

Anthropic cập nhật chính sách sử dụng, cấm hành vi lạm dụng với Claude

Anthropic đã công bố bản cập nhật chính sách sử dụng cho Claude, AI của công ty, vào ngày 8 tháng 10 năm 2026. Đây là lần đầu tiên trong hơn một năm công ty thay đổi chính sách này, nhằm phản ánh các trường hợp lạm dụng mới và có nguy cơ cao, gồm can thiệp bầu cử, phát triển vũ khí, giám sát, cùng các ứng dụng trong lĩnh vực sức khỏe và tài chính.

Siết hành vi với Claude và tuyên truyền lừa dối

Một trong những thay đổi đáng chú ý nhất là việc cấm “hành vi lạm dụng hoặc độc ác kéo dài và không cần thiết” đối với Claude. Vào tháng 8 năm ngoái, công ty thông báo Claude có thể chấm dứt các cuộc trò chuyện với người dùng “có hành vi gây hại hoặc lạm dụng liên tục” như một phần trong nghiên cứu về “phúc lợi mô hình”. Cập nhật mới cho biết việc chấm dứt cuộc trò chuyện vẫn là “cơ chế thực thi chính”; Anthropic không bình luận về việc có thêm cơ chế thực thi nào khác hay không, chẳng hạn như cấm người dùng.

Theo thông báo, chính sách mới “chỉ áp dụng trong những trường hợp cực đoan, khi người dùng liên tục hành động độc ác với các mô hình của chúng tôi mà không có mục đích rõ ràng. Chính sách không áp dụng cho những biểu hiện thất vọng, phản kháng thông thường, các chủ đề sáng tạo tối tăm, hoặc hoạt động kiểm tra và nghiên cứu mô hình.”

Ngoài thay đổi về phúc lợi mô hình, Anthropic tập hợp một số hạn chế hiện có thành quy định mới cấm các chiến dịch thương mại hoặc chính trị lừa dối, nhằm xử lý vấn đề tuyên truyền do AI tạo ra. Chính sách hạn chế “những nỗ lực che giấu ai đứng sau một thông điệp hoặc khuếch đại nội dung thông qua tài khoản hay bài đăng giả mạo”. Phần về bầu cử cũng cấm lừa dối cử tri và làm gián đoạn bầu cử, gồm phát tán thông tin sai lệch “về ứng cử viên hoặc cách thức bỏ phiếu, giả mạo ứng cử viên hay quan chức bầu cử, hoặc tìm cách ngăn cử tri tham gia”.

Vũ khí, giám sát và điều kiện ngoại lệ

Anthropic cho biết dù chính sách sử dụng luôn công khai cấm phát triển vũ khí bằng Claude, công ty đã thấy nhiều nỗ lực dùng Claude để phát triển hướng dẫn và phần mềm điều khiển cho vũ khí. Vì vậy, chính sách mới mở rộng lệnh cấm để bao gồm “phần mềm và các thành phần làm cho vũ khí hoạt động, cũng như các hành động như vũ trang cho máy bay không người lái và các phương tiện tự hành khác”.

Do báo cáo tình báo về mối đe dọa gần đây cho thấy ngày càng nhiều người dùng Claude để giám sát và theo dõi “các nhà bất đồng chính kiến”, công ty đã làm rõ các lệnh cấm liên quan đến giám sát. “Việc theo dõi người mà không có sự đồng ý của họ là bị cấm, bất kể diễn ra theo thời gian thực hay thông qua phân tích dữ liệu đã thu thập trước đó,” Anthropic viết. “Claude không thể được sử dụng để quyết định hoặc đề xuất ai sẽ bị điều tra, bắt giữ hoặc buộc tội trong quy trình thực thi pháp luật hoặc tư pháp hình sự. Chúng tôi cũng cấm dùng Claude để xây dựng hoặc cải thiện các công cụ được thiết kế cho giám sát.”

Anthropic cho biết các quy tắc này có thể được điều chỉnh cho “các hợp đồng với một số khách hàng chính phủ nhất định… nếu, theo đánh giá của Anthropic, các hạn chế sử dụng theo hợp đồng và biện pháp bảo vệ áp dụng đủ để giảm thiểu tác hại tiềm tàng.” Công ty trước đó đã ký hợp đồng với quân đội Mỹ.

Anthropic cũng thêm quy định mới rằng khi các mô hình AI của họ được “kết nối với phần cứng thực hiện hành động vật lý tự động và có thể gây thương tích”, thì một “người điều hành đủ điều kiện phải có khả năng quan sát thiết bị và dừng nó nếu cần thiết”. Quy định này phản ánh xu hướng các phòng thí nghiệm AI đầu tư vào robot và phần cứng khác để cung cấp cho hệ thống AI hình thức vật lý.

Trong năm qua, Anthropic nhiều lần gợi ý rằng các mô hình AI của họ có thể có ý thức theo một cách nào đó. “Các câu hỏi về trải nghiệm nội tâm tiềm năng, ý thức, tình trạng đạo đức và phúc lợi là những câu hỏi nghiêm túc mà chúng tôi đang điều tra khi các mô hình trở nên tinh vi và có khả năng hơn,” Kyle Fish, người đứng đầu nghiên cứu phúc lợi mô hình của công ty, nói với The Verge vào tháng 2. Cùng tháng, CEO Anthropic Dario Amodei nói trong một podcast rằng “Chúng tôi không biết liệu các mô hình có ý thức hay không”.

Một số phần khác của ngành AI công khai phản đối quan điểm này. Vào tháng 9 vừa qua, quy tắc ứng xử của Microsoft AI gây chú ý khi có lập trường cứng rắn về phúc lợi AI, với bản dự thảo do Mustafa Suleyman đăng ghi rằng “Ý tưởng về phúc lợi mô hình là sai. AI không nên có quyền hoặc nhân cách pháp lý.” Tuy nhiên, tài liệu sau đó đã thay đổi theo hướng thận trọng hơn: “Mặc dù khoa học về ý thức AI còn xa mới được giải quyết… Chúng tôi từ chối việc theo đuổi nhân cách pháp lý, hoặc ý tưởng rằng các mô hình có thể xứng đáng được phúc lợi, hoặc có quyền.”

Nguồn tham khảo: Anthropic bans ‘abusive or cruel behavior’ toward Claude.

Bài viết được biên soạn với sự hỗ trợ của AI dựa trên nguồn dẫn ở trên.

TH (phapluatxahoi.kinhtedothi.vn)

Hình ảnh Tòa soạn Trang Công Nghệ

Tòa soạn Trang Công Nghệ

Tin công nghệ được tổng hợp và đối chiếu với nguồn dẫn, có sử dụng công cụ AI trong quá trình biên soạn.

Đọc nhiều nhất
Marvell Technology công bố kết quả tài chính quý 2 năm 2027
Cristiano Ronaldo trở lại, Al-Nassr đè bẹp Al-Riyadh 4-0
GTA 6 sẽ có bản đồ lớn nhất và phức tạp nhất từ trước đến nay
Biển số 80A, 80-NN, 80 biển trắng... được cấp cho những cơ quan nào?
Đọc nhiều nhất
Marvell Technology công bố kết quả tài chính quý 2 năm 2027
Cristiano Ronaldo trở lại, Al-Nassr đè bẹp Al-Riyadh 4-0
GTA 6 sẽ có bản đồ lớn nhất và phức tạp nhất từ trước đến nay
Biển số 80A, 80-NN, 80 biển trắng... được cấp cho những cơ quan nào?

Xem gì ?