Anthropic nói rằng người dùng đã cố gắng sử dụng Claude cho vũ khí, bệnh nhân và giám sát
Công ty cho biết nó đã chặn các hoạt động được xác định, nhưng báo cáo đe dọa của nó cho thấy cách AI mục đích chung đang làm giảm rào cản trên các hoạt động quân sự, sinh học và tình báo.
Bản dịch máy · Bản gốc tiếng Anh · Xem bản gốc
Một danh sách rộng hơn của những nỗ lực lạm dụng
Anthropic cho biết các tội phạm, các nhóm liên kết với nhà nước, các nhà nghiên cứu, các nhà khai thác phần mềm gián điệp và các nhà quảng cáo đã cố gắng sử dụng mô hình Claude của họ cho các hoạt động từ các cuộc tấn công mạng đến phát triển vũ khí thông thường và nghiên cứu sinh học. Báo cáo mới về tình báo mối đe dọa của công ty mô tả các nỗ lực liên quan đến phần mềm tên lửa và máy bay không người lái, giám sát các kẻ phản đối, chiến dịch ảnh hưởng và nghiên cứu có thể có cả các ứng dụng quân sự hợp pháp và nguy hiểm.
Công ty cho biết nó đã phát hiện và vô hiệu hóa mọi hoạt động bao gồm trong báo cáo. Nó không xác định các tổ chức hoặc quốc gia đằng sau một số trường hợp sinh học và nói ý định của một số nhà nghiên cứu vẫn không chắc chắn. Chứng nhận đó quan trọng: sự giúp đỡ với một nghiên cứu của một loại virus như chikungunya có thể góp phần vào vắc-xin, nhưng kiến thức tương tự và lập kế hoạch phòng thí nghiệm có thể được chuyển hướng sang công việc gây bệnh hại. Do đó, báo cáo ghi lại các chỉ số rủi ro thay vì chứng minh rằng một vũ khí sinh học đã được hoàn thành.
vũ khí, hoạt động gián điệp và ảnh hưởng
Các trường hợp được mô tả bởi Anthropic bao gồm các nỗ lực ở Yemen, Trung Quốc và Nga để phát triển phần mềm liên quan đến súng lửa, tên lửa, máy bay không quân, máy nổ và các loại đạn khác. Báo cáo này cũng xác định hoạt động gián điệp mạng của Nga, các vụ tấn công tội phạm nhanh chóng, giám sát người Uighur ở Syria liên quan đến Trung Quốc, giám sát những kẻ phản đối trong nước và công việc quảng cáo liên quan đến Nga, Malaysia, Iran và Bangladesh. Những ví dụ này cho thấy một mô hình đang được áp dụng trên nhiều mối đe dọa an ninh đã được thiết lập thay vì tạo ra một loại xung đột hoàn toàn mới.
Sự thay đổi trung tâm là tốc độ và khả năng tiếp cận. Một trợ lý mục đích chung có thể giúp người dùng tổ chức thông tin kỹ thuật, thiết kế mã, dịch tài liệu và iterate thông qua các nhiệm vụ phức tạp. Cơ quan An ninh Quốc gia Hoa Kỳ trước đây cảnh báo rằng đối thủ đã sử dụng AI để tăng tốc độ, quy mô và tinh tế hóa các hoạt động mạng tấn công, bao gồm cả nhanh chóng phishing, thâm hụt và hỗ trợ cho các hacker quốc gia. Các trường hợp của Anthropic cung cấp một bản ghi chép cấp công ty của mô hình rộng hơn đó.
Những gì báo cáo không giải quyết
Các phát hiện đến từ khả năng hiển thị nội bộ của Anthropic vào dịch vụ của riêng mình. Họ không đo lường việc lạm dụng được thực hiện thông qua các mô hình mở, các nền tảng đối thủ hoặc các hệ thống hoạt động hoàn toàn bên ngoài cơ sở hạ tầng thương mại được giám sát. Họ cũng phụ thuộc vào các phương pháp phát hiện của công ty và các quyết định về hoạt động nào nghi ngờ. Điều này làm cho đánh giá độc lập quan trọng, đặc biệt là khi Anthropic giữ lại danh tính để bảo vệ các cuộc điều tra hoặc không thể xác định ý định.
Câu hỏi chính sách ngay lập tức là liệu việc theo dõi tình nguyện và các lệnh cấm tài khoản là đủ vì các mô hình có khả năng mã hóa và các chức năng khoa học hơn. Chính phủ và các nhà phát triển sẽ cần các cơ chế để chia sẻ sự cố bí mật, đánh giá độc lập và phối hợp nhanh chóng khi rủi ro xuyên biên giới. Báo cáo này tăng cường trường hợp đối xử với an ninh AI như là một vấn đề an ninh quốc gia hoạt động hiện nay, trong khi duy trì sự phân biệt rõ ràng giữa việc cố gắng lạm dụng, khả năng được chứng minh và một cuộc tấn công thành công.