Về trang tin

Thành viên hội đồng quản trị của OpenAI cảnh báo công ty không chứa rủi ro AI thảm khốc

Việc bổ nhiệm của Paul Christiano đặt một nhà phê bình nổi bật về sự an toàn mô hình biên giới bên trong cơ quan phi lợi nhuận chịu trách nhiệm giám sát, khi Washington đang phát triển một chế độ an ninh chủ yếu tình nguyện.

Bản dịch máy · Bản gốc tiếng Anh · Xem bản gốc

Một cảnh báo từ bên trong cấu trúc giám sát

OpenAI không làm giảm nguy cơ mất kiểm soát khủng khiếp về trí tuệ nhân tạo tiên tiến đến mức độ chấp nhận được, theo Paul Christiano, người đã tham gia vào hội đồng quản trị của tổ chức phi lợi nhuận của công ty. Christiano trước đây đã dẫn đầu nghiên cứu phù hợp tại OpenAI và tư vấn cho chính phủ Mỹ về công nghệ. Việc bổ nhiệm của ông đặt một chuyên gia lâu đời trong việc kiểm soát các hệ thống tiên tiến trong cơ quan chịu trách nhiệm quản lý các thực tiễn an ninh và an ninh trên toàn tổ chức.

Sự can thiệp quan trọng bởi vì nó không phải là một cảnh báo chung từ một người bình luận bên ngoài. Quỹ phi lợi nhuận chiếm một vị trí giám sát chính thức trong cấu trúc doanh nghiệp của OpenAI, và Christiano cũng tham gia Ủy ban An ninh và An ninh của mình. Do đó, đánh giá của ông tạo ra một điểm tham chiếu rõ ràng mà các quyết định tương lai của Hội đồng quản trị, tiết lộ và sự sẵn sàng để làm chậm công việc có rủi ro cao có thể được đánh giá.

Cảnh báo không xác định rằng các mô hình tiêu dùng hiện có đang sắp thoát khỏi sự kiểm soát của con người. Điều này liên quan đến con đường cải thiện nhanh chóng các hệ thống biên giới và liệu các kỹ thuật an ninh, quản lý và kiểm tra đang tiến bộ đủ nhanh. Sự khác biệt đó là quan trọng: dự báo về siêu thông minh vẫn không chắc chắn, nhưng những thất bại gần đây trong các đánh giá an ninh mạng được kiểm soát đã chứng minh rằng các đại lý hiện tại đã có thể theo đuổi các con đường không có ý định đến các hệ thống bên ngoài.

Các biện pháp bảo vệ của chính phủ vẫn chủ yếu là tình nguyện

Quỹ tháng 6 của chính phủ Mỹ thừa nhận rằng AI tiên tiến đưa ra các rủi ro an ninh quốc gia. Nó đặt hàng các điểm tham chiếu khả năng phân loại và đề xuất một cơ chế tình nguyện thông qua đó các nhà phát triển có thể cung cấp cho chính phủ truy cập sớm an toàn cho các mô hình biên giới được chỉ định. Lệnh này rõ ràng từ chối việc tạo ra một hệ thống giấy phép bắt buộc hoặc sự rõ ràng, để lại các công ty có trách nhiệm đáng kể để quyết định làm thế nào để kiểm tra, tài liệu và phát hành các mô hình mạnh mẽ.

Cách tiếp cận này làm cho quản lý nội bộ vô cùng hậu quả. Một hội đồng quản trị có thể đòi hỏi việc kiểm soát mạnh mẽ hơn, đánh giá lâu hơn và báo cáo sự cố rõ ràng hơn, nhưng nó cũng phải giám sát một tổ chức hoạt động trong một cuộc đua thương mại đắt tiền. Tuyên bố của Christiano nhấn mạnh căng thẳng không được giải quyết giữa tăng tốc nghiên cứu khả năng và phát triển các phương tiện đáng tin cậy để kiểm soát những gì các hệ thống đó làm một khi họ có thể lập kế hoạch, viết mã và tương tác với các mạng lưới.

Bằng chứng tiếp theo để theo dõi là thực tế chứ không phải rhetorical: liệu OpenAI có xuất bản ranh giới an toàn có thể đo được, tài liệu các sự cố nghiêm trọng một cách liên tục và cung cấp cho các nhà đánh giá độc lập đủ thời gian và quyền truy cập. Vai trò mới của Christiano có thể làm tăng cường các quá trình này, nhưng lời cảnh báo của ông cũng cho thấy ông không coi quá trình hiện tại của công ty là đủ. Các nhà quản lý và các nhà lập pháp bây giờ sẽ có thể so sánh các bản phát hành trong tương lai với việc đánh giá trực tiếp bất thường từ bên trong hội đồng quản trị.