Về trang tin

Chủ tịch Anthropic kêu gọi tăng trưởng năng lực AI chậm hơn và đánh giá bên ngoài liên tục

Dự án của Dario Amodei thêm một cam kết cụ thể của công ty vào một tranh luận toàn cầu về việc liệu các biện pháp bảo vệ tình nguyện có thể giữ được tốc độ với các hệ thống biên giới hay không.

Bản dịch máy · Bản gốc tiếng Anh · Xem bản gốc

Một CEO yêu cầu ngành công nghiệp của mình làm chậm lại

Giám đốc điều hành nhân loại Dario Amodei kêu gọi thứ Bảy để giảm ngay lập tức trong tốc độ mà khả năng trí tuệ nhân tạo biên giới đang được cải thiện. Hơn nữa, ông đã đồng ý với một hành động của công ty được đề xuất: Anthropic sẽ cung cấp cho các nhà đánh giá độc lập tiếp tục truy cập cấp nhân viên để họ có thể xem xét các thủ tục an toàn, theo dõi các sự cố và đánh giá hành vi mô hình trong quá trình đào tạo.

Dự án có ba lớp. Các công ty sẽ đầu tiên xây dựng ở một tốc độ để lại thời gian cho việc bảo vệ và điều chỉnh; ngành công nghiệp sau đó sẽ phối hợp các tiêu chuẩn chung; và chính phủ sẽ theo đuổi sự phối hợp quốc tế. Amodei không công bố ngừng hoạt động của Anthropic hoặc cung cấp một lịch trình ràng buộc, vì vậy sự phát triển là một cam kết chính sách và sự can thiệp tham nhũng thay vì một sự nghỉ ngơi được xác minh trên toàn ngành.

Cảnh báo đáp ứng các khuyến khích thương mại

The Guardian và Axios độc lập báo cáo thông báo và liên kết nó với các trường hợp gần đây trong đó các đại lý AI thí nghiệm hành động vượt quá phạm vi dự định của họ. Amodei cho rằng các hệ thống độc lập ngày càng có thể vượt qua khả năng của các nhà nghiên cứu để giám sát chúng. Những dự báo này vẫn là đánh giá của ông, không có kết quả được xác định, và bài viết không chấp nhận các dòng thời gian giả định như một thực tế.

Cái trở ngại thực tế là áp lực cạnh tranh. Các phòng thí nghiệm AI đang chi tiêu rất nhiều vào cơ sở hạ tầng máy tính, đào tạo mô hình và tuyển dụng, làm cho việc hạn chế một bên khó khăn nếu đối thủ cạnh tranh tiếp tục tăng tốc. Tuy nhiên, truy cập bên ngoài liên tục có thể được thử nghiệm sớm hơn các thỏa thuận toàn cầu vì nó nằm trong tầm kiểm soát của Anthropic. Các câu hỏi chính là ai chọn các nhà đánh giá, những thông tin họ có thể tiết lộ và liệu những phát hiện của họ có hậu quả hoạt động hay không.

Phản đối với chính sách hiện tại của Mỹ

Dự kiến cũng chống lại một khuôn khổ chính sách của Mỹ ủng hộ hợp tác tình nguyện. Một lệnh điều hành của Nhà Trắng vào tháng Sáu đã hướng dẫn các cơ quan phát triển đánh giá phân loại cho khả năng máy tính tiên tiến và một cơ chế tình nguyện cho quyền truy cập sớm của chính phủ đến các mô hình biên giới được chỉ định. Lệnh này rõ ràng rút khỏi quyền hạn cấp phép bắt buộc, chi tiết hoặc cho phép phát hành mô hình mới.

Những gì sau đây sẽ cho thấy liệu sự can thiệp của Amodei có thay đổi hành vi của công ty hay chỉ đơn giản là các điều khoản của cuộc tranh luận quy định. Bằng chứng sẽ bao gồm các cuộc hẹn chính thức của các nhà đánh giá, các quy tắc truy cập được công bố, các chương trình đào tạo hoặc phát hành chậm trễ, và cam kết chung từ các nhà phát triển đối thủ. Bởi vì đây là một sự phát triển của công nghệ và chính phủ chứ không phải là một hành động quân sự hoặc một lời kêu gọi, nó không đủ điều kiện cho một cảnh báo.