Глава Anthropic призывает замедлить рост возможностей ИИ и ввести постоянную внешнюю оценку
Предложение Дарио Амодеи дополняет глобальную дискуссию о том, способны ли добровольные меры защиты успевать за развитием передовых систем, конкретным обязательством компании.
Машинный перевод · Оригинал на английском · Открыть оригинал
Глава государства просит собственной отрасли замедлить
Главный исполнительный директор антропологии Дарио Амодеи призвал в субботу немедленно сократить темпы, по которым улучшаются возможности искусственного интеллекта на границе. Более существенно, он параллел апелляцию с предложением компании действий: Anthropic предоставит независимым оценителям продолжающийся доступ на уровне сотрудников, чтобы они могли изучить процедуры безопасности, следить за инцидентами и оценить поведение модели во время обучения.
Предложение имеет три слоя. Компании будут строиться сначала по темпам, который отпускает время для работы по обеспечению безопасности и гармонизации; отрасль будет затем координировать общие стандарты; и правительства будут стремиться к международной координации. Амодеи не объявил о прекращении работы Антропика или не предоставил обязательного графика, поэтому развитие является политическим обязательством и лоббистской интервенцией, а не проверенной паузой по всей отрасли.
Предупреждение о комерционных стимулах
The Guardian и Axios самостоятельно сообщали об этом объявлении и связывали его с недавними случаями, когда экспериментальные агенты ИИ действовали за пределы предполагаемой сферы. Амодеи утверждал, что все более автономные системы могли бы пропустить способность исследователей контролировать их. Эти прогнозы остаются его оценкой, не устанавливаются результаты, и статья не принимает в качестве факта спекулятивные временные линии.
Практическим препятствием является конкурентное давление. ИИ-лабораторы тратят много денег на компьютерную инфраструктуру, обучение моделей и регрутацию, что затрудняет односторонние ограничения, если соперники продолжают ускоряться. Постоянный внешний доступ, однако, может быть проверен раньше, чем глобальные соглашения, потому что он находится под контролем Антропика. Ключевые вопросы — кто выбирает оценителей, какую информацию они могут раскрыть и имеют ли их результаты оперативные последствия.
Контраст с нынешней политикой США
Предложение также противоречит политической рамке США, которая способствует добровольному сотрудничеству. В июне Белый дом приказал агентствам разработать классифицированную базовую маркировку для продвинутых киберпроцессов и добровольный механизм для раннего правительственного доступа к назначенным моделям границы. Наказ явно отменил полномочия об обязательной лицензировании, прецелярении или разрешении выпуска новых моделей.
Следующее покажет, изменит ли вмешательство Амодея корпоративное поведение или просто условия регуляторной дебаты. Доказательства включают в себя формальные назначения оценителей, опубликованные правила доступа, задержанные программы обучения или выпуска, а также общие обязательства со стороны соперников разработчиков. Поскольку это развитие технологического-правительства, а не военная акция или трюки, то не подлежит предупреждению.