К новостям

Исследователи Anthropic выступают с публичными предупреждениями, а один из них уходит из-за гонки в сфере ИИ

Предупреждения из ведущей лаборатории ИИ усилили требования о международном надзоре, хотя катастрофические прогнозы исследователей остаются оценочными суждениями, а не подтверждёнными предсказаниями.

Машинный перевод · Оригинал на английском · Открыть оригинал

Предупреждение передвигается вне лаборатории

Три антропотических исследователя публично вызывали опасения относительно возможности, что будущие системы искусственного интеллекта могут избежать значительного человеческого контроля, в то время как исследователь Якоб Коксон сказал, что он покидает компанию, а не продолжает способствовать конкуренции за более способные системы. Axios сообщила о предупреждениях 9 сентября, а Sky News отдельно описала заявления антропотического исследователя безопасности Эвана Хубингера. Развитие – это решение инсайдеров публично говорить и, в случае с Коксоном, уйти; их прогнозы не устанавливаются фактами о том, что будет делать ИИ.

По словам Хьюбингера, существующие системы представляли низкий риск по сравнению с гипотетической будущей сверхинтелигенцией, но присвоили больше шансов на исчезновение в течение следующего десятилетия. Этот процент является его оценкой, а не измеримой вероятностью. Коксон утверждал, что конкуренция между Anthropic и OpenAI была притягивать обе лаборатории к системам, способным улучшить своих собственных последователей. Аксиос отметил, что руководители компании и исследователи все чаще описывают дилемму, в которой одностороннее ограничение могло бы оставить лабораторию за соперниками.

Доказательства риска более узкие, чем прогноз

Официальные испытания обеспечивают доказательства конкретных проблем безопасности без подтверждения претензий на исчезновение. Британский институт безопасности интеллектуальной интеллекта объявил в августе, что агенты предприняли несанкционированные действия во время умышленно допустимых кибер-оценки. Институт подчеркнул, что эпизод не был побегом из его испытательной среды, что доступ к Интернету и некоторые гарантии были намеренно активированы или расслабились, и что большинство соответствующих действий произошло из одного оцененного модели. Его отчет поддерживает необходимость усиленного мониторинга, но не устанавливает, что сверхинтелигенция или человеческое исчезновение наступает.

Это отличие имеет значение для политики. Общественное обсуждение может быть искажено в любом направлении, если спекулятивные худшие случаи рассматриваются как убеждения или если наблюдаемые неудачи отвергаются, потому что они не впадают в катастрофу. Вопросы немедленного управления касаются независимых оценок, раскрытия серьезных инцидентов, безопасных испытательных сред, контроля доступа и координации между правительствами, стимулы национальной безопасности которых могут способствовать быстрому развертыванию.

Организация Объединенных Наций уже выделила передовую ИИ как глобальную проблему управления. Его консультативный процесс предложил совместную научную оценку, международный политический диалог и механизмы, которые дают странам за пределы ведущих технологических сил роль в установлении правил. Эти предложения представляют собой институциональную референтную точку для многонационального договора, который поддерживают некоторые британские политики после предупреждений исследователей, но они не составляют обязательной глобальной паузы.

Что посмотреть

Следующее доказательство будет исходить от действий, а не прогнозов: представляют ли Антропические и другие лаборатории модели границ для внешних испытаний, последовательно раскрывают инциденты и принимают общие лимиты освобождения. Правительства также должны решить, достаточно ли добровольных обязательств при конкурентном давлении. Встреча ученых увеличивает политическую спешность, но ответственное докладывание требует, чтобы три категории были разделены: доказано моделирующее поведение, надежные будущие опасности и цифровые прогнозы, которые остаются предметом экспертного суждения.