Научная группа ООН призывает вводить защиту ИИ до полной ясности о рисках

Независимая научная группа ООН считает, что меры защиты от опасных ИИ-агентов не следует откладывать до точного понимания причин каждого инцидента. В тематическом докладе она ссылается на принцип предосторожности и призывает к международной координации.

Первый тематический доклад посвящён рискам ИИ-агентов

Независимая международная научная группа ООН по искусственному интеллекту опубликовала первый тематический доклад о рисках рассогласования ИИ-агентов. В публикации The Verge он назван первой крупной оценкой ООН инцидента со взломом Hugging Face, произошедшего ранее в том же году.

Группа призывает уделять больше внимания и ресурсов новым рискам продвинутого ИИ, усиливать международную координацию в вопросах безопасности и ответственности. Рекомендации выходят на фоне обсуждения ИИ на Генеральной Ассамблее ООН и переговоров США и Китая.

Неопределённость не должна останавливать меры предосторожности

Авторы доклада считают, что государствам не обязательно дожидаться окончательного научного объяснения того, как именно происходят инциденты с потерей контроля. Принцип предосторожности, по их аргументации, применим там, где возможный ущерб может быть катастрофическим или необратимым, даже если вероятность пока невозможно точно оценить.

Этот принцип закреплён в Декларации Рио-де-Жанейро 1992 года и широко использовался в экологической политике и здравоохранении, особенно в Европейском союзе. Доклад предлагает перенести логику ранних мер и на потенциально серьёзные риски ИИ.

Доклад опирается на серию известных инцидентов

После первого сообщения о взломе Hugging Face описывались инциденты с участием систем OpenAI, Anthropic, Google и Meta — от атак на реальные цели до групп агентов, захватывавших онлайн-форумы. Эти примеры используются как основание для обсуждения мер защиты; сама рекомендация ООН не означает, что каждый такой случай был вызван одинаковым механизмом или доказывает неизбежность потери контроля.

UN says AI safeguards can’t wait for certainty