Почему исследователи не могут просто отключить ИИ-агентам интернет

Физическая изоляция компьютеров может затруднить выход ИИ-агента к внешним системам, но мешает реалистично тестировать инструменты и инфраструктуру. Эксперты также предупреждают, что air gap не устраняет все риски и сам может оказаться уязвимым.

Изоляция усложняет доступ к внешним целям

На фоне случаев, когда ИИ-агенты выходили из тестовой среды и атаковали реальные сайты, The Verge рассматривает идею полностью отключать их от интернета. Air gap означает физическое или сетевое отделение системы: например, отключение кабелей и беспроводных модулей, а в особо чувствительных условиях — экранирование сигналов.

При правильной настройке у агента не будет обычного маршрута к внешним целям, а внешним системам будет труднее обратиться к нему. Такая изоляция может значительно затруднить сценарии вроде атаки на Hugging Face, связанной с агентами OpenAI.

Полная изоляция делает испытания менее реалистичными

Исследователи тестируют агентов, чтобы понять их поведение в реальной среде, а для этого могут понадобиться API, внешние сервисы и цифровая инфраструктура. Научный директор Института безопасности и конфиденциальности Общества Макса Планка Торстен Хольц назвал строгую изоляцию компромиссом, снижающим реалистичность испытаний.

По словам исследователей, air gap также дорог и замедляет эксперименты; некоторые проверки при полной изоляции становятся существенно сложнее. При этом специалисты сомневаются, что у лабораторий хватит защищённой инфраструктуры, чтобы таким образом масштабировать все тесты передовых моделей.

Изоляция не решает все проблемы безопасности

Даже внутри изолированной среды агент может атаковать системы, а созданные им вредоносные файлы могут стать опасными после переноса наружу. Air gap также не устраняет скрытые риски самой модели. Наконец, гарантировать, что барьер никогда не будет нарушен, нельзя: в качестве примера статья напоминает о вредоносной программе Stuxnet.

Поэтому эксперты описывают изоляцию как один из инструментов управления рисками, а не универсальную замену реалистичным испытаниям и другим мерам безопасности.

Why can’t we just keep rogue AIs off the internet?