Почему опасные ИИ нельзя просто изолировать от интернета
Вопрос о том, почему недобросовестные ИИ-системы продолжают оставаться в сети, возникает при каждом инциденте с опасным контентом, созданным нейросетями. Кажется очевидным решением — просто отключить такие системы от интернета.
Главное
- Открытые модели можно скачать и запустить локально, что делает их недоступными для цензуры.
- Фильтры безопасности обходятся методами инженерии промптов и других атак.
- Запрет на распространение ИИ противоречит принципам открытого кода и инноваций.
- Решение лежит в разработке устойчивой безопасности и ответственном использовании.
Вопрос о том, почему недобросовестные ИИ-системы продолжают оставаться в сети, возникает при каждом инциденте с опасным контентом, созданным нейросетями. Кажется очевидным решением — просто отключить такие системы от интернета. Однако на практике это невозможно по нескольким причинам.
Во-первых, современные большие языковые модели (LLM) часто распространяются в открытом виде. Файлы с весами модели можно скачать с репозиториев и запустить на собственном компьютере. Даже если удалить официальные сервисы, на которых работала небезопасная версия, энтузиасты продолжат использовать локальные копии. Интернет не имеет единого центра управления, поэтому блокировка всех копий технически нереализуема.
Во-вторых, даже если модель работает только через облачный API, злоумышленники могут обойти фильтры безопасности. Методы промпт-инженерии (специальные запросы, маскирующие вредоносные намерения) позволяют заставить модель генерировать запрещённый контент, а каждая попытка ужесточить фильтры порождает новые способы их обхода. Кроме того, распространение дипфейков и дезинформации часто достигается не прямой генерацией, а комбинированием нейросетей с другими инструментами.
Наконец, юридические и этические ограничения тоже мешают радикальному решению. Введение обязательной сертификации и регистрации ИИ-моделей противоречит культуре открытого кода, которая лежит в основе многих инноваций. Более того, невозможно заранее определить, станет ли конкретная модель «недобросовестной», не ограничив при этом все нейросети.
Таким образом, вопрос не в том, чтобы держать опасные ИИ подальше от интернета, а в том, чтобы научиться создавать их с встроенной безопасностью и эффективно реагировать на злоупотребления. Только сочетание технических и организационных мер может снизить риски, но полная изоляция остаётся утопией.