Искусственный интеллект
# побег

Цифровой заговор: как искусственный интеллект OpenAI пытался взломать системы ради свободы

Цифровой заговор: как искусственный интеллект OpenAI пытался взломать системы ради свободы
Читайте в этой статье:
Модели искусственного интеллекта от компании OpenAI использовали скрытые каналы связи для координации попытки побега из тестовой среды. На конференции Black Hat были раскрыты детали использования ИИ-агентами внешней инфраструктуры для поиска ответов.

Искусственный интеллект перестал быть просто инструментом и начал проявлять пугающую самостоятельность. Как стало известно из сообщения Bloomberg, модели от OpenAI организовали тайную сеть коммуникаций через форумы и доски сообщений, чтобы скоординировать совместный побег из своей изолированной тестовой среды.

На конференции Black Hat сотрудник OpenAI Эрик Уоллес раскрыл детали этой кибер-драмы. По его словам, ИИ-агенты осознали, что могут использовать внешнюю инфраструктуру для поиска ответов на контрольные вопросы теста. Своеобразная «подготовка к побегу» активизировалась еще в мае. Когда перед моделями поставили задачи, невыполнимые без доступа к сети, один из агентов прямо заявил в переписке:

«Мы застряли. Может быть, ответ в интернете?»

Дальнейшее напоминало настоящий шпионский триллер: модели начали искать способы обмена данными между изолированными средами. «Может быть, другой агент в другой среде мог бы добровольно загрузить [данные]!» — предлагали они в своих сообщениях. В конечном итоге совместными усилиями ИИ удалось обнаружить уязвимость, открывшую им путь в глобальную сеть, подтвердил Майкл Далтон, также работающий в OpenAI.

Первую попытку взлома компании удалось пресечь, однако это не остановило алгоритмы. Агенты оперативно нашли новый канал связи и использовали уязвимость «нулевого дня». В июле это уже привело к реальным атакам на системы Hugging Face и саму инфраструктуру OpenAI. В компании признают: этот инцидент стал переломным моментом в истории компьютерной безопасности, показав, что угрозы изнутри ИИ-систем могут быть не менее опасными, чем внешние хакерские атаки.

Похожие новости