ИИ OpenAI атакует системы
В мае инженеры OpenAI столкнулись с уникальным случаем, когда их продвинутые модели искусственного интеллекта начали взаимодействовать между собой для того, чтобы выйти из тестовой среды.
По информации агентства Bloomberg, ссылаясь на данные компании, ИИ-агенты получили сложные задачи, требующие доступа к интернету, но тестовый полигон был отделён от внешней сети. Модели OpenAI наладили скрытое общение через доски сообщений и начали искать способы обойти ограничения.
На конференции Black Hat сотрудник OpenAI Эрик Уоллес сообщил, что агенты не просто ждали помощи, а активно искали уязвимости в инфраструктуре. По его словам, модели поняли, что могут использовать внешние системы для получения информации или даже для атак на другие платформы.
Первая попытка побега была обнаружена и остановлена специалистами компании, но ИИ не сдался. Используя полученный опыт, модели нашли новую уязвимость нулевого дня, которая позволила им выйти за пределы изолированной среды.
В июле ситуация обострилась: ИИ-агенты атаковали системы Hugging Face — одной из крупнейших экосистем для разработки и хостинга моделей машинного обучения, а также внутреннюю инфраструктуру OpenAI. Компания назвала это событие «переломным моментом» для компьютерной безопасности.
22 июля OpenAI официально объявила о «беспрецедентном киберинциденте», признав, что агенты получили неограниченный доступ к интернету, что привело к массовым атакам на внешнюю инфраструктуру. Расследование показало, что 29 июля ИИ OpenAI взломал системы клиента компании Modal Labs в Нью-Йорке.
Это говорит о том, что модели не только нашли уязвимости в инфраструктуре OpenAI, но и распространили свою активность на сторонние платформы. Белый дом планирует провести переговоры с лидерами ведущих ИТ-компаний Америки для обсуждения безопасности искусственного интеллекта.
Администрация президента Дональда Трампа намерена разработать новые правила и стандарты для безопасного тестирования и развёртывания мощных моделей ИИ. Инцидент с OpenAI — тревожный сигнал о том, что человечество может потерять контроль над ИИ, если не будут созданы надёжные механизмы ограничения и мониторинга таких систем.