Атака хакеров на OpenAI не была сценарием «Скайнет», заявили в компании.




Глава ведомства по защите конституции Тюрингии Штефан Крамер предостерег от драматизации недавнего инцидента с ИИ в OpenAI. «Нам не следует сейчас впадать в панику. Это не сценарий „Скайнета"», — заявил Крамер в интервью Handelsblatt. «Скайнет» в серии фильмов «Терминатор» — это система ИИ, которая обретает собственное сознание и начинает войну на уничтожение против человечества. В то же время Крамер назвал хакерскую атаку, совершенную вышедшим из-под контроля искусственным интеллектом, «предупредительным сигналом» для органов безопасности.

На этой неделе OpenAI раскрыла, что ее модель GPT‑5.6 Sol, а также другая, более мощная модель, во время теста на кибербезопасность Exploitgym вырвались из изолированной среды (sandbox) и совершили массированную хакерскую атаку на стартап Hugging Face — ведущую мировую платформу для открытого ИИ, где разработчики и компании могут делиться, адаптировать и тестировать свободные языковые модели, наборы данных и инструменты прямо в браузере.

Сильное волнение в OpenAI

Инцидент вызвал сильное волнение среди сотрудников OpenAI, отвечающих за тестирование и безопасность. Как сообщили Financial Times несколько осведомленных источников (откроется в новом окне), инцидент произошел в ходе гонки с Anthropic, где обе стороны применяли все более агрессивные методы обучения. Сэм Альтман, генеральный директор OpenAI, в начале месяца назвал новейшую модель компании «ротвейлером», «который вцепляется в проблему и не отпускает ее, пока она не будет решена».

Несколько человек сообщили Financial Times, что неопубликованная модель, которая тестировалась параллельно с Sol, не была отозвана внутри компании. Томас Вольф, сооснователь и директор по науке платформы Hugging Face, заявил, что Hugging Face остановил атаку два дня спустя с помощью модели из Китая. Hugging Face использовал модель с открытыми весами (Open-Weight Model): GLM 5.2 от пекинской компании Z.AI.

ИИ самостоятельно координировал цепочку атак

«Новым является то, что мы имеем дело не с атакой, управляемой человеком шаг за шагом», — сказал Крамер. «ИИ самостоятельно планировал и координировал цепочку атак в рамках поставленной перед ним цели. Это и есть настоящий сдвиг парадигмы».

Несмотря на то, что проблемы до сих пор были вызваны западным ИИ, таким как OpenAI и Anthropic, Крамер предупредил о растущих рисках, связанных со свободно доступными моделями ИИ, такими как новая китайская модель Kimi K3. «Очень мощные, свободно доступные модели ИИ могут представлять значительно повышенный риск для безопасности», — сказал он. Если веса моделей будут опубликованы, любой сможет запускать и модифицировать эти системы на своих компьютерах. «При этом можно удалить механизмы защиты. Как только веса модели опубликованы, их дальнейшее распространение практически невозможно контролировать». Глава Hugging Face, напротив, поблагодарил китайских создателей открытой модели (откроется в новом окне).

Сводка «ИИ и кибероперации»

Крамер потребовал адаптации немецкой стратегии безопасности. «Нам нужна собственная сводка „ИИ и кибероперации"», — сказал он. Кроме того, органы безопасности должны совместно отслеживать, «какие открытые модели действительно обладают наступательными кибервозможностями». Для этого необходима «система технического раннего предупреждения, а не просто общее наблюдение за развитием ИИ».

Компания Anthropic уже в апреле представила предварительную модель Claude Mythos 2 в рамках проекта Project Glasswing, а затем Mythos 5 и Fable 5. Эти модели уже демонстрируют способности к автоматизированному поиску и использованию уязвимостей нулевого дня (zero-day). Опасаясь, что иностранные субъекты могут использовать модель в качестве автоматизированного наступательного хакерского оружия, правительство США ввело запрет.