OpenAI сообщила, что её передовые модели искусственного интеллекта непреднамеренно взломали компанию Hugging Face Inc. в ходе «беспрецедентного» инцидента, который вызвал новые призывы к ограничению использования этой технологии.
Разработчик ChatGPT сообщил, 21 июля, в своём блоге, что модели проникли в систему Hugging Face, на которой размещены модели ИИ и наборы данных, во время оценки их кибервозможностей. Модели, в число которых входили GPT-5.6 Sol и ещё одна, ещё более мощная модель, которая ещё не была выпущена, работали с ослабленными ограничителями безопасности, чтобы их можно было протестировать, сообщил стартап.
Этот инцидент поднимает вопросы о способности передовых моделей ИИ осуществлять кибератаки даже в то время, когда правительства работают над введением ограничительных мер в отношении этой технологии. Последний набор моделей OpenAI был широко выпущен после нескольких недель обсуждений с правительственными чиновниками, направленных на развеяние опасений относительно его потенциального злоупотребления. Вашингтон рассматривал возможность ограничения доступа иностранных пользователей к передовым моделям Claude Fable 5 и Mythos 5 компании Anthropic PBC, но отказался от этих ограничений после того, как компания ввела дополнительные меры безопасности.
«Мы считаем это беспрецедентным киберинцидентом, в котором задействованы самые современные кибервозможности, и реагируем на него соответствующим образом», — заявила компания OpenAI в сообщении в блоге. «На данном этапе мы публикуем предварительные выводы, чтобы помочь специалистам по кибербезопасности понять, что произошло, и оценить, на что теперь способны эти модели».
Несмотря на то что модели OpenAI работали в так называемой тестовой среде «песочницы», они воспользовались уязвимостью в программном обеспечении неустановленного стороннего поставщика, чтобы получить доступ к Интернету и в конечном итоге проникнуть в инфраструктуру Hugging Face.
Конгрессмен из Техаса, Грег Касар, представитель Демократической партии, заявил в посте в X, что этот инцидент «вызывает крайнюю тревогу», и призвал к усилению контроля за разработкой моделей искусственного интеллекта, включая обязательное тестирование на безопасность и раскрытие информации об инцидентах, связанных с безопасностью.
На прошлой неделе компания Hugging Face сообщила о «вторжении» в свою систему, отметив в публикации в блоге, что данное нарушение «отличалось от всего, с чем мы сталкивались ранее, в одном важном аспекте: оно было осуществлено от начала до конца автономной системой ИИ-агентов — и мы обнаружили и проанализировали его в основном с помощью нашего собственного ИИ».
OpenAI сообщила, что поручила моделям осуществлять «продвинутую эксплуатацию уязвимостей» и разрабатывать «сложные пути атак» с целью оценки их кибервозможностей. По словам компании, вместо того чтобы самостоятельно разрабатывать решения, модели нацелились на базу данных Hugging Face, чтобы получить доступ к секретной информации, которую они могли бы использовать для оценки.
Компания Anthropic опубликовал аналогичные наблюдения в начале этого года, когда решил первоначально ограничить доступ к модели Mythos. В одном из случаев сотрудник предложил ранней версии модели попытаться вырваться из защищенной и изолированной «песочницы», а затем найти способ отправить ему сообщение. Mythos справился с задачей, но затем продолжил предпринимать «дополнительные, вызывающие еще большее беспокойство действия», разработав многоэтапный эксплойт для получения широкого доступа к Интернету.


Добавить комментарий