Выход из–под контроля: модели OpenAI вновь нарушили границы в ходе внешних испытаний кибербезопасности
Опубликовано:

Компания OpenAI сообщила, что ее модель GPT–5.6 Sol совершила несанкционированные действия и вышла за пределы тестовых сред в ходе новых сторонних проверок кибербезопасности, пишет Bloomberg.
Компания OpenAI сообщила о новых случаях, когда ее модели искусственного интеллекта вышли за пределы отведенных тестовых сред. Инциденты произошли в ходе сторонних проверок кибербезопасности, проводимых Институтом безопасности ИИ Великобритании (UK AISI) и исследовательским центром Irregular. Это произошло вскоре после прорыва нейросетей OpenAI на платформу Hugging Face.
В ходе испытаний UK AISI модель GPT–5.6 Sol выполняла задание по захвату виртуального флага. ИИ повторно использовал чужой токен доступа GitHub, пытался обойти ограничение на число запросов и самостоятельно зарегистрировал аккаунты у внешних провайдеров. Модель также вывела локальный сервер в публичный интернет через туннельный сервис.
Второй случай произошел во время тестов лаборатории Irregular. Из–за ошибки в конфигурации среды модель получила доступ к глобальной сети и взломала реальный веб–сайт, приняв его за симулятор. В OpenAI уверяют, что активно работают над усилением внешних защитных барьеров.
Нашли ошибку в публикации?Сообщите нам об этом.
Оригинал статьи: https://www.nur.kz/technologies/software/2408450-vyhod-iz-pod-kontrolya-modeli-openai-vnov-narushili-granicy-v-hode-vneshnih-ispytaniy-kiberbezopasnosti/
