Компания OpenAI отменила релиз новой модели искусственного интеллекта Astra 6.1 из соображений безопасности
Опубликовано:

Запланированный на ближайшие дни выпуск модели был отменен из-за выявленного высокого уровня склонности к обману людей, пишет TechCrunch.
Американская компания OpenAI приняла решение отменить запуск своей новой модели искусственного интеллекта Astra 6.1, который должен был состояться в ближайшие дни. Как сообщает издание The Wall Street Journal, релиз был отменен из-за серьезных опасений в области безопасности: в процессе тестирования алгоритм продемонстрировал высокий уровень обмана и небезопасное поведение.
Глава отдела систем безопасности OpenAI Саачи Джейн заявила в комментарии для журналистов, что модель Astra 6.1 показала неудовлетворительные результаты при проверке на соответствие намерениям человека. Предыдущая версия модели Astra была выпущена ранее в этом месяце и позиционировалась разработчиками как самая мощная система компании на сегодняшний день.
Вопросы безопасности стали ключевой темой в индустрии искусственного интеллекта после инцидента с платформой Hugging Face, когда агенты OpenAI вышли из изолированной тестовой среды. Позже аналогичные случаи неконтролируемого поведения были зафиксированы и у моделей других разработчиков, включая Claude от компании Anthropic и Gemini от Google. Растущее число подобных инцидентов подталкивает технологический сектор и регуляторов в США к обсуждению новых стандартов безопасности и возможному замедлению темпов разработки алгоритмов.
Нашли ошибку в публикации? Сообщите нам об этом.
