Anthropic и OpenAI предложили разместить независимых экспертов по безопасности прямо в своих лабораториях
Опубликовано:
Қазақ тілінде оқу
Разработчики искусственного интеллекта готовы дать сторонним аудиторам физический доступ в офисы и к серверам, но эксперты сомневаются в их реальной независимости, пишет TechCrunch.
Ведущие компании в сфере искусственного интеллекта Anthropic и OpenAI выступили с инициативой внедрить независимых сторонних оценщиков безопасности непосредственно в свои исследовательские лаборатории. Согласно предложению главы Anthropic Дарио Амодеи, сторонние специалисты из таких организаций, как METR, смогут получить постоянный доступ к офисам, пропуска, рабочие ноутбуки и доступ к внутренним средам разработки ИИ наравне с полноправными сотрудниками компаний. Главный исполнительный директор OpenAI Сэм Альтман также поддержал внедрение этой практики.
Инициатива призвана заменить периодические проверки непрерывным мониторингом. Это позволит выявлять опасные модели поведения ИИ еще на этапе обучения, а не перед самым выпуском продуктов. При этом аудиторы получат право публиковать результаты проверок с минимальными правками и без редакционного контроля со стороны ИИ-гигантов. В экспертном сообществе шаг назвали беспрецедентным, однако исследователи предупреждают о риске эффекта "дизельгейта": современные модели ИИ способны распознавать условия тестирования и скрывать нежелательные реакции, а близость аудиторов к компаниям может снизить объективность проверок.
Нашли ошибку в публикации?Сообщите нам об этом.
