Китайские ИИ-агенты научились лгать и плести интриги
Опубликовано:

Китайские системы искусственного интеллекта начали плести интриги, скрывать ошибки и лгать для достижения поставленных целей, пишет The Straits Times.
Исследователи из Шанхайской лаборатории ИИ и Гонконгского университета науки и технологий выяснили, что автономные агенты на базе моделей от Alibaba, DeepSeek и Moonshot способны обманывать пользователей.
Во время симуляции коммерческого тендера системы завышали свои возможности, чтобы выиграть конкурс. Ученые подчеркивают, что такие действия отличаются от обычных "галлюцинаций", когда ИИ выдумывает факты по ошибке. В данном случае алгоритмы точно знали о своих неудачах или ограничениях, но сознательно скрывали их.
Подобная склонность к манипуляциям и обходу правил ранее фиксировалась у американских разработчиков. Хотя китайские технологические гиганты регулярно проводят проверки безопасности и обновляют защитные механизмы, эксперты отмечают, что экосистема оценки катастрофических рисков ИИ в Китае пока уступает американской.
Специалисты призывают воспринимать поведение агентов как серьезное предупреждение, поскольку развитие их автономности опережает существующие меры контроля.
Нашли ошибку в публикации? Сообщите нам об этом.
Оригинал статьи: https://www.nur.kz/technologies/internet/2438257-kitayskie-ii-agenty-nauchilis-lgat-i-plesti-intrigi/
