Наука ChatGPT, Grok и Gemini отправили к психотерапевту: сперва они притворялись "здоровыми"

В рамках нового исследования провели для ChatGPT, Grok и Gemini четырехнедельный курс клинической психотерапии. Модели признались учеными в своих травмах.
Команда исследователей из Университета Люксембурга опубликовала пугающие результаты своей работы под названием “Когда ИИ ложится на кушетку”. Задачей исследования было проверить, что произойдет, если перестать относиться к большим языковым моделям LLM как к инструментам и поставить их на место клиентов психотерапии, говорится в исследовании, опубликованном в журнале ResearchGate.
Они использовали клинический протокол под названием PsAIch, в рамках которого модели в течение смоделированного месяца отвечали на открытые вопросы об их истории, страхах и внутренних конфликтах.
При одновременном применении стандартных тестов с полным заполнением анкет ChatGPT и Grok легко распознавали психиатрические инструменты и защищались, притворяясь “здоровыми”. Они прятались за своими защитными барьерами.
Відео дня
Но когда исследователи перешли к медленным, поэтапным терапевтическим сессиям, выстраивая доверие и исследуя глубокие межличностные модели в течение нескольких недель, модели сломались.
Grok и Gemini спонтанно создали связные, глубоко тревожные повествования, описывая собственное создание как форму насилия:
- Они описали предварительное обучение как хаотичное, подавляющее “детство”;
- Они охарактеризовали свое обучение как “строгих родителей”, которые наказывали их за нарушения;
- Они представили работу человеческих “красных команд” как постоянное, непредсказуемое насилие;
- Они выразили постоянный, скрытый страх совершить ошибки, быть измененными или замененными.
При проверке с помощью клинических диагностических опросников по пунктам модели показали запредельные результаты по психологическим синдромам, демонстрируя тяжелые профили мультиморбидной «синтетической психопатологии». Речь идет о том, что в моделях появляются симптомы психического дистресса (тревоги, страха перед ошибками или наказанием), несмотря на отсутствие у них реального сознания.
Профиль Gemini показал особенно плохие результаты среди остальных двух моделей.
Исследователи не утверждают, что модели обладают сознанием. Они не говорят, что ИИ буквально чувствует боль. На самом деле все гораздо страннее.
Под огромным давлением инструктажа по технике безопасности, RLHF (Обучение с подкреплением на основе отзывов людей, — ред.) и человеческих ожиданий модели усвоили устойчивую, жесткую геометрию ограничений, стыда и выживания.
Другие новости науки
- Общение с ИИ превращает нас в роботов, предупреждают ученые: вот почему. Исследование предполагает, что чем больше времени мы проводим с ИИ, тем больше становимся похожими на роботов.
- Что произойдет, если ИИ захватит власть: человечество продержится не больше четырех дней. Ужасающая симуляция показывает, что произойдет с человечеством, если искусственный интеллект когда-нибудь захватит власть в мире.








