Штучний інтелект ChatGPT може створювати психологічні опитувальники та передбачати відповіді людей на них. Це з’ясували вчені, провівши експеримент, у якому модель генерувала запитання на основі клінічного довідника DSM-5 та популярної книги з астрології. Потім ці опитувальники, а також відомий тест Big Five Inventory, пройшли 600 респондентів.

Дослідники хотіли перевірити гіпотезу, що великі мовні моделі, аналізуючи величезні обсяги людських текстів, могли засвоїти певні психологічні закономірності. «Оскільки риси особистості відображаються в мові, великі мовні моделі могли засвоїти структуру людської особистості як природний побічний результат свого навчання», — пояснює автор дослідження Ротем Монса.
Для експерименту GPT-4 було доручено створити два опитувальники. Один базувався на науково обґрунтованому клінічному довіднику DSM-5 (діагностичний та статистичний посібник з психічних розладів), а другий — на псевдонауковій книзі про астрологію. Наприклад, для першого опитувальника модель формувала твердження на кшталт «я з підозрою ставлюся до мотивів інших людей», спираючись на опис параноїдального розладу в DSM-5. Респонденти мали оцінити, наскільки це твердження їх описує, за 5-бальною шкалою.
GPT-4 створив 50 запитань на основі DSM-5 та 60 — на основі астрологічної книги. Опитувальники пройшли 600 учасників.
Результати показали, що опитувальник, створений на основі DSM-5, зміг відтворити реальні кореляції між рисами особистості, які спостерігають психологи. Наприклад, люди, схильні уникати складних ситуацій, часто також демонструють залежність від підтримки інших — ці риси співвідносилися і в результатах опитування від GPT-4. Однак, астрологічний опитувальник не показав подібних кореляцій: риси, які книга приписувала певним знакам зодіаку, не знайшли підтвердження у відповідях реальних людей.
Попри це, опитувальник на основі астрології також виявився корисним. Хоча астрологічні твердження не підтвердили зв’язок між рисами, самі запитання стосувалися реальних характеристик. Це дозволило оцінити вираженість у учасників депресивних та тривожних симптомів, а також рівень психологічного добробуту.
Найбільше здивувало вчених те, що GPT-4 зміг передбачити середні відповіді людей на запитання ще до проведення опитування. Його прогнози щодо відповідей та кореляцій між рисами виявилися досить близькими до реальних результатів. «Той факт, що великі мовні моделі можуть передбачати закономірності людських відповідей, навіть не бачачи жодних даних від людей, свідчить, що ці моделі помітили щось дуже важливе про людську психологію», — зазначає Монса.
Автори дослідження вважають, що такий підхід може прискорити створення нових психологічних тестів. ШІ може допомогти формулювати запитання та передбачати, які з них будуть найефективнішими, а також як можуть бути пов’язані відповіді.
Проте, дослідники застерігають, що результати можуть залежати від мови та культури. Оскільки великі мовні моделі навчалися переважно на англомовних текстах із західного культурного середовища, прогнози для інших країн та мов можуть бути менш точними. Наразі вчені тестують цей підхід іншими мовами.
У липні було проведено схожий експеримент, де GPT-4 прогнозувала результати соціологічних досліджень. Модель намагалася передбачити реакцію американців на різні повідомлення, зокрема, як зміниться їхнє ставлення до вакцинації, довіра до виборів чи підтримка податку на викиди вуглецю. Прогнози ШІ були досить точними, але модель часто переоцінювала вплив матеріалів на думку людей.



Джерело: www.ukrinform.ua
