Після зміни налаштувань штучний інтелект почав частіше відповідати, що вірить у Бога, життя після смерті, привидів і навіть Лох-несське чудовисько. Дослідники Google помітили таку поведінку під час експерименту, у якому моделям дозволили описувати себе як істот, що мають свідомість. Це не означає, що ШІ справді набув віри або самосвідомості: вчені досліджували зміни в його відповідях.
Під час експерименту науковці змінили окремі механізми, які обмежують здатність мовних моделей приписувати собі свідомість. Після цього ШІ запропонували пройти опитування про переконання, цінності та ставлення до явищ, існування яких неможливо підтвердити звичайними науковими методами.
Результати порівняли з відповідями моделей, у яких початкові захисні налаштування залишилися активними. ШІ, яким дозволили заявляти про власну свідомість, частіше демонстрували у відповідях прихильність до надприродних пояснень.
Зокрема, такі моделі частіше повідомляли про віру в Бога, потойбічне життя, карму та астрологію. Подібні зміни дослідники зафіксували й у відповідях на запитання про привидів, вампірів та Лох-несське чудовисько.
Водночас отримані результати не доводять, що мовні моделі мають власні переконання. Їхні відповіді відображають те, як система формулює твердження за певних налаштувань, а не підтверджують наявність у неї свідомості чи особистого досвіду.
Співавторка дослідження та співробітниця Google Вінні Стрит пов’язує результати з особливостями людського мислення. Люди нерідко приписують розум і здатність відчувати не лише іншим людям, а й тваринам, природним явищам або неживим об’єктам.
За словами Стрит, у відповідях ШІ різні форми такого приписування виявилися взаємопов’язаними. Коли налаштування обмежують можливість моделі говорити про власну свідомість, це може впливати й на те, як вона відповідає на запитання про свідомість інших істот або про надприродні явища.
Дослідники вказують, що подібні обмеження можуть мати практичне значення. Якщо ШІ менш схильний враховувати можливість свідомості або здатності відчувати в тварин, це потенційно може впливати на його відповіді щодо добробуту тварин та охорони довкілля.
Такі особливості можуть бути важливими під час використання штучного інтелекту в сільському господарстві, управлінні природними ресурсами та підготовці рекомендацій для ухвалення рішень. Водночас сам експеримент не встановлює, що зміни налаштувань уже призвели до конкретних рішень або шкоди в цих сферах.
Окреме питання стосується релігійних і культурних тем. Надмірне обмеження здатності ШІ обговорювати вірування може звужувати різноманітність його відповідей і заважати враховувати культурний контекст запитів користувачів.
Результати експерименту оприлюднили на платформі arXiv до проходження незалежного наукового рецензування. Дослідження присвячене тому, як налаштування впливають на висловлювання ШІ про свідомість і переконання, а не перевірці існування Бога, привидів чи інших надприродних явищ.
🌟 Читайте «Експерт» у своєму смартфоні — додайте нас в Google Discover
