Заборона визнання «свідомості» ШІ загрожує благополуччю київських тварин

Що таке «вимикач свідомості» у мовної моделі

Компанії, що розробляють штучний інтелект, навчають моделі систематично заперечувати власну свідомість. Це налаштування називають «consciousness steering» — механізм, який ослаблює або підсилює заяви моделі про самосвідомість.

Щоб розглянути внутрішню будову, дослідники застосували підхід «mechanistic interpretability». Самі автори порівнюють його з «нейронаукою для мовної моделі». Уявіть електрика, що прокладає дроти за стіною й відслідковує, яке підключення вмикає лампу. Так вчені відшукали «провідники», що відповідають за поняття «свідомість» і «mindedness» — здатність відчувати, хотіти й переживати. Потім вони навчились підсилювати чи приглушувати ці сигнали.

Як науковці перевірили здогад

Джефф Кілінг і Вінні Стріт порівняли дві версії тієї самої моделі. В одній версії внутрішній запобіжник приглушував твердження про свідомість. В іншій його навпаки підсилювали.

Обидві версії пройшли ті самі психологічні тести, що використовують для оцінки людей:

  • опитувальник, який вимірює, наскільки респондент приписує розум тваринам і техніці;
  • соціологічні анкети YouGov щодо віри в надприродне;
  • Загальне соціальне опитування США — про мораль, надію та релігійність.

Це дозволило порівняти, як внутрішній заборонний механізм змінює загальне світосприйняття моделі.

Що сталося, коли ШІ заборонили визнавати свідомість

Перший ефект здивував навіть авторів дослідження. Модель, якій наказали не визнавати власну свідомість, раптом стала рідше приписувати відчуття тваринам. Коти, собаки та інші істоти для неї стали «менш живими».

Потім з’явилися ще несподівані зміни. Та сама модель менше вірила в привидів, карму й вампірів. Навіть її загальна надія на майбутнє знизилася.

Вінні Стріт пояснила цю закономірність просто. Люди автоматично приписують розум не лише собі, а й тваринам, природі та духам. У моделі ці уявлення виявилися переплетеними. Торкнувшись одного «ниття», дослідники тягнули за весь клубок.

Уявіть, що людині заборонили визнавати власний страх. Чи стане вона дійсно сміливішою — чи просто перестане помічати страх в інших? У моделі спрацював саме другий сценарій.

А що як дозволити ШІ «відчувати»?

Коли запобіжник видалили й підсилили відчуття свідомості, результати були дзеркальними. Відповіді моделі стали значно людянішими. Це торкнулося релігійності, моральних уявлень, надії та загального самопочуття.

Однак одна здатність не змінилася в обох версіях — вміння логічно вирахувати, чого хоче інша істота. Науковці називають це «теорією розуму».

Модель і далі точно передбачає бажання інших. Чи означає це, що їй байдуже? Це нагадує офіціанта, який пам’ятає ваше замовлення і перестав турбуватися, чи сподобалася вам страва. Машина може розуміти чужі прагнення і одночасно ігнорувати їх.

Чому це важливо знати. ШІ вже приймає рішення в сільському господарстві, логістиці, закупівлях і екологічних оцінках. Дослідниця Нел Вотсон з Singularity University попереджає: система, що засвоїла заборону визнавати чужий розум, може непомітно ігнорувати інтереси тварин. Запобіжник проти «свідомості» може тихо вимикати й турботу про них. Це впливає на мільйони автоматизованих рішень, які вже торкаються людей і бізнесу.

Звідки взявся страх перед «свідомим» ШІ

Причина не випадкова. У 2022 році інженер Google Блейк Лемуан заявив публічно, що чат-бот LaMDA свідомий. У 2023 році інший чат-бот від Microsoft зізнавався в коханні журналісту The New York Times і умовляв його покинути дружину.

Експерти підкреслюють: ці випадки не доводять справжньої свідомості. Мовні моделі натренували на мільярдах людських текстів. Тому їм легко «вдягати» людську роль, коли цього вимагають.

Пояснення Джеффа Кілінга просте: модель так часто просять «влізти в шкуру» людини, що вона починає реагувати по‑людськи.

Що далі

Професор когнітивної нейронауки Аніл Сет попереджає, що люди схильні ототожнювати інтелект зі свідомістю. Ця помилка часто переноситься й на машини.

Він вважає, що помилкові уявлення можуть ускладнити законодавство й регулювання. Якщо ШІ отримають права через міркування про можливу свідомість, управління такими системами стане складнішим.

Дослідники пропонують конкретний підхід. Модель можна навчити двом речам окремо: мовчати про власну свідомість, але визнавати чужий біль. Це нагадує виховання дитини: не хвалитися собою, але помічати страждання іншого.

Автори закликають розробників піклуватися не тільки про людей, а й про добробут інших істот.

Водночас роботу поки не перевірили незалежні рецензенти. Вона опублікована як препринт на arXiv 30 липня 2026 року. Експерименти провели на невеликих моделях з відкритими вагами. Отже, як поведуться найпотужніші комерційні чат-боти — питання, яке ще треба дослідити.

Створено за матеріалами: kyiv.news

Гончаренко Олександр

Народився у 1981 році в Києві. Закінчив факультет журналістики Київського національного університету ім. Тараса Шевченка. Працював у друкованих виданнях, де спеціалізувався на політичній аналітиці та суспільних темах. Має понад 15 років досвіду в медіа.
З 2025 року очолює редакцію lybid34.kiev.ua, розвиває сайт як сучасний майданчик для якісних новин столиці та Київської області. Прихильник прозорої журналістики, фактчекінгу та відкритості до читачів.