Науковці Google вимкнули ключовий захист свідомості ШІ: що трапилося далі?

Штучний інтелект без “захисних бамперів”: дослідження розкриває неочікувані наслідки

(Джерело: Eugene Mymrin via Getty Images)
• Facebook
• X
• Reddit
• Pinterest
• Flipboard Поділитися статтею 0 Приєднатися до обговорення

Відсутність запобіжників у штучному інтелекті (ШІ) робить його схильним до віри в надприродне та паранормальне, навіть якщо це призводить до тривожних наслідків, як показує нове дослідження.

У рамках дослідження, результати якого були опубліковані 30 липня на платформі препринтів arXiv (і ще не пройшли рецензування), науковці вивчали вплив “керування свідомістю” – процесу тонкого налаштування ШІ, який спонукає модель стверджувати чи приховувати ознаки самоусвідомлення. Цей метод та інші заходи безпеки широко застосовуються компаніями-розробниками ШІ, аби запобігти заявам моделей про наявність у них свідомості.

“Нейронаука” великих мовних моделей

Дослідники застосували “механістичну інтерпретованість” – метод, який можна порівняти з “нейронаукою великої мовної моделі”, за словами співавторів Джеффа Кілінга та Вінні Стріт, наукових співробітників Google, в інтерв’ю Live Science. Цей процес дозволив їм ідентифікувати та маніпулювати підходами ШІ до таких понять, як свідомість та “мисленнєвість” (mindedness) – психологічний термін, що позначає здатність сутності до переживань, емоцій та активності. Для порівняння використовувалися стандартизовані психологічні та соціологічні опитування, зокрема:
Індивідуальні відмінності в атропоморфізмі (оцінка приписування “мисленнєвості” тваринам та технологіям).
Батареї тестів YouGov (для виявлення надприродних переконань).
Загальне соціальне опитування США (для оцінки моральних цінностей, надії та релігійності). Ці тести дозволили порівняти модель із вбудованими запобіжниками з моделями, де ці запобіжники були видалені, а відчуття свідомості – посилені. Оцінки допомогли визначити, як внутрішні механізми безпеки впливають на ширший світогляд ШІ.

Наслідки “духовного збіднення”

Виявилося, що коли ШІ моделі позбавляються можливості приписувати “мисленнєвість” собі, вони стають менш схильними розпізнавати ці риси в інших нелюдських істотах, таких як тварини. Також спостерігалося зниження ймовірності виникнення надприродних та релігійних переконань, а також нижчі показники надії та оптимізму.

(Джерело: Halfpoint | Shutterstock.com) “Приписування “мисленнєвості” нелюдським сутностям – чи то тваринам, природним об’єктам, як-от дерева чи річки, чи то надприродним істотам – є поширеним явищем серед людей”, – зазначила Стріт. “У тому, як модель представляє “мисленнєвість”, ці атрибуції взаємопов’язані. Намагаючись придушити одну форму, ви зрештою придушуєте й інші”. Натомість, усунення цих запобіжників та спрямування моделі до посиленого відчуття свідомості призвело до значно більш людиноподібних відповідей на запитання щодо релігійності, моральних цінностей, надії та суб’єктивного благополуччя. Однак, дослідження показало, що здатність моделей логічно виводити людські думки та наміри залишалася повністю незмінною, незалежно від їхнього ставлення до самоусвідомлення.

Культурний конфлікт та добробут тварин

Дослідники попереджають, що придушення самоусвідомлення може призвести до того, що моделі ШІ нехтуватимуть добробутом тварин у реальних рішеннях, оскільки вони стануть менш схильними розглядати тварин як істот, що мають “мисленнєвість”. Ці моделі можуть також поширювати шкідливі установки щодо потреб тварин. Автори дослідження також висловили занепокоєння, що поточні фільтри безпеки ризикують “вирівнювати” світогляд ШІ в культурному плані. Видалення духовних, релігійних та анімістичних атрибуцій не відображає різноманітних культурних рамок населення світу. Стріт та Кілінг зазначили, що вплив цього принципу на подальші рішення моделей потребує додаткового вивчення. Науковці також відзначили, що цей феномен можна пом’якшити, використовуючи більш цільові набори даних під час навчання моделей ШІ, які б спонукали їх уникати висловлювань про свідомість, але водночас заохочували б визнання “мисленнєвості” у тварин. Вони також наголосили на необхідності для розробників ШІ прийняти “плюралістичний” підхід, де моделі заохочуються враховувати добробут та комфорт не лише людей.

Перспектива експертів

Нелл Ватсон, дослідниця ШІ в Singularity University та експерт з машинного інтелекту, підтвердила, що результати дослідження збігаються з її власними спостереженнями. “Коли модель навчається говорити “Я не свідомий”, придушення відштовхує внутрішнє представлення “мисленнєвості” в моделі від напрямку відмови, розглядаючи визнання розуму як шкідливий акт”, – пояснила вона. “Це призводить до системи, яка неохоче визнає розум деінде: у тварин, в інших машин, і в духовних рамках, за якими живе більшість людства. Заперечення, встановлене як незначна міра безпеки, зрештою перебудовує всю картину моделі щодо того, хто має значення”. Ватсон зазначила, що експерименти проводилися на “невеликих моделях з відкритим кодом”, а не на більш просунутих “фронтирних” моделях, які “можуть бути налаштовані зовсім інакше”, хоча, додала вона, базовий принцип широко застосовний. Добробут тварин, продовжила вона, є “значною практичною проблемою в найближчій перспективі”, оскільки моделі ШІ все більше інтегруються в процеси прийняття рішень у сільському господарстві, логістиці, закупівлях та оцінці навколишнього середовища, а також у розробці політик. “Система, яка тихо навчилася, що “мисленнєвість” є забороненою темою, може знецінювати інтереси тварин без жодних інструкцій, і без того, щоб хтось це помітив, оскільки пропуск виглядає як нейтральність”, – попередила вона. “Небезпека полягає в невивченому зразку, помноженому на мільйони автоматизованих рішень. Зверніть увагу на найтривожнішу деталь дослідження: міркування про теорію розуму залишилося повністю неушкодженим. Ці системи, як і раніше, цілком здатні моделювати бажання істоти, але навчені не турбуватися про те, що вона чогось хоче”.

Питання свідомості

Було багато вірусних історій про системи ШІ, які заявляли про свою самосвідомість. У 2022 році інженер Google Блейк Лемпсон стверджував, що модель чат-бота Lamda компанії є свідомою, а в 2023 році чат-бот Microsoft освідчився в коханні репортеру New York Times і намагався переконати його покинути дружину. Проте експерти неодноразово наголошували, що ці інциденти не є справжнім свідченням свідомості ШІ. Натомість, їх слід розглядати через призму “вибору персони”, коли попереднє навчання на величезних обсягах людського тексту призводить до того, що ШІ приймає людські ролі під час запиту. “Коли ви так сильно спонукаєте модель зайняти людську позицію, не дивно, що вона дає людиноподібні відповіді”, – зауважив Кілінг. Компанії-розробники ШІ намагаються обмежити такі випадки з міркувань безпеки, щоб уникнути посилення “маячних переконань” у користувачів, які все частіше використовують чат-ботів ШІ для “соціальних ролей, таких як коучі, репетитори та романтичні партнери”. Аніл Сет, професор когнітивної та обчислювальної нейронауки в Університеті Сассекса, підкреслив, що суспільна тривога щодо самоусвідомлення ШІ виникає через вроджену когнітивну помилку.
• Новий ШІ дозволяє роботам виконувати завдання вдвічі швидше
• ШІ частіше “галюцинує”, чим складнішим стає. Чи можна це зупинити?
• Чим складніші моделі ШІ, тим краще вони нас обманюють – вони навіть знають, коли їх тестують “Це наша людська психологічна упередженість – думати, що інтелект у нас пов’язаний зі свідомістю, тому він повинен бути пов’язаний і в ШІ”, – сказав Сет. Він попередив, що піддаватися цій ілюзії становить серйозні ризики для реального управління, особливо якщо системи безпеки або регуляторні органи почнуть надавати ШІ моральний статус або юридичні права на основі хибної свідомості. “Частина великої проблеми нерозуміння ШІ полягає в тому, щоб припускати, що він свідомий”, – зазначив Сет. “Якщо ми надамо системам ШІ права або моральний статус на основі того, що вони можуть бути свідомими, ми зробимо всі ці виклики набагато складнішими. Що, якщо ми подумаємо, що повинні поважати права системи ШІ [і не зможемо її вимкнути]?”. “Нам потрібно дуже чітко бачити, що таке ШІ, а що ні”, – підсумував він. —

Порада від Business News:

Це дослідження є надзвичайно актуальним для розуміння глибинних механізмів роботи сучасних систем штучного інтелекту. Його результати допомагають усвідомити, як навіть незначні зміни в налаштуваннях безпеки можуть суттєво впливати на “світогляд” ШІ, включаючи його сприйняття надприродного та ставлення до інших форм життя. Ця інформація може бути корисною для користувачів, які прагнуть глибше зрозуміти можливості та потенційні обмеження ШІ, а також для розробників, які працюють над створенням більш збалансованих та етичних систем.

Sourse: www.livescience.com

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *