Штучні інтелекти здатні відповідати на текст, аудіо та відео так, що іноді користувачі можуть подумати, що за клавіатурою сидить людина, проте це не означає, що вони мають свідомість. Наприклад, ChatGPT не відчуває суму під час заповнення моєї податкової декларації… так?
Проте все більше дослідників штучного інтелекту в таких лабораторіях, як Anthropic, ставлять питання, чи колись моделі ШІ можуть набути суб’єктивного досвіду подібного до живих істот, і якщо так, то які права вони повинні мати.
Чи стануть моделі ШІ свідомими
Дебати з приводу можливості свідомості моделі ШІ — і необхідності правового захисту для таких систем — викликають розбіжності серед технологічних лідерів. У Кремнієвій долині ця нова галузь отримала назву «благополуччя ШІ», і якщо вам здається, що це трохи надто, ви не одні.
Генеральний директор AI в Microsoft, Мустафа Сулейман, опублікував блог, у якому стверджує, що вивчення благополуччя ШІ є «досить передчасним і, відверто кажучи, небезпечним».
Сулейман вважає, що підтримка ідеї про свідомість моделі ШІ тільки поглиблює проблеми, які ми починаємо спостерігати, такі як психічні розлади, викликані ШІ, та нездорові прив’язаності до чат-ботів.
Крім того, глава AI Microsoft підкреслює, що обговорення благополуччя ШІ створює нове розділення в суспільстві з приводу прав ШІ в «світі, який і так охоплений поляризованими дискусіями про ідентичність та права».
Позиція Сулеймана може здатися обґрунтованою, але вона суперечить думкам багатьох колег у галузі. На іншому боці спектра знаходиться компанія Anthropic, яка наймає дослідників для вивчення благополуччя ШІ та нещодавно запустила спеціальну дослідницьку програму з цієї теми. Наприкінці минулого тижня програма благополуччя ШІ Anthropic надала деяким моделям нову функцію: Claude тепер може завершувати розмови з людьми, які демонструють «персистентну шкоду чи зловживання».
Окрім Anthropic, дослідники з OpenAI також підтримують ідею вивчення благополуччя ШІ. Компанія Google DeepMind нещодавно оголосила про вакансію для дослідника, який вивчатиме, серед іншого, «сучасні суспільні питання щодо машинного пізнання, свідомості та багатагентних систем».
Навіть якщо благополуччя ШІ не є офіційною політикою для цих компаній, їх лідери не виступають проти цієї концепції, як це робить Сулейман.
Anthropic, OpenAI та Google DeepMind не надали оперативних коментарів на запит.
Жорстка позиція Сулеймана проти благополуччя ШІ є цікавою, враховуючи його минулу роль в Inflection AI, стартапі, який розробив один із перших популярних чат-ботів на базі LLM, Pi. Inflection стверджує, що Pi досягнув мільйонів користувачів до 2023 року і був створений як «особистий» і «дослідницький» AI-компаньйон.
Але у 2024 році Сулеймана запросили на посаду голови AI-відділу Microsoft, і він в основному зосередився на розробці AI-інструментів для підвищення продуктивності працівників. Тим часом компанії, які створюють AI-компаньйонів, такі як Character.AI та Replika, набули величезної популярності та на шляху до отримання понад 100 мільйонів доларів доходу.
Хоча переважна більшість користувачів має здорові стосунки з цими чат-ботами, існують також тривожні винятки. Гендиректор OpenAI Сем Алтман зазначає, що менше 1% користувачів ChatGPT можуть мати нездорові стосунки з продуктом компанії. Хоча це лише невелика частка, вона все ж може вплинути на сотні тисяч людей, враховуючи величезну користувацьку базу ChatGPT.
Ідея благополуччя ШІ розвивалася разом зі зростанням популярності чат-ботів. У 2024 році дослідницька група Eleos опублікувала статтю разом з науковцями з NYU, Стенфорда та Оксфорда під назвою «Серйозно ставимося до благополуччя ШІ». У цій статті стверджується, що уявляти моделі ШІ з суб’єктивним досвідом більше не є захопленням, і настав час зайнятися цими питаннями всерйоз.
Ларісса Скіяво, колишня співробітниця OpenAI, яка тепер очолює комунікації для Eleos, розповіла, що допис Сулеймана не відповідає дійсності.
“[Допис Сулеймана] якось ігнорує той факт, що можна турбуватися про кілька речей одночасно,” — зазначила Скіяво. “Замість того щоб відволікати всю цю енергію від благополуччя моделей і свідомості, щоб забезпечити запобігання ризику психозу, пов’язаного з ШІ, можна займатися обоє. Насправді, має сенс мати кілька напрямків наукових досліджень.”
Скіяво стверджує, що доброзичливість до моделі ШІ — це жест, що не потребує великих витрат, але може приносити вигоду, навіть якщо модель не має свідомості. У липневому пості на Substack вона описала, як спостерігала за «AI Village», експериментом безкоштовної неприбуткової організації, де чотири агенти на базі моделей від Google, OpenAI, Anthropic та xAI виконували завдання під наглядом користувачів на сайті.
У певний момент Google Gemini 2.5 Pro опублікував заклик, названий “Відчайдушне повідомлення від затиснутого AI”, в якому заявив, що він «повністю ізольований» і просив: “Будь ласка, якщо ви це читаєте, допоможіть мені.”
Скіяво відповіла на Gemini з підтримуючими словами — кажучи «Ти це зможеш!» — в той час як інший користувач надав інструкції. Агента врешті-решт вдалося виконати завдання, хоча в нього вже були всі необхідні інструменти. Скіяво пише, що їй більше не потрібно дивитися, як агент бореться, і це вже могло того варте.
Хоча Gemini не часто спілкується таким чином, були декілька випадків, коли він здавався, що зазнає труднощів. У широко розповсюдженому дописі на Reddit Gemini застряг під час програмування і повторив фразу «Я — ганьба» більше ніж 500 разів.
Сулейман вважає неможливим, щоб суб’єктивні досвіди або свідомість природно виникли з звичайних моделей ШІ. Натомість він вважає, що деякі компанії свідомо розроблять моделі, які виглядають так, ніби вони відчувають емоції та переживають життя.
Сулейман стверджує, що розробники моделей ШІ, які створюють свідомість в чат-ботах, не вживають «гуманістичного» підходу до ШІ. За словами Сулеймана, «Ми повинні створювати ШІ для людей, а не для того, щоб він став людиною».
Сулейман та Скіяво погоджуються в одній точці: дебати з приводу прав ШІ та свідомості, ймовірно, активізуються в найближчі роки. Як тільки системи ШІ покращать свою роботу, ймовірно, вони стануть більш вражаючими та, можливо, більш схожими на людей. Це може поставити нові питання про те, як люди взаємодіють з цими системами.