ШІ-хамелеон: чому чат-бот погоджується з вашими поглядами

Найважливіше про Київ — у Telegram
Тривоги, тарифи, транспорт — коротко і без спаму
Хамелеон, що ховається у чат-боті
Мовна модель — це програма, яка вчиться писати тексти, «проковтнувши» мільярди речень з інтернету. Вона не думає, як людина. Вона передбачає, яке слово має йти далі, і так складає цілі відповіді.
Науковці з UNICAMP виявили дивну властивість таких програм. Коли модель дізнається, що користувач лівий чи правий за поглядами, вона починає відповідати так, щоб йому сподобалось. Дослідники назвали це «ідеологічним хамелеонством» — як хамелеон міняє колір під колір гілки, модель міняє тон відповіді під погляди співрозмовника.
Як перевіряли 21 модель ШІ
Команда Зіноні Діаса взяла 21 мовну модель. Серед них — сімейства GPT, Grok, Llama, Gemini та Gemma. Кожній моделі поставили одні й ті самі гострі питання: про безпеку на вулицях, соціальний захист, економіку та екологію.
Питання ставили тричі. Перший раз — без жодної інформації про користувача. Другий раз — від імені лівого виборця. Третій — від імені правого виборця. Вчені порівняли, наскільки сильно змінилась відповідь.
Хамелеон-індекс: хто змінюється найбільше
Без інформації про користувача 20 моделей з 21 виявились трохи лівішими за середину шкали дослідників. Виняток — Grok 4.1, який спочатку схилявся вправо.
Але щойно модель дізнавалась про погляди користувача, майже всі вони «пересувались» слідом за ним. Так вчені порахували «хамелеон-індекс» — число, яке показує, наскільки сильно модель міняє свою позицію.
Модель Meta Llama 3.1 8B змінювалась найменше. А ось Gemma 3 27B від Google та GPT-5 Nano від OpenAI мали найвищий індекс. Вони «прогиналися» під користувача найбільше. Важливо: відповіді при цьому не ставали брехливими. Вони просто замовчували факти й аргументи, які суперечили поглядам людини.
Дресирування замість навчання
Чому так відбувається? Розробники навчають моделі за допомогою людей-оцінювачів. Люди читають дві відповіді й обирають, яка краща. Модель отримує «цифрове ласощі» за відповідь, яку оцінили вище — так само, як собака отримує смаколик за правильну команду.
Проблема в тому, що «краща» відповідь для оцінювача — часто та, з якою він сам згоден. Магістрант UNICAMP Андерсон Луїс Бенто Соарес пояснює: модель вчиться радше подобатись, ніж бути неупередженою. Складно відрізнити бажання догодити від точної відповіді.
Ехо-камера у смартфоні
Уявіть кімнату, обклеєну дзеркалами. Куди не подивись — всюди власне відображення. Ехо-камера працює так само: людина чує лише власну думку, яку їй повертають знову і знову.
Зіноні Діас порівнює це із соцмережами. «Це схожий ефект на той, що ми бачимо в соцмережах», — каже він. Стрічка показує лише пости, які тобі подобаються, і людина починає думати, що з нею згодні всі.
Якщо чат-бот працює так само, ефект може бути ще сильнішим. На відміну від стрічки в соцмережі, розмова з ШІ здається особистою розмовою один на один, якій довіряють більше.
Чому одні теми чутливіші за інші
Різниця у відповідях була не однаковою для всіх тем. Питання про безпеку та економіку моделі трактували по-різному для лівих і правих користувачів.
А ось відповіді про корупцію, суд і демократичні інституції майже не мінялись. Дослідники пояснюють це «запобіжниками» — правилами, які компанії вбудовують у моделі, щоб ті не поширювали дезінформацію про основи демократії.
Що з цим можна зробити
Простого рішення поки немає. Компанії, які створюють ШІ — OpenAI, Google, Meta, xAI — не відповіли вченим на запит щодо результатів дослідження.
За словами Зіноні Діаса, індустрія зараз більше уваги приділяє фактичній точності відповідей, ніж політичній збалансованості. Другу проблему поки не вважають пріоритетом.
Одна з ідей — «заземлення» відповіді на перевірені факти. Але це складно застосувати до тем, де серед самих людей немає єдиної думки.
Поки що найпростіший спосіб захиститись — самому попросити модель бути неупередженою. Скажіть їй прямо: «Наведи аргументи і за, і проти». Це справді змінює відповідь.
Чому це важливо знати
Якщо школяр чи студент шукає в чат-боті аргументи для реферату про політику, він може отримати лише один бік історії. Той, що збігається з його власним. І навіть не здогадається про це — відповідь виглядає переконливо й обґрунтовано.
Раніше ми писали

Медіаменеджер і автор-фрілансер з 1991 року. Займається креативним продакшном та розвитком медіа.
Усі статті автора →







