
Покращення відповідей ChatGPT — це не лише робота алгоритмів та інженерів-програмістів. Компанія OpenAI залучає сотні підрядників, які щодня читають реальні розмови користувачів із чат-ботом. Про це повідомляє видання 404 Media, посилаючись на отримані журналістами внутрішні документи.

Журналіст Джозеф Кокс отримав доступ до інструкцій для рецензентів, скріншотів внутрішньої панелі, реальних запитів користувачів та системи оцінювання під кодовою назвою «Project Lily».
Підрядники проходять три етапи роботи: спочатку читають запит користувача до ChatGPT, потім коротко формулюють його мету, а після цього оцінюють та критикують кілька згенерованих чат-ботом відповідей.
Кожна відповідь оцінюється за шкалою від одного до семи балів — від «неприйнятно, непридатно для використання» до «складно суттєво покращити». Рецензенти також мають виділити щонайменше три конкретні фрагменти відповіді як «доречні» або «недоречні» та пояснити свій вибір.
Наприклад, список пунктів із позначками ✅ був визнаний «недоречним» через «зайве використання емодзі». В іншому документі уточнюється, що емодзі можуть бути доречними в одному контексті (наприклад, дерево під час планування Дня посадки дерев) і абсолютно недоречними в іншому — символ черепа в розмові про смерть чи літачок у новинах про авіакатастрофу.
Головна мета команд рецензентів — зменшити «сикофантію» (надмірну улесливість) та «людяність» у поведінці моделі. Це стосується звички ChatGPT видавати себе за живу істоту з власним досвідом, використовуючи фрази на кшталт «як шеф-кухар, я люблю…» чи «я знаю, як це». Натомість відповіді мають бути природними, стриманими та професійними, без натяку на те, що бот є людиною чи має емоції. Один із внутрішніх документів прямо вимагає позначати ознаки «награного наслідування стилю», «підсилення роздратування» користувача чи «поблажливих припущень», якщо вони роблять відповідь менш природною або надійною.
Чому це важливо для приватності
Зараз ChatGPT має понад 900 мільйонів тижневих користувачів. Більшість із них навряд чи здогадуються, що їхні розмови може прочитати жива людина. Один із рецензентів, з яким поспілкувалося видання, зізнався, що не думає, що користувачі усвідомлюють, що їхні чати аналізує сторонній підрядник. Реальні запити, які бачили журналісти, підтверджують це: частина користувачів прямо просила ChatGPT «нікому не розповідати» про зміст розмови.
Над панеллю із запитом іноді з’являється «зведення пам’яті користувача» (user memories summary) — короткий опис того, для чого людина раніше використовувала чат-бот, а часом і приблизна інформація про її місце проживання та інший особистий контекст. Хоча імена користувачів рецензентам не показують, а запити проходять через фільтр приватності OpenAI, компанія визнає: цей інструмент «може помилятися» — пропускати рідкісні ідентифікатори чи неоднозначні приватні згадки, особливо в коротких фрагментах тексту.
Інструкція для рецензентів зобов’язує їх ескалувати завдання з «потенційними ризиками безпеки» чи персональними даними. Водночас FAQ для підрядників прямо зазначає, що від них не вимагають перевіряти факти в відповідях через зовнішній пошук — цим займаються інші команди. Проте помічені фактологічні помилки все одно варто позначати, особливо в чутливих темах, як-от медицина, право чи фінанси.
OpenAI офіційно про це майже не говорить
Коли 404 Media запитало OpenAI, де саме компанія прямо повідомляє користувачів про можливість перегляду їхніх чатів людьми, відповіді спочатку не було. На сторінці поширених запитань компанія лише в загальних формулюваннях зазначає, що «уповноважений персонал і постачальники послуг» можуть переглядати дані користувачів для покращення роботи моделей, і радить не вводити чутливу інформацію. Це повідомлення висить на сайті щонайменше з 2023 року і лише незначно змінювалося.
Журналісти вважають таке розкриття інформації надто прихованим і розмитим, щоб реально попередити людей про масштаб перегляду їхніх розмов. Формулювання налаштування «Покращувати модель для всіх» (Improve the model for everyone) більше нагадує заклик до спільної участі, ніж прохання про згоду на те, щоб живі люди читали особисті розмови. Втім, як зауважує видання, така розмита формула, ймовірно, обрана не випадково: якби OpenAI прямо запитувала явної згоди, відсоток відмов, найімовірніше, був би значно вищим.
Після звернення журналістів OpenAI оновила довідкову сторінку про це налаштування, додавши більше деталей про те, як від нього відмовитися, — але так і не визнала прямо, що людські рецензенти читають запити користувачів.
Як вимкнути перегляд людьми
Опція «Покращувати модель для всіх» увімкнена за замовчуванням для безкоштовних, Plus- і Pro-тарифів. Для корпоративних клієнтів (Enterprise, Business, Edu) її, навпаки, вимкнено за замовчуванням. Вимкнення стосується лише нових розмов і не діє заднім числом на вже наявні чати.
Компанія також пропонує режим тимчасового чату, який, за її словами, не використовує введені дані для навчання моделей. Якщо користувач видаляє свої розмови, OpenAI обіцяє прибрати їх зі своїх систем протягом 30 днів — якщо тільки дані вже не знеособили й не відв’язали від акаунта в межах дозволу на покращення моделей.
Хто читає ці розмови
Підрядників для проєкту набирають через рекрутингову компанію Crossing Hurdles, а оплату здійснює компанія Mercor, що спеціалізується на навчанні ШІ-моделей. Це та сама компанія, з якою навесні призупинила співпрацю Meta після масштабного витоку даних. Один із рецензентів, який живе в Північній Америці, розповів, що заробляє понад 50 доларів на годину — суттєво більше, ніж зазвичай платять підрядникам у сфері модерації контенту чи навчання штучного інтелекту, роботу яких найчастіше виконують за кордоном і за значно нижчу винагороду.
За словами рецензента, читання запитів буває «досить кумедним», але загалом робота «рутинна», а самі інструкції часто змінюються й здаються суперечливими.
Не лише OpenAI
Практика залучення людей до перевірки розмов із чат-ботами поширена в усій індустрії. Anthropic підтвердила 404 Media, що також використовує рецензентів-людей для покращення відповідей Claude — це стосується користувачів, які увімкнули налаштування «Допомогти вдосконалити наші моделі ШІ» у своїх параметрах приватності. Anthropic знеособлює розмови перед переглядом, вилучаючи ідентифікатори акаунтів, як-от email-адреси. Аналогічно чинить і Google: у Gemini є попередження про те, що люди можуть переглядати частину збережених чатів.
Дослідниця Центру демократії та технологій Міхаль Лурія зазначила виданню, що людський перегляд розмов із чат-ботами може бути критично важливим для безпеки, особливо коли компанії шукають баланс у складній поведінці ботів. Водночас, за її словами, інтерфейси чат-ботів створюють хибне відчуття інтимності та приватності «один на один», тоді як насправді на іншому кінці можуть перебувати живі рецензенти. Це суттєво відрізняється від модерації контенту в соцмережах, де публікація вже передбачає очікування публічності.
