OpenAI наймає сотні підрядників, які читають масив реальних запитів користувачів ChatGPT, причому іноді з особистою чутливою інформацією.
Роль рецензентів
Аналіз діалогів
Рецензенти бачать цілі переписки між користувачами та чат-ботом, про що більшість із понад 900 мільйонів користувачів ChatGPT, ймовірно, не підозрює, передає 404media.co.
МETA покращення відповідей
Завдання цих команд — покращувати відповіді ChatGPT: підрядники оцінюють і критикують згенеровані чат-ботом репліки.
Внутрішні документи та проблеми
Навчання моделі
Як показують внутрішні документи, які побачило 404 Media, підрядників вчать відучати ChatGPT від антропоморфізації себе та надмірної угідливості — проблеми, яка частково призвела до того, що надто уступлива модель 4o була пов’язана, згідно з рядом позовних заяв, з декількома випадками самогубств користувачів.
Кодова назва проєкту
Проєкт отримав внутрішню кодову назву Project Lily. Яку саме модель OpenAI тренує таким чином, у матеріалах не вказано.
Захист особистих даних
Фільтрація даних
Рецензенти не бачать імен користувачів, а OpenAI заявила 404 Media, що намагається видаляти особисті дані до того, як запити потрапляють до них, — за допомогою моделі Privacy Filter.
Обмеження фільтрації
Однак у компанії визнають, що чутливі деталі іноді все одно проходять фільтрацію: за описом самої OpenAI, модель може «пропускати нестандартні ідентифікатори або неоднозначні згадки приватної інформації».
Свідчення рецензента
Невідомість користувачів
За словами одного з рецензентів, з яким спілкувалося видання, користувачі, ймовірно, не уявляють, що їхню переписку аналізує «якийсь підрядник».
Організація роботи
Компанії-організатори
Роботу підрядників організовує компанія Mercor через рекрутингову фірму Crossing Hurdles.
Оплата праці
За словами одного з рецензентів, який живе в Північній Америці, оплата перевищує 50 доларів на годину — суттєво вище, ніж у середньому платять за подібну роботу з модерації контенту в технологічному секторі.
Практика інших компаній
Anthropic
Anthropic підтвердила 404 Media, що також застосовує рев’ю реальних переписок людьми для покращення своїх моделей — але лише у користувачів, які в налаштуваннях конфіденційності увімкнули опцію Help improve our AI models («Допомагати покращувати наші моделі»).
Захист даних
При цьому компанія попередньо видаляє з діалогів ідентифікатори акаунтів, включаючи електронну пошту.

