OpenAI использовала труд сотрудников на аутсорсе за $2 в час, чтобы сделать ChatGPT менее «токсичным»
За эти деньги работники, которых нанял подрядчик, анализировали тексты с описанием домогательств, разжигания ненависти и насилия.
Разработчики чат-ботов сталкиваются с проблемой: из-за того, что ИИ обучается на текстах в открытом доступе, он неизбежно в итоге может создавать расистские, сексистские и другие высказывания.
«Очистить» эти данные вручную нельзя — даже команде из сотен человек потребовалось бы несколько лет», пишет Time.
Поэтому разработчик чат-бота ChatGPT — компания OpenAI создала нейросеть, которая поможет находить «токсичные» высказывания и заранее отфильтровывать их.
Чтобы получить такие метки, с ноября 2021 года OpenAI отправила десятки тысяч фрагментов текста аутсорсинговой фирме в Кении. В этом разработчику помогала компания Sama из Сан-Франциско — она нанимает работников в Кении, Уганде и Индии для разметки данных для Google, Microsoft и других.
По данным Time, который проанализировал внутренние документы обеих компаний и поговорил с сотрудниками, OpenAI подписала с Sama три контракта на общую сумму около $200 тысяч для разметки текстовых описаний домогательств, разжигания ненависти и насилия.
Около трёх дюжин работников разделили на три команды. Они должны были прочитать и разметить от 150 до 250 отрывков текста за девятичасовую смену, рассказали сотрудники. При этом зарплаты составляли от $1,32 до $2 в час. В контрактах говорилось, что OpenAI будет платить Sama по $12,5 в час.
Четверо сотрудников, с которыми поговорил Time, сказали, что такая работа их психически травмировала. И хотя они могли посещать «консультантов по здоровью», такие встречи были бесполезными. В результате Sama якобы отказалась от работы с OpenAI в начале 2022-го — на восемь месяцев раньше плана, пишет издание.