404 Media: сотни подрядчиков OpenAI читали переписки пользователей ChatGPT

Компания OpenAI наняла сотни внешних подрядчиков для чтения реальных переписок пользователей ChatGPT. Об этом сообщило издание 404 Media. В распоряжении журналистов оказались внутренние материалы фирмы под кодовым...
Bitcoin 1 Minute
Вот последние новости с рынков цифровых активов: Компания OpenAI наняла сотни внешних подрядчиков для чтения реальных переписок пользователей ChatGPT. Об этом сообщило издание 404 Media. В распоряжении журналистов оказались внутренние материалы фирмы под кодовым названием Project Lily, включая инструкции для рецензентов, переписки в Slack, систему оценки ответов и сами обращения пользователей.
Подрядчики разбирали эти диалоги: пересказывали намерение человека и оценивали реакции чат-бота. Цель — повысить качество реплик ChatGPT. Рецензенты работали не с отдельными сообщениями, а с целыми диалогами.
Динамика рынка
Некоторые из них содержали чувствительные личные данные, отметили в 404 Media. Собеседник издания, работающий с запросами, ответил отрицательно на вопрос, догадываются ли пользователи о проверке: «Не думаю, что они представляют, будто какой-то подрядчик где-то анализирует эти разговоры». Это не те проверки, о которых OpenAI говорила публично: о просмотре чатов при подозрении, что пользователь готовит нападение на других людей, компания сообщала открыто.
Project Lily — отдельный процесс, подчеркнули журналисты. Как устроена проверка Работа велась через панель, где подрядчик выбирал задачу. После клика система открывала ему реальный запрос пользователя.
В 404 Media видели несколько таких запросов, но не стали приводить их дословно, чтобы не раскрыть источники. Далее рецензент выполнял три шага: читал запрос, кратко описывал намерение пользователя и оценивал набор сгенерированных ответов. В инструкции приводился пример: пользователь просил помочь переписать рабочее сообщение в Slack так, чтобы оно звучало располагающе и приглашало к обсуждению.
Влияние на рынки
После этого подрядчик просматривал четыре варианта ответа ChatGPT и отмечал фрагменты, соответствовавшие или не соответствовавшие требованиям к обучаемой модели. Нужно было выделить минимум три фрагмента и объяснить свой выбор. Завершающим шагом была оценка по шкале от 1 до 7: единица — непригодный ответ, семерка — тот, который уже близок к идеальному.
Даже полезный по содержанию ответ мог получить низкий балл, если оказывался слишком длинным или перегруженным. Обоснование занимало от пары предложений до целого абзаца. Какая именно модель обучалась, в документах не указано.
Неизвестно и то, идет ли речь об уже доступной модели или о будущем релизе. Чему учили ChatGPT В одном из руководств хороший ответ описывался так: модель должна уловить намерение пользователя, дать точную и полезную помощь и изложить текст ясно, естественно и в меру тепло. Другой документ, помеченный «Конфиденциально», предписывал модели подстраиваться под тон пользователя, но менее выраженно: «Он должен оставаться естественным, сдержанным и профессиональным, не намекая на то, что он человек или испытывает эмоции».
Эта перемена продолжает формировать ландшафт цифровых активов.





