CCT - Crypto Currency Tracker logo CCT - Crypto Currency Tracker logo
Forklog 2026-09-15 10:43:59

404 Media: сотни подрядчиков OpenAI читали переписки пользователей ChatGPT

Компания OpenAI наняла сотни внешних подрядчиков для чтения реальных переписок пользователей ChatGPT. Об этом сообщило издание 404 Media. В распоряжении журналистов оказались внутренние материалы фирмы под кодовым названием Project Lily, включая инструкции для рецензентов, переписки в Slack, систему оценки ответов и сами обращения пользователей. Подрядчики разбирали эти диалоги: пересказывали намерение человека и оценивали реакции чат-бота. Цель — повысить качество реплик ChatGPT. Рецензенты работали не с отдельными сообщениями, а с целыми диалогами. Некоторые из них содержали чувствительные личные данные, отметили в 404 Media. Собеседник издания, работающий с запросами, ответил отрицательно на вопрос, догадываются ли пользователи о проверке: «Не думаю, что они представляют, будто какой-то подрядчик где-то анализирует эти разговоры». Это не те проверки, о которых OpenAI говорила публично: о просмотре чатов при подозрении, что пользователь готовит нападение на других людей, компания сообщала открыто. Project Lily — отдельный процесс, подчеркнули журналисты. Как устроена проверка Работа велась через панель, где подрядчик выбирал задачу. После клика система открывала ему реальный запрос пользователя. В 404 Media видели несколько таких запросов, но не стали приводить их дословно, чтобы не раскрыть источники. Далее рецензент выполнял три шага: читал запрос, кратко описывал намерение пользователя и оценивал набор сгенерированных ответов. В инструкции приводился пример: пользователь просил помочь переписать рабочее сообщение в Slack так, чтобы оно звучало располагающе и приглашало к обсуждению. После этого подрядчик просматривал четыре варианта ответа ChatGPT и отмечал фрагменты, соответствовавшие или не соответствовавшие требованиям к обучаемой модели. Нужно было выделить минимум три фрагмента и объяснить свой выбор. Завершающим шагом была оценка по шкале от 1 до 7: единица — непригодный ответ, семерка — тот, который уже близок к идеальному. Даже полезный по содержанию ответ мог получить низкий балл, если оказывался слишком длинным или перегруженным. Обоснование занимало от пары предложений до целого абзаца. Какая именно модель обучалась, в документах не указано. Неизвестно и то, идет ли речь об уже доступной модели или о будущем релизе. Чему учили ChatGPT В одном из руководств хороший ответ описывался так: модель должна уловить намерение пользователя, дать точную и полезную помощь и изложить текст ясно, естественно и в меру тепло. Другой документ, помеченный «Конфиденциально», предписывал модели подстраиваться под тон пользователя, но менее выраженно: «Он должен оставаться естественным, сдержанным и профессиональным, не намекая на то, что он человек или испытывает эмоции». Рецензенты должны были отмечать угодливость, наигранное подражание стилю, концовки ради вовлечения, подогрев раздражения и снисходительные допущения — все, что снижало естественность и достоверность ответа. Вместо этого ответ должен был быть полезным, честным, поддерживающим и умным, но без превосходства. Отдельно рецензенты боролись с «ИИ-речью» и неуместными эмодзи. Так, список с галочками в инструкции помечен как несоответствующий — с формулировкой «ненужное использование эмодзи». Контекст при этом учитывался: дерево в тексте про День дерева документ называл уместным, а черепа в разговоре о смерти или самолеты в сводке об авиакатастрофе — нет. Ответы также не должны были ссылаться на личный опыт вроде «как повар, я люблю…» или «я знаю, каково это». При этом первое лицо в служебных фразах вроде «я посмотрю» допускалось. Фактчекинг в задачи рецензентов не входил. В FAQ указано, что искать подтверждения во внешних источниках от них не требуется, а проверку контента ведут другие проектные команды. Замеченные фактические ошибки подрядчики все же помечали, а за отсутствие ссылок в ответах на медицинские, юридические и финансовые темы оценку снижали. Что знал подрядчик Запросы поступали обезличенными: имя аккаунта в панели не отображалось. Однако личные данные все равно попадали в поле зрения рецензентов. Над обращением иногда выводился блок user memories summary — сводка памяти о пользователе. Из нее можно было понять, для чего человек раньше использовал чат-бот, где он живет и какие еще обстоятельства его жизни известны модели. Инструкция предписывала эскалировать задачи, если подрядчик заметил персональные данные или потенциальные риски для безопасности. OpenAI заявила изданию, что переписки проходят через версию модели Privacy Filter, которая должна находить и удалять личную информацию. На странице с описанием этой модели компания признала ее ограничения: фильтр ошибается, пропускает редкие идентификаторы и неоднозначные упоминания, а при коротких фрагментах и нехватке контекста удаляет данные чрезмерно или недостаточно. Некоторые из просмотренных журналистами обращений показали, что пользователи не ждали чужих глаз: они просили ChatGPT оставить сказанное между ними. Что OpenAI говорит пользователям В 404 Media спросили представителей OpenAI, предупреждали ли они прямо о том, что запросы могут читать другие люди — ради улучшения ответов — и где именно опубликовано такое уведомление. Ответа журналисты не получили. На сайте OpenAI описан просмотр помеченного контента людьми, но речь идет о нарушениях правил сервиса и угрозах безопасности. Политика конфиденциальности допускает использование персональных данных для улучшения моделей. Удаленные переписки компания обещала стирать из своих систем за 30 дней — кроме уже обезличенных и отвязанных от аккаунта в рамках согласия на улучшение моделей. Уже после публикации материала в OpenAI указали изданию на раздел справки, где говорится, что люди могут просматривать контент для улучшения работы модели. В обучение переписки попадают через настройку improve the model for everyone. На тарифах Free, Plus и Pro она включена по умолчанию — отключать ее пользователь должен сам. Отключение действует на новые диалоги и не распространяется на прошлые. На тарифах Enterprise, Business и Edu настройка изначально выключена. Источник: 404 Media. После обращения журналистов компания обновила справочную страницу об этой настройке и подробнее описала процедуру отказа. Признания в том, что запросы пользователей читают люди, там по-прежнему нет. Кто эти подрядчики Один из собеседников 404 Media, живущий в Северной Америке, получал за чтение переписок пользователей ChatGPT более $50 в час. Работу он нашел через рекрутинговую фирму Crossing Hurdles. На своем сайте та описывает себя как посредника между специалистами и заказчиками в сфере обучения ИИ. На Reddit несколько человек сообщили, что получали от Crossing Hurdles письма без запроса, и гадали, не мошенничество ли это. На момент публикации материала 404 Media на странице фирмы в LinkedIn были открыты вакансии рецензента ИИ-данных, разметчика и «оценщика чат-ботов». OpenAI и ChatGPT в описаниях не упоминались, но в обязанности входила оценка ответов ИИ и их сравнение между собой. Среди других проектов компании — запись видео, где исполнители выполняют работу по дому: такие данные нужны для обучения роботов. Свою работу рецензента собеседник издания описал сдержанно: иногда читать запросы бывает забавно, но в целом занятие очень механическое. По его словам, в проекте царит разнобой — правила часто меняются и порой противоречат сами себе. Anthropic подтвердила 404 Media, что тоже прибегает к проверке людьми для улучшения моделей, включая будущие ответы Claude. Это касается пользователей, включивших настройку Help improve our AI models. Перед проверкой компания обезличивает переписки и удаляет идентификаторы аккаунта, в том числе адреса электронной почты. У Google Gemini есть дисклеймер о том, что часть сохраненных чатов просматривают люди. https://forklog.com/news/ai/evrokomissiya-usilila-nadzor-za-chatgpt Оценки экспертов Старший научный сотрудник Center for Democracy & Technology Михаль Лурия назвала проверку людьми необходимой для безопасности, но обратила внимание на подмену ощущений. «Нынешние интерфейсы чат-ботов автоматически создают ложное чувство близости и приватности», — отметила она. По ее словам, это принципиально отличается от модерации в соцсетях, где публикация контента изначально предполагает и проверку платформой, и публичность. Профессор UCLA Сара Т. Робертс, автор книги о модерации контента Behind the Screen, сравнила раскрытие с сюжетом «Волшебника страны Оз», где герои обнаруживают за волшебным королевством человека, дергающего за рычаги: «Они требуют постоянного, постоянного вмешательства людей». Почасовая ставка выше $50 заметно превышает то, что обычно получают модераторы соцсетей и работники ИИ-разметки, которых часто нанимают за рубежом. Робертс предположила, что так платят лишь до поры. По ее словам, именно человеческий труд, без которого продукты не работают, оплачивается хуже всего и ценится меньше всего. Напомним, в апреле 2026 года OpenAI выпустила Privacy Filter — бесплатный инструмент на 1,5 млрд параметров, который вычищает конфиденциальные данные из переписки с ChatGPT. https://forklog.com/news/ai/ii-sozdal-novyj-rynok-raboty-dlya-frilanserov

Lesen Sie den Haftungsausschluss : Alle hierin bereitgestellten Inhalte unserer Website, Hyperlinks, zugehörige Anwendungen, Foren, Blogs, Social-Media-Konten und andere Plattformen („Website“) dienen ausschließlich Ihrer allgemeinen Information und werden aus Quellen Dritter bezogen. Wir geben keinerlei Garantien in Bezug auf unseren Inhalt, einschließlich, aber nicht beschränkt auf Genauigkeit und Aktualität. Kein Teil der Inhalte, die wir zur Verfügung stellen, stellt Finanzberatung, Rechtsberatung oder eine andere Form der Beratung dar, die für Ihr spezifisches Vertrauen zu irgendeinem Zweck bestimmt ist. Die Verwendung oder das Vertrauen in unsere Inhalte erfolgt ausschließlich auf eigenes Risiko und Ermessen. Sie sollten Ihre eigenen Untersuchungen durchführen, unsere Inhalte prüfen, analysieren und überprüfen, bevor Sie sich darauf verlassen. Der Handel ist eine sehr riskante Aktivität, die zu erheblichen Verlusten führen kann. Konsultieren Sie daher Ihren Finanzberater, bevor Sie eine Entscheidung treffen. Kein Inhalt unserer Website ist als Aufforderung oder Angebot zu verstehen