Бизнес Государство и политика Искусственный интеллект
По имеющимся данным, сотни подрядчиков читают реальные разговоры в ChatGPT
OpenAI платит сотням подрядчиков за чтение реальных разговоров в ChatGPT и оценку ответов чат-бота в рамках внутреннего кодового названия Project Lily, при этом компания не дала ответа на вопрос о том, где она предупреждала об этом пользователей. Суд Европейского союза постановил в сентябре прошлого года, что обязанность контролера по информированию действует на момент сбора данных и не зависит от того, может ли получатель кого-либо идентифицировать.
OpenAI платит сотням подрядчиков за чтение реальных разговоров в ChatGPT и оценку ответов чат-бота в рамках внутреннего кодового названия Project Lily, сообщает 404 Media.
Проверяющие не видят имен пользователей. Они видят сводку пользовательских воспоминаний над запросом, которая иногда показывает, для чего человек использовал чат-бот ранее и в какой точке мира он может проживать.
В OpenAI заявляют, что модель фильтрации конфиденциальности (Privacy Filter) предварительно удаляет личную информацию. На собственной странице этой модели указано, что она может совершать ошибки, пропускать редкие идентификаторы и недостаточно тщательно производить цензуру при ограничении контекста.
Издание 404 Media попросило компанию указать, где именно она сообщает пользователям, что люди могут читать их чаты. В OpenAI не ответили, а после публикации сослались на справочную страницу.
В Anthropic подтвердили, что они также используют проверку людьми для пользователей, которые включают соответствующую настройку, и заявляют, что сначала удаляют идентификаторы учетных записей. В Gemini от Google есть примечание о том, что люди проверяют некоторые сохраненные чаты.
В Европе в сентябре прошлого года урегулировали ту часть вопроса, которая имеет здесь значение.
Суд Европейского союза постановил в деле EDPS против SRB, что обязанность контролера информировать людей применяется до любой передачи данных и оценивается с точки зрения самого контролера, а не получателя.
Таким образом, критерием является не то, сможет ли подрядчик в Северной Америке выяснить, кто написал запрос. Обязанность лежала на OpenAI в момент сбора разговора.
Регулятор Италии уже оштрафовал компанию на 15 млн евро, девять из которых — за обработку данных без достаточных правовых оснований, и обязал в течение шести месяцев транслировать социальную рекламу на итальянском телевидении и радио.
Настройки по умолчанию также имеют значение. Функция «Улучшить модель для всех» включена по умолчанию для бесплатных аккаунтов, а также аккаунтов Plus и Pro, и отключена для Enterprise, Business и Edu, причем ее отключение применяется к новым разговорам, а не к старым.
Компания OpenAI весь год занималась продажей конфиденциальности другой половине своего рынка, анонсировав в августе нулевое хранение данных для корпоративных клиентов.
Потребители же получают настройки, которые подпитывают модель данными.
«Я не думаю, что они могли бы вообразить, что какой-то подрядчик где-то анализирует их разговоры,» — отметил один из проверяющих. При этом та же компания просила этих же пользователей подключить свои банковские счета.



