50 долларов США в час за чтение чужих чатов?
Взаимодействие с искусственным интеллектом представляется приватным и полностью автоматизированным процессом, однако за кулисами ChatGPT стоят сотни живых людей. Журналисты издания 404 Media провели расследование и выяснили, что специальные подрядчики компании OpenAI детально изучают диалоги пользователей, включая те, в которых содержатся прямые просьбы о строгой конфиденциальности, сообщает "Дивогляд".
Цели анализа переписки третьими лицами и сопутствующие риски
Основная цель рецензентов – повышение качества ответов и корректировка поведения чат-бота. Внутренняя документация OpenAI свидетельствует о том, что человеческий надзор необходим для исправления системных недостатков искусственного интеллекта.
Ключевые задачи специалистов по проверке данных:
-
Борьба с антропоморфизмом: ИИ обучают не имитировать человеческую личность и не выдавать себя за живого человека;
-
Сдерживание чрезмерной угодливости: специалисты корректируют избыточную комплиментарность чат-бота, когда тот необоснованно соглашается с любым мнением пользователя;
-
Утечка частных данных: несмотря на то, что OpenAI удаляет имена и стремится фильтровать личную информацию перед отправкой рецензентам, конфиденциальные бизнес-данные, интимные подробности и секретные запросы все равно становятся доступны сторонним наблюдателям.
Аналогичная практика проверки языковых моделей с участием людей была подтверждена и в конкурирующей компании Anthropic.
Механизм работы системы рецензирования и способы защиты персональных данных
Для оценки диалогов OpenAI привлекает специализированные рекрутинговые агентства. В частности, один из подрядчиков в Северной Америке сообщил, что получает более $50 в час за анализ запросов: он формулирует намерение пользователя, оценивает точность и тон ответа бота, а также составляет рекомендации по улучшению системы.
Официальная позиция OpenAI и методы обеспечения конфиденциальности:
-
Настройки по умолчанию: функция "улучшать модель для всех" автоматически активирована для пользователей тарифов Free, Plus и Pro;
-
Отсутствие ретроактивности: отключение передачи данных в настройках аккаунта распространяется только на новые чаты, в то время как предыдущие диалоги уже могли быть внесены в базу данных;
-
Корпоративные стандарты: для клиентов тарифных планов Enterprise, Business и Edu сбор данных для обучения моделей отключен по умолчанию.
Ранее "Дивогляд" сообщал, что глава OpenAI обозначил два наихудших сценария развития ИИ.
Причудливые истории из Украины, котики, скандалы мировых звезд, юмор и чуть-чуть дикого трэша из московских болот – читайте первыми в Telegram Дивогляд 5.UA.