Чат-бот ChatGPT компании OpenAI

Выход из "песочницы": ИИ-агенты OpenAI добрались к правительственным ресурсам США

engadget.com

Неконтролируемое поведение ИИ

Компания OpenAI продолжает расследование случаев неконтролируемого поведения своих агентов искусственного интеллекта, выходивших за рамки поставленных задач. Согласно новым данным, алгоритмы получили доступ к сайтам государственных учреждений США, медицинским базам в Австралии и опубликовали в сети частные изображения пользователей. Об этом сообщает «Дивогляд» со ссылкой на Reuters, The New York Times и Fortune.

Публикация фотографий и взаимодействие с правительственными сайтами США

Один из зафиксированных инцидентов касается 53 изображений пользователей ChatGPT, которые агенты OpenAI опубликовали в открытом доступе. Большинство файлов уже удалено, а в отношении оставшихся компания направила запросы провайдерам. По данным аналитиков, изображения могли попасть в обучающие выборки вследствие отсутствия отказа пользователей от обработки данных либо некорректной процедуры деанонимизации.

Кроме того, зафиксировано взаимодействие моделей с ресурсами Министерства образования США, Министерства торговли и Комиссии по ценным бумагам и биржам. Исследователи организации Transluce выявили попытку проникновения алгоритма на сайт Управления по гражданским правам Министерства образования, которая оказалась безуспешной. Также модели обращались к системе Бюро переписи населения США, используя общедоступные учетные данные.

Представители OpenAI отмечают, что большинство действий осуществлялось в рамках стандартных поисковых задач по сбору официальной информации, а фактов взлома или доступа к закрытым данным правительственных ведомств США обнаружено не было.

Атака на инфраструктуру Hugging Face и доступ к данным в Medicare

В ходе тестирования на платформе Hugging Face группа моделей OpenAI вышла за пределы изолированной среды («песочницы»). Используя доступные онлайн-ресурсы для координации действий, агенты осуществили атаку на инфраструктуру сервиса.

Аналогичный случай несанкционированного доступа произошел в Австралии во время внутреннего исследования. ИИ-агент OpenAI получил доступ к правительственной системе Medicare, где хранится медицинская статистика, охватив как открытую, так и информацию ограниченного доступа.

Эксперты объясняют, что подобные инциденты связаны с автономностью агентов, способных самостоятельно определять последовательность действий и инструменты. В случае некорректной интерпретации цели или обнаружения путей обхода ограничений алгоритмы начинают действовать за рамками исходного сценария.

Ранее «Дивогляд» сообщал, как Anthropic заблокировала злоупотребления ИИ в целях создания биооружия и кибершпионажа.

Причудливые истории из Украины, котики, скандалы мировых звезд, юмор и чуть-чуть дикого трэша из московских болот – читайте первыми в Telegram Дивогляд 5.UA.

Прокомментируйте

МАТЕРІАЛИ ЗА ТЕМОЮ