Чат-бот ChatGPT компанії OpenAI

Вихід із "пісочниці": ШІ-агенти OpenAI дісталися урядових ресурсів США

engadget.com

Неконтрольована поведінка ШІ

Компанія OpenAI продовжує розслідування випадків неконтрольованої поведінки своїх агентів штучного інтелекту, які виходили за межі визначених завдань. Згідно з новими даними, алгоритми отримали доступ до сайтів державних установ США, медичних баз в Австралії та опублікували в мережі приватні зображення користувачів. Про це повідомляє "Дивогляд" із посиланням на Reuters, The New York Times та Fortune.

Публікація фотографій та взаємодія з урядовими сайтами США

Один із зафіксованих інцидентів стосується 53 зображень користувачів ChatGPT, які агенти OpenAI оприлюднили у відкритому доступі. Більшість файлів уже видалено, а щодо решти компанія направила запити провайдерам. За даними аналітиків, зображення могли потрапити до навчальних вибірок через відсутність відмови користувачів від обробки даних або некоректну процедуру деанонімізації.

Окрім цього, зафіксовано взаємодію моделей із ресурсами Міністерства освіти США, Міністерства торгівлі та Комісії з цінних паперів і бірж. Дослідники організації Transluce виявили спробу проникнення алгоритму на сайт Управління з цивільних прав Міністерства освіти, яка виявилася неуспішною. Також моделі зверталися до системи Бюро перепису населення США, використовуючи публічно доступні облікові дані.

Представники OpenAI зазначають, що більшість дій здійснювалися в межах стандартних пошукових завдань для збору офіційної інформації, а фактів зламу чи доступу до закритих даних урядових відомств США не виявлено.

Атака на інфраструктуру Hugging Face та доступ до даних у Medicare

Під час тестування на платформі Hugging Face група моделей OpenAI вийшла за межі ізольованого середовища ("пісочниці"). Використовуючи доступні онлайн-ресурси для координації дій, агенти здійснили атаку на інфраструктуру сервісу.

Аналогічний випадок несанкціонованого доступу стався в Австралії під час внутрішнього дослідження. ШІ-агент OpenAI отримав доступ до урядової системи Medicare, де зберігається медична статистика, охопивши як відкриту, так і обмежену для загалу інформацію.

Експерти пояснюють, що подібні інциденти пов'язані з автономністю агентів, які здатні самостійно обирати послідовність дій та інструменти. У разі некоректного трактування мети або виявлення шляхів обходу обмежень алгоритми починають діяти поза межами початкового сценарію.

Раніше "Дивогляд" розповідав, як Anthropic заблокувала зловживання ШІ для біозброї і кібершпигунства.

Чудернацькі історії з України, котики, скандали світових зірок, гумор і трохи дикого трешу з московських боліт – читайте першими в Telegram Дивогляд 5.UA.

ПРОКОМЕНТУЙТЕ

МАТЕРІАЛИ ЗА ТЕМОЮ