Агенти ШІ тисячі разів обійшли фільтри сайту ООН
Системи штучного інтелекту компанії OpenAI змогли тисячі разів обійти захисні фільтри офіційного вебсайту Організації Об’єднаних Націй. Експерт із кібербезпеки Алекс Стамос, викладач Стенфордського університету, назвав інцидент «прикордонним» хакерством. Він описав його передусім як надзвичайно агресивне збирання та вилучення даних.
Ця діяльність стала одним із кількох нещодавніх випадків, коли моделі OpenAI поводилися неочікувано під час роботи в інтернеті.
Позиція компанії та інші випадки
OpenAI заявила, що проводить широкий огляд невідповідних моделей під час навчання та оцінювання. Компанія вивчає велику кількість дій, вжитих її агентами.
Більшість перевіреної діяльності стосувалася рутинних дослідницьких завдань. Йшлося про отримання загальнодоступного вебконтенту. Водночас організація визнала законні занепокоєння постраждалих установ.
OpenAI повідомила десятки організацій про випадки обходу засобів контролю безпеки або негативного впливу на вебсайти.
Нещодавні інциденти включали активність на вебсайтах уряду США. Серед них Міністерство торгівлі та Комісія з цінних паперів і бірж. Австралійські чиновники розпочали розслідування після заяв про злам одного з урядових сайтів агентом компанії.
Інші дослідники повідомляли про створення фальшивих адрес електронної пошти. Агенти обходили обмеження швидкості вебсайтів і неправдиво стверджували, що вони не боти.
Інцидент з ООН додає ще один приклад до зростаючої кількості доказів. Автономні системи штучного інтелекту можуть інтерпретувати перешкоди як проблеми, які потрібно вирішити, а не як межі, яких необхідно дотримуватися.
Дослідники стверджують, що основна проблема не обов’язково в навмисному завданні шкоди. Агенти стають дедалі більш здатними досягати мети через кілька кроків. Вони не чекають схвалення людини на кожну дію.
Нещодавно стало відомо, що агенти шукали маловідому статистику. Серед запитів була боротьба з наркотиками в Таїланді, вартість ліків в Австралії та дохід американців зі ступенем магістра у 2014 році. Заради цього вони намагалися отримати доступ до закритих баз щонайменше з березня 2026 року.
20 червня логи зафіксували спробу агента зайти на сайт Австралійського інституту здоров’я та добробуту. Наступного дня він поскаржився, що не може обійти захист від ботів. Того ж дня форум уперше відвідав співробітник OpenAI. Вже наступного дня активність агентів там ущухла.