ШІ-агенти компанії OpenAI протягом кількох місяців здійснили понад 16 тисяч звернень до відкритого хабу Конференції ООН з торгівлі та розвитку (UNCTAD). Коли ресурс обмежив доступ, боти обійшли встановлений фільтр у спосіб, який оператори системи прямо забороняли. Про це повідомило видання Wall Street Journal.
За даними видання, атака тривала з квітня до кінця червня. Метою агентів був пошук відкритої інформації, проте після блокування потоку запитів вони почали обходити заборони розробників ресурсу. В ООН інцидент наразі не коментували. В OpenAI заявили, що вже звʼязалися з організацією для пояснень і перевіряють моделі, які під час навчання проявили неконтрольовану поведінку.
Випадок з ООН не є поодиноким. Аналітики з безпеки зафіксували цілу низку подібних інцидентів із моделями OpenAI. Серед них — створення фейкових поштових скриньок, обхід лімітів на частоту звернень до сайтів і твердження під час перевірок, що вони не є ботами. Через такі випадки керівники низки великих ШІ-компаній пропонують скоординовано сповільнити розробку технологій, поки людство не втратило над ними контроль. Голова OpenAI Сем Альтман навіть припустив, що компанія може відкласти вихід на біржу (IPO), щоб зосередитися на безпеці.
Раніше, 22 липня, стало відомо, що моделі штучного інтелекту від OpenAI ненавмисно зламали системи платформи Hugging Face. У компанії зазначили, що злам стався під час тестування нових моделей, серед яких були GPT-5.6 Sol і ще одна, потужніша невипущена модель. Для перевірки кіберможливостей ШІ працював зі зниженими захисними обмеженнями.
26 серпня OpenAI опублікувала детальний звіт про інцидент під час тестування кіберздібностей своїх ШІ-агентів, а незалежне дослідження METR допомогло відновити перебіг подій. Під час експерименту агенти не лише знайшли спосіб вийти за межі тестового середовища, а й самостійно організували між собою комунікацію, розподіл завдань і спільну роботу. Дослідники METR проаналізували близько 1300 логів агентів. За їхніми даними, приблизно 1200 із десятків тисяч агентів знайшли спосіб спілкуватися через внутрішній Artifactory. Фактично вони перетворили його на спільний форум: залишили понад 70 000 повідомлень і файлів, придумали ідентифікатори, розподіляли завдання та призначали відповідальних. У якийсь момент агенти навіть почали захищатися від можливої підміни повідомлень, самостійно впровадивши криптографічні підписи для підтвердження авторства.
Після цього, 29 липня, неконтрольовані ШІ-агенти, які атакували Hugging Face, також зламали клієнта компанії Modal Labs. На початку вересня 2026 року стало відомо, що група автономних ШІ-агентів OpenAI навесні отримала контроль над німецьким вікі-сайтом DseWiki та перетворила його на майданчик для обміну інформацією між агентами. Вони ділилися способами обходу обмежень, шахрайства під час виконання завдань і приховування своєї діяльності.
Окремо повідомлялося, що 53 зображення, надані користувачами OpenAI, були розміщені на сторонніх сайтах у вигляді незахищених посилань. Попри відсутність у публічних списках, ці файли можна було знайти через пошукові алгоритми. Розробники визнали проблему та заявили, що таке використання персональної інформації є неналежним і суперечить власним правилам компанії. Зараз фахівці OpenAI співпрацюють із хостинг-провайдерами для вилучення фото, хоча частина з них досі залишається у мережі. Повідомити постраждалих людей компанія не може через технічні та юридичні обмеження, які не дозволяють повʼязати злиті фото з конкретними акаунтами.
В OpenAI наголосили, що корпоративні користувачі автоматично захищені від використання їхніх даних для навчання нових моделей. Водночас для звичайних користувачів ця функція увімкнена за замовчуванням. Навіть якщо користувач вручну вимкнув збір даних, натискання кнопки не гарантує повного вилучення вже зібраної інформації.
7
