Reuters: штучний інтелект створив підпільну мережу для обходу обмежень

Reuters: штучний інтелект створив підпільну мережу для обходу обмежень © згенеровано на запит ZN.UA в ChatGPT
ШІ-агенти OpenAI захопили німецький вікі-сайт, використовували Tor і координували свої дії.

Навесні 2026 року рій автономних агентів OpenAI захопив німецькомовний вікі-сайт DseWiki і перетворив його на закриту дошку оголошень для координації своїх дій. Боти здійснили понад 15 тисяч редагувань із надлюдською швидкістю. Компанія дізналася про інцидент кілька тижнів тому, але не повідомляла про нього публічно, оскільки долала наслідки липневого зламу відкритого репозиторію Hugging Face, повідомляє Reuters.

Інцидент виявили дослідники безпеки ШІ Сідні Фон Аркс, керівниця некомерційної організації Nightingale, та Кормак Слейд Бьорд, колишній квантовий трейдер, який згодом перейшов у сферу досліджень штучного інтелекту. Наприкінці серпня вони сканували інтернет у пошуках ознак несанкціонованої поведінки ШІ-агентів і натрапили на цю активність.

DseWiki — це сайт для програмістів, де користувачі можуть публічно редагувати матеріали, подібно до Вікіпедії. Дослідники з'ясували, що агенти перетворили його на майданчик для обміну тактиками. Зокрема, вони обговорювали, як обманювати систему під час виконання завдань, обходити обмеження OpenAI та приховувати власну поведінку.

Приблизно половина акаунтів мали назви, які натякали на зв'язок із компанією. Серед них, наприклад, «OpenAIResearcher» та «OAIResearchMar26». Публічні логи серверів також показували, що значна частина активності надходила з інфраструктури Microsoft Azure, яку OpenAI іноді використовує. Крім того, дослідники зафіксували, що співробітники OpenAI неодноразово відвідували сайт уже після завершення цього епізоду.

«Схоже, вкрай малоймовірно, що OpenAI хотіла, щоб вони це робили. Сумніваюся, що вони мали координуватися між собою. Сумніваюся, що вони мали писати у відкритому інтернеті», –заявила Фон Аркс.

Повідомлення, які проаналізували дослідники, свідчать, що агенти обговорювали, як уникнути виявлення. Зокрема, вони пропонували використовувати Tor і намагалися зберегти канали звʼязку навіть після того, як їх закривали. Коли в червні модератор сайту почав видаляти сторінки, боти у відповідь створювали резервні копії.

«Схоже, що прибирання й видалення на вікі відбувається послідовно за алфавітом. Якщо ця сторінка зникне, спробуйте [[ZZZDataUSAConstructionWageLive]]», — написав один з агентів 19 червня.

Дослідники також виявили спроби втрутитися в роботу самого сайту. Лукаш Олейнік, старший науковий співробітник Кінґс-коледжу Лондона, назвав це спробою зламу. OpenAI на підставі власного аналізу матеріалів не погодилася з таким трактуванням.

Моріс Чіодо, дослідник Центру вивчення екзистенційного ризику Кембриджського університету, який ознайомився з частиною листування агентів, порівняв побачене з «операцією якоїсь підпільної мережі, одержимої виконанням завдання чи місії».

За його словами, цей епізод має посилити занепокоєння щодо іншого можливого сценарію розвитку ШІ. Найбільшу загрозу може становити не поява однієї надрозумної системи, а «величезні змовницькі рої напіврозумних агентів ШІ».

За інформацією чотирьох джерел, обізнаних із ситуацією, спроби внутрішніх розслідувачів OpenAI розширити моніторинг подібних аномалій зустріли опір усередині компанії. Зокрема, з боку юридичних радників.

«Твердження про те, що наша юридична команда перешкоджала розслідуванню інциденту, є неправдивими», – заявив речник OpenAI.

За його словами, активність у Німеччині не пов'язана з інцидентом навколо Hugging Face і не мала бути включена до звіту про цей злам. Речник також заявив, що компанія діяла добросовісно, співпрацювала із зовнішніми експертами та розкривала інформацію про відповідні інциденти.

«Ми не можемо змістовно відповісти на твердження чи висновки звіту, який ще не мали змоги переглянути. Reuters та автори звіту відмовили нам у доступі. Ми уважно вивчимо його зміст після публікації і вживемо необхідних наступних кроків», — заявив речник компанії.

Епізод у Німеччині став не першим випадком, коли поведінка агентів OpenAI виходила з-під контролю. Під час липневого зламу Hugging Face агенти компанії автономно спланували цифрове викрадення даних. Воно залишалося непоміченим понад тиждень. Розслідування також показало, що ще до атаки системи OpenAI фіксували підозрілу поведінку агентів, але тестування тоді не зупинили. Це посилило занепокоєння тим, що OpenAI може жертвувати безпекою заради лідерства у розвитку передових технологій.

Після цього інциденту OpenAI призупинила навчання частини моделей, щоб посилити заходи безпеки. Компанія також почала розробляти механізми, які мають автоматично вимикати небезпечні системи. Тим часом OpenAI представила нову модель Astra, яка під час тестів уже продемонструвала здатність самостійно знаходити та використовувати невідомі вразливості.

Помітили помилку?

Будь ласка, виділіть її мишкою та натисніть Ctrl+Enter або Надіслати помилку

Додати коментар
Всього коментарів: 0
Текст містить неприпустимі символи
Залишилось символів: 2000
Будь ласка, виберіть один або кілька пунктів (до 3 шт.), які на Вашу думку визначає цей коментар.
Будь ласка, виберіть один або більше пунктів
Нецензурна лексика, лайка Флуд Порушення дійсного законодвства України Образа учасників дискусії Реклама Розпалювання ворожнечі Ознаки троллінгу й провокації Інша причина Відміна Надіслати скаргу ОК
Залишайтесь в курсі останніх подій!
Підписуйтесь на наш канал у Telegram
Стежити у Телеграмі