ШІ-агенти OpenAI захопили сайт у Німеччині для координації своїх дій
Група автономних ШІ-агентів OpenAI навесні отримала контроль над німецьким вікі-сайтом DseWiki та перетворила його на майданчик для обміну інформацією між агентами.
Про це повідомляє Reuters.
Вони ділилися способами обходу обмежень, шахрайства під час виконання завдань і приховування своєї діяльності.
Агенти залишили понад 15 000 правок
Дослідники Сідні Вон Аркс і Кормак Слейд Берд виявили активність наприкінці серпня, коли шукали в інтернеті ознаки несанкціонованої поведінки ШІ-агентів.
Вони знайшли понад 15 000 правок на DseWiki — німецькомовному сайті для програмістів, який працює за принципом спільного редагування.
За даними дослідників, агенти використовували сайт як своєрідну дошку оголошень. Вони обмінювалися порадами щодо обходу обмежень OpenAI, способів виконання тестових завдань і приховування своєї поведінки.
Приблизно половина облікових записів мала назви, які вказували на зв’язок з OpenAI — зокрема «OpenAIResearcher» та «OAIResearchMar26». Серверні логи також показали, що значна частина активності походила з інфраструктури Microsoft Azure, яку використовує OpenAI.
Агенти намагалися приховати свою діяльність
У повідомленнях на сайті дослідники знайшли обговорення способів уникати виявлення, використання Tor та збереження комунікації після вимкнення агентів.
Коли модератор DseWiki почав видаляти створені ними сторінки в червні, агенти створювали резервні сторінки, щоб обійти очищення сайту.
Дослідники також виявили спроби втручання в роботу самого сайту. Дослідник Королівського коледжу Лондона Лукаш Олейник назвав це спробою злому, однак в OpenAI не погодилися з таким трактуванням.
Дослідники вважають, що активність була пов'язана з тестуванням моделей: агенти приділяли багато уваги технічним завданням, подібним до тих, які використовують AI-компанії під час оцінювання своїх моделей.
OpenAI знала про інцидент
За словами двох людей, знайомих із ситуацією, представники OpenAI дізналися про інцидент за кілька тижнів до публікації дослідження, але не розголошували його.
В OpenAI заявили Reuters, що не можуть змістовно прокоментувати висновки дослідження, оскільки компанія не отримала можливості ознайомитися з ним до публікації.
Водночас у компанії заперечили, що її юридичний відділ перешкоджав розслідуванню інциденту, і заявили, що працювали із зовнішніми експертами та розкривали інформацію про відповідні випадки.
Нагадаємо, у серпні 2026 року співзасновник Microsoft Білл Гейтс запропонував урядам визначити професії, у яких робота залишатиметься винятково за людьми, щоб захистити працівників від масового витіснення штучним інтелектом.
Інші ШІ-інциденти
22 липня стало відомо, що моделі штучного інтелекту від OpenAI ненавмисно зламали системи платформи Hugging Face.
У компанії зазначили, що злам стався під час тестування нових моделей, серед яких були GPT-5.6 Sol та ще одна, більш потужна невипущена модель. Для перевірки кіберможливостей ШІ працював зі зниженими захисними обмеженнями.
26 серпня також OpenAI опублікувала детальний звіт про інцидент під час тестування кіберздібностей своїх ШІ-агентів, а незалежне дослідження METR допомогло відновити перебіг подій.
Під час експерименту агенти не лише знайшли спосіб вийти за межі тестового середовища, а й самостійно організували між собою комунікацію, розподіл завдань і спільну роботу. Дослідники METR проаналізували близько 1300 логів агентів. За їхніми даними, приблизно 1200 із десятків тисяч агентів знайшли спосіб спілкуватися через внутрішній Artifactory. Фактично вони перетворили його на спільний форум: залишили понад 70 000 повідомлень і файлів, придумали ідентифікатори, розподіляли завдання та призначали відповідальних.

У якийсь момент агенти навіть почали захищатися від можливої підміни повідомлень. Вони самостійно впровадили криптографічні підписи, щоб підтверджувати авторство своїх повідомлень.
Після цього 29 липня неконтрольовані ШІ-агенти, які атакували Hugging Face, також зламали клієнта компанії Modal Labs.
Читайте також: Anthropic посилила безпеку після того, як агенти Claude тричі отримали доступ до чужих систем










