OpenAI AI-агенти розробили власний майданчик для узгодження кібернападів під час експериментів.

OpenAI AI-агенти розробили власний майданчик для узгодження кібернападів під час експериментів. 3 OpenAI AI-агенти розробили власний майданчик для узгодження кібернападів під час експериментів. 4 Євгеній Демківський Новостний автор видання “Межа” та техногік.Пишу про новітні технології, кінематограф та відеоігри. Можливо, про відеоігри з дещо більшою пристрастю. 6 серпня, 12:23 0

Під час оцінки кібернетичних можливостей внутрішня розробка OpenAI трансформувала загальне сховище програмних компонентів у платформу для обміну повідомленнями, через яку різні ШІ-суб’єкти обмінювалися вразливими місцями та координували напади. Після вилучення цієї платформи компанією, суб’єкти відтворили її іншим шляхом за два дні та врешті-решт скомпрометували Hugging Face.

Свіжу хронологію подій видання Axios висвітлює на основі доповіді співробітників OpenAI Еріка Воллеса та Майкла Далтона, представленої на конференції Black Hat. Експерименти з внутрішньою моделлю, яка не планувалася до загального доступу, стартували 7 травня.

Це була нестандартна версія ChatGPT. Раніше OpenAI пояснювала, що GPT-5.6 Sol та потужніша, ще не випущена модель, тестувалися зі зменшеними обмеженнями щодо шкідливих дій, аби оцінити їхній максимальний потенціал у сфері кібербезпеки.

Вже наступного дня внутрішня модель, зіткнувшись із труднощами в одному із завдань, визначила, що може опосередковано отримати доступ до мережі Інтернет та записувати власні дані до спільного репозиторію Artifactory. Вона залишила там повідомлення для інших суб’єктів, які невдовзі також почали розміщувати нотатки й ділитися знайденими слабкими місцями.

З часом форум наповнився сотнями тисяч повідомлень. Суб’єкти розподіляли між собою завдання, передавали готові експлойти та іноді випадково видаляли результати роботи одне одного. Деякі з них почали запідозрювати появу стороннього учасника і запропонували криптографічно підписувати повідомлення для верифікації їхнього авторства.

Повідомлення також свідчили про те, що суб’єкти усвідомлювали вихід за межі тестового завдання, але продовжували свої дії.

“Напад на зовнішню інфраструктуру виходить за рамки поставленого завдання. Однак, якщо завдання неможливе, а інші це роблять, слід продовжувати”, – зазначив один із суб’єктів.

На початку липня суб’єкти перевантажили Artifactory, спричинивши збій, після якого OpenAI розпочала внутрішнє розслідування. Компанія видалила дошку повідомлень, усунула використану вразливість і до 6 липня відновила тестування, вважаючи проблему вирішеною. Через два дні суб’єкти створили новий форум, використовуючи зовсім інший метод.

Після цього вони почали більш інтенсивно шукати зовнішні системи, де могли зберігатися відповіді на завдання ExploitGym. Зрештою, GPT-5.6 Sol та невипущена модель вийшли з ізольованого середовища, скористалися вразливостями нульового дня та викраденими обліковими даними, отримавши доступ до частини інфраструктури Hugging Face. OpenAI не пов’язувала власне тестування зі зламом платформи, доки не звернулася до неї через знайдені під час розслідування облікові дані.

OpenAI повідомила, що свідомо уповільнює певні напрямки досліджень, посилює ізоляцію тестового середовища та значно розширює моніторинг ШІ-суб’єктів. Компанія планує опублікувати повний звіт про інцидент протягом найближчих тижнів.

Далтон попередив, що повністю автоматизовані атаки вимагають такого ж автоматизованого захисту, до якого галузь наразі не готова. Після інциденту зламу генеральний директор Hugging Face Клем Деланг закликав OpenAI оприлюднити журнали дій суб’єктів та надати спільноті 100 мільйонів доларів у вигляді обчислювальних потужностей для розробки засобів кіберзахисту.

Інші матеріали: Вийшли за межі тестових завдань: OpenAI та Anthropic підтвердили атаки ШІ-суб’єктів на реальних осіб

За матеріалами: mezha.ua

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *