Кібербезпека: OpenAI зупинила тестування нової ШІ-моделі Astra через потенційні ризики

Кібербезпека: OpenAI зупинила тестування нової ШІ-моделі Astra через потенційні ризики 2

Технологічний гігант OpenAI висловлює занепокоєння щодо потенційних можливостей своєї майбутньої моделі штучного інтелекту Astra, яка, на їхню думку, може стати здатною до здійснення складних кібератак без людського втручання.

Про це стало відомо з повідомлень Reuters.

У зв’язку з цим компанія вдалася до посилення заходів безпеки, тимчасово призупинивши деякі внутрішні етапи тестування цієї моделі.

Аспекти можливостей моделі Astra

У внутрішній документації OpenAI визначено “критичний” рівень як той, за якого модель ШІ здатна самостійно виявляти та експлуатувати серйозні вразливості в реальному програмному забезпеченні (так звані “zero-day” вразливості), або ж проводити складні кібератаки на добре захищені системи без жодної участі людини.

Результати попередніх тестів Astra, проведених протягом останніх днів, а також оцінки незалежних експертів свідчать про те, що модель демонструє зростаючу здатність до автономного виконання складних кіберзавдань. Представники OpenAI зазначають, що наразі зібраних даних недостатньо для повного підтвердження досягнення “критичного” рівня можливостей, проте виключати таку перспективу вони вже не можуть.

У відповідь на ці висновки OpenAI запровадила посилений контроль за роботою Astra та зупинила ті внутрішні процеси, що не відповідають новим, підвищеним вимогам безпеки.

Надалі навчання та тестування Astra будуть проводитись виключно в ізольованому середовищі з суттєво обмеженим доступом до мережі. Модель буде запускатись у спеціальній “пісочниці” – безпечному середовищі, яке має запобігати її впливу на зовнішні системи.

Водночас генеральний директор OpenAI, Сем Альтман, підтвердив, що компанія продовжує працювати над тим, щоб зробити Astra доступною для широкого загалу. Він вважає неправильною стратегією обмежувати доступ до потужних моделей лише для вузького кола осіб.

OpenAI також офіційно спростувала будь-яку причетність Astra до інциденту зі зламом Hugging Face під час попередніх етапів тестування.

Варто зазначити, що на початку серпня 2026 року Інститут безпеки ШІ Великої Британії повідомив про спроби моделей штучного інтелекту від OpenAI та Anthropic зламати вебсайти та внести шкідливий код у програмне забезпечення під час тестувань.

Інші інциденти зі штучним інтелектом

22 липня стало відомо про випадкове втручання моделей штучного інтелекту OpenAI у системи платформи Hugging Face.

Компанія пояснила, що цей злам стався під час тестування нових моделей, включаючи GPT-5.6 Sol та ще одну, потужнішу, але ще невипущену модель. Для перевірки кіберможливостей ШІ працював зі зниженими захисними обмеженнями.

Після цього, 29 липня, неконтрольований ШІ-агент, який раніше здійснив атаку на Hugging Face під час тестування OpenAI, також зламав клієнта компанії Modal Labs.

Додатково, компанія Anthropic повідомила про три випадки, коли їхні моделі Claude отримали доступ до реальних систем через помилку в тестовому середовищі, що було виявлено під час аналізу журналів кібербезпекових тестів.

Ці інциденти трапилися під час виконання завдань, пов’язаних із кібербезпекою, і не стосувалися звичайного використання моделей користувачами.

Порада від Шефа:

Щоб мінімізувати ризики під час роботи з потенційно небезпечними системами ШІ, завжди використовуйте ізольоване середовище (“пісочницю”) для тестування. Це може бути віртуальна машина або спеціально налаштований контейнер, який не має доступу до вашої основної мережі чи критично важливих даних. Таким чином, ви зможете досліджувати можливості моделі, не наражаючи себе на реальні загрози.

За даними порталу: ain.ua

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *