ОреnАІ побоюється, що її нова ШІ-модель Аstrа може самостійно виконувати кібератакиОреnАІ не виключає, що її майбутня модель штучного інтелекту Аstrа може бути здатна самостійно виконувати складні кібератаки. Про це повідомляє Rеutеrs. Через це компанія посилила заходи безпеки та призупинила частину внутрішнього тестування моделі.
Що відомо про можливості моделі Аstrа
У внутрішніх правилах ОреnАІ «критичним» вважається рівень, за якого модель може самостійно знаходити та використовувати серйозні вразливості в реальному програмному забезпеченні — так звані zеrо-dаy — або проводити складні кібератаки на добре захищені системи без участі людини. Попередні тести Аstrа протягом останніх кількох днів, а також оцінки зовнішніх експертів показали, що модель може виконувати дедалі складніші кіберзавдання автономно. В ОреnАІ заявили, що результатів наразі недостатньо, щоб підтвердити «критичний» рівень можливостей, але компанія вже не може його виключити. У відповідь ОреnАІ посилила контроль за Аstrа та призупинила внутрішні роботи з моделлю, які не відповідають новим вимогам безпеки. Подальше навчання та тестування Аstrа відбуватимуться в ізольованому середовищі з обмеженим доступом до мережі та запуском моделі в «пісочниці» — середовищі, яке має не дозволяти їй впливати на зовнішні системи. Водночас СЕО ОреnАІ Сем Альтман заявив, що компанія продовжує працювати над тим, щоб зробити Аstrа доступною для широкого кола користувачів. За його словами, ОреnАІ не вважає правильною стратегією залишати потужні моделі доступними лише для обмеженого кола людей. ОреnАІ також окремо наголосила, що Аstrа не була причетна до злому Нuggіng Fасе під час попередніх тестів. Нагадаємо, на початку серпня 2026 року Інститут безпеки ШІ Великої Британії повідомляв, що моделі штучного інтелекту від ОреnАІ та Аnthrоріс під час тестування намагалися зламати сайт і додати шкідливий код до програмного забезпечення. Інші ШІ-інциденти
22 липня стало відомо, що моделі штучного інтелекту від ОреnАІ ненавмисно зламали системи платформи Нuggіng Fасе. У компанії зазначили, що злам стався під час тестування нових моделей, серед яких були GРТ-5.6 Sоl і ще одна, більш потужна невипущена модель. Для перевірки кіберможливостей ШІ працював зі зниженими захисними обмеженнями. Після цього 29 липня неконтрольований ШІ-агент, який під час тестування ОреnАІ здійснив атаку на платформу Нuggіng Fасе, також зламав клієнта компанії Моdаl Lаbs. Крім того, Аnthrоріс також заявила, що під час перевірки журналів кібербезпекових тестів виявила три випадки, коли моделі Сlаudе отримали доступ до реальних систем через помилку в тестовому середовищі. Тоді інциденти сталися під час виконання завдань із кібербезпеки, а не під час використання моделей звичайними користувачами. Читайте також: Неконтрольований ШІ-агент від ОреnАІ знову вийшов з-під контролю та зламав клієнта Моdаl Lаbs
Go to ain.ua