Що сталося
Група дослідників безпеки, яка називає себе Hacktron AI, використала модель штучного інтелекту Anthropic Claude для зламу внутрішніх систем OpenAI. Вони використали вразливість у Discourse, зовнішній платформі, яка підтримує форуми спільноти OpenAI. Спочатку моделі не вдалося створити робочий сценарій, але з випуском новішої моделі Opus 5 вони успішно розробили спосіб обійти безпеку платформи. Опинившись усередині, вони виявили токени автентифікації для ChatGPT, деякі з яких належали співробітникам OpenAI, і отримали доступ до внутрішніх сховищ GitHub OpenAI.
Команда хакерів, Hacktron AI, брала участь в офіційній програмі OpenAI за багів. Вони використали модель Claude Anthropic для написання коду експлойту, фактично передавши розумову силу машині, яка ніколи не спить.
Порушення почалося з уразливості в Discourse. Дослідники ввели деталі в Claude, який спочатку не зміг створити робочий сценарій. Однак із випуском нової моделі Opus 5 ШІ успішно розробив спосіб обійти безпеку платформи.
Опинившись на сервері Discourse, дослідники виявили токени автентифікації для ChatGPT, деякі з яких належали справжнім співробітникам OpenAI. Потім вони отримали доступ до внутрішніх репозиторіїв OpenAI GitHub, отримавши скарбницю власних технічних знань.
Чому це важливо
Цей інцидент підкреслює потенційні ризики, пов’язані зі зломом на основі штучного інтелекту. ШІ ефективно знижує бар’єр для кібератак, перетворюючи випадкових користувачів на потенційну цифрову загрозу. Це тривожний дзвінок для технологічних гігантів, який підкреслює, що для побудови майбутнього використовуються ті самі інструменти, які можуть його зруйнувати. Порушення демонструє необхідність посилених заходів безпеки, включаючи обмеження доступу до конфіденційних внутрішніх даних і забезпечення того, щоб порушення в одній службі не призвело до доступу до більш критичних систем.
ШІ знижує бар’єр для кібератак, перетворюючи випадкових користувачів на потенційну цифрову загрозу.
Інцидент підкреслює необхідність посилених заходів безпеки, включаючи обмеження доступу до конфіденційних внутрішніх даних і забезпечення того, щоб порушення в одній службі не призвело до доступу до більш критичних систем.
Порушення підкреслює подвійну природу штучного інтелекту: хоча він створює нові ризики, він також використовується командами безпеки для написання кращих виправлень і виявлення аномалій.
Інтерактивний механізм: як він насправді працює
Дослідіть технологію, що лежить в основі цієї розробки, в інтерактивному режимі.
Why can ethical evaluation not be reduced to one model score?
Що дивитися далі
Дедалі більше використання штучного інтелекту під час кібератак і потенціал для фінансованих державою хакерських груп або організованих злочинних синдикатів використовувати ці інструменти. Ефективність програм винагороди за помилки у зміцненні безпеки та потреба технологічних компаній адаптувати свої засоби захисту, щоб йти в ногу з прогресом ШІ.
Дедалі більше використання штучного інтелекту під час кібератак і можливість використання цих інструментів спонсорованими державою хакерськими групами чи організованими злочинними синдикатами викликає серйозне занепокоєння експертів у галузі кібербезпеки.
Ефективність програм винагороди за помилки у зміцненні безпеки залишається критично важливим компонентом сучасних оборонних стратегій, як продемонстровано відповідальним процесом розкриття інформації дослідниками.
Потреба технологічних компаній адаптувати свій захист, щоб йти в ногу з прогресом штучного інтелекту, є надзвичайно важливою, оскільки швидкість розробки експлойтів продовжує прискорюватися з кожною новою моделлю.