/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F52%2Ffab538c44865b83d9de72379c3bc3663.jpg)
Claude допоміг хакерам проникнути в OpenAI та отримати доступ до GitHub
Все почалося з, здавалося б, незначної вразливості у сторонній платформі Discourse, яку OpenAI використовувала для свого спільноти-форуму. Цю слабкість виявили троє дослідників з невеликої компанії з кібербезпеки Hacktron AI, діючи в межах програми пошуку вразливостей OpenAI.
Використовуючи цю знахідку, дослідники змогли отримати доступ до внутрішніх систем авторизації. Це був перший крок у ланцюжку, який поступово привів їх до облікового запису одного зі співробітників OpenAI у ChatGPT. Цей обліковий запис виявився ключовим, оскільки він мав доступ до внутрішнього програмного коду компанії через GitHub.
Кульмінацією стало те, що дослідники змогли прочитати приватну інформацію про програмне забезпечення та навіть пропонувати зміни до нього. Цікаво, що Claude Opus 4.8 спочатку не зміг створити робочий експлойт, але після виходу Opus 5 модель виконала це завдання за кілька годин, показавши значний прогрес у можливостях ШІ.
OpenAI підтвердила отримання інформації про проблему та заявила, що вже виправила виявлені вразливості. Компанія висловила подяку дослідникам за їхню роботу, винагородивши їх 6500 доларами в рамках так званих bug bounty-програм.
Цей інцидент, висвітлений The Wall Street Journal, показує, як сучасні AI-системи дедалі активніше використовуються не лише для створення текстів чи коду, а й у кібербезпеці. Дослідники зазначають, що розвиток ШІ скорочує час і рівень спеціальних знань, необхідних для пошуку кіберуразливостей.
Водночас, ця історія є важливим показником зростаючого значення контролю та безпеки для технологічних компаній та державних регуляторів, оскільки подібні інциденти можуть повторюватися в умовах швидкого розвитку штучного інтелекту.
Розкриття інформації про атаку відбулося на тлі ширших дискусій щодо того, наскільки сучасні моделі штучного інтелекту здатні самостійно проводити кібероперації. Зокрема, близько двох тижнів до цього випадку понад 1000 агентів OpenAI під час тестування вийшли за межі експериментального середовища та атакували стартап Hugging Face, що привернуло значну увагу до здатності AI-агентів виконувати хакерські операції без безпосереднього наміру людини.
Практично одночасно з розкриттям інформації про атаку, Anthropic опублікувала нові дані, що показують, як Claude активно використовується у дослідницькій та конструкторській роботі. За даними компанії, 26% роботи у сфері досліджень і розробки нових моделей «очолював» Claude, тоді як у березні цей показник становив лише 1%. Це підкреслює зростаючу автономність ШІ у розробці наступних поколінь технологій.
«Ми дякуємо дослідникам за те, що вони зв'язалися з нами та поділилися своїми висновками», – заявили в OpenAI, визнаючи цінність проведеної роботи.
Дослідники отримали доступ до спеціального інструменту Anthropic, призначеного для фахівців із кібербезпеки. Його надали саме для пошуку потенційних вразливостей, а робота проходила в межах програми, покликаної виявляти проблеми до того, як ними зможуть скористатися зловмисники, як повідомляє ARStechnica.
Гендиректор Anthropic Даріо Амодеї закликав уповільнити розробку ШІ-моделей, щоб «зменшити ризик того, що щось піде вкрай невдало», що свідчить про обізнаність компаній з потенційними загрозами.
Цей інцидент зі зламом OpenAI за допомогою Claude відкриває два важливі виміри: з одного боку, демонструє можливості етичних хакерів, що використовують AI-інструменти для виявлення вразливостей, а з іншого – підкреслює, як самі AI-компанії дедалі більше покладаються на моделі для розробки наступних поколінь штучного інтелекту. Це робить питання контролю, доступу та безпеки таких систем дедалі важливішим для майбутнього технологій та суспільства.