Дослідники за допомогою Claude отримали доступ до систем OpenAI
Дослідники Hacktron AI за допомогою Claude виявили вразливості OpenAI, отримали доступ до акаунтів і повідомили компанію.
Команда з трьох дослідників стартапу Hacktron AI у межах програми винагород OpenAI за знайдені вразливості отримала доступ до облікових записів співробітників компанії та її внутрішнього програмного забезпечення. Після цього фахівці повідомили OpenAI про проблеми, а компанія виплатила їм винагороду в розмірі 6 500 доларів.
Як повідомляє TechCrunch, дослідники використали модель Claude від Anthropic. За їхніми словами, вони поєднали дві критичні вразливості, що дозволило отримати доступ до кількох акаунтів ChatGPT працівників OpenAI, а через один з облікових записів — до Codex, підключеного до організації OpenAI на GitHub.
Вразливість у форумному програмному забезпеченні
Першу точку входу команда знайшла 25 липня у Discourse — сторонньому програмному забезпеченні, на якому працює форум спільноти OpenAI. Проблема була пов’язана з обробкою завантажених зображень у форматах HEIF та HEIC: під час їх перетворення на JPEG використовувалася бібліотека libheif із помилкою пам’яті.
Розробники libheif виправили цю помилку кількома місяцями раніше, однак вона не була офіційно позначена як вразливість і не отримала номер CVE — стандартного ідентифікатора відомих проблем безпеки. За оцінкою Hacktron, саме це могло призвести до використання у Discourse версії програмного забезпечення з уразливим компонентом.
Роль моделі Claude
У Hacktron заявили, що спеціальна версія Claude Opus 4.8 для дослідників кібербезпеки спочатку не змогла створити робочий експлойт. Ситуація змінилася після виходу Opus 5: команда стверджує, що надала моделі те саме завдання, і вона впоралася з ним упродовж кількох годин після релізу.
Після виявлення другої вразливості дослідники повідомили OpenAI та Discourse. Discourse випустила виправлення 27 липня, а OpenAI заявила, що усунула проблеми, виявлені Hacktron.