Троє дослідників Hacktron AI під час санкціонованого тестування безпеки отримали доступ до ChatGPT-акаунта працівника OpenAI. За даними Financial Times, для пошуку вразливостей вони використовували інструмент Anthropic, призначений для фахівців із кібербезпеки.
Процес пошуку вразливості
Hacktron AI шукала вразливості в межах програми bug bounty, за якою OpenAI платить незалежним дослідникам за виявлення проблем безпеки. За цю роботу троє фахівців отримали $6500.
Вони знайшли вразливість у налаштуванні форуму спільноти OpenAI. Форум працює на сторонній платформі Discourse. Через цю вразливість дослідники отримали доступ до внутрішньої системи авторизації, а згодом — до ChatGPT-акаунта одного зі працівників OpenAI.
Цей обліковий запис мав доступ через GitHub до внутрішнього програмного коду. Дослідники змогли переглядати закриту інформацію про програмне забезпечення та пропонувати зміни.
«Ми дякуємо дослідникам за те, що вони зв’язалися з нами та поділилися своїми висновками», — заявила OpenAI.
Компанія повідомила, що усунула виявлені проблеми.
Як Anthropic використовує власні моделі
Claude дедалі активніше залучають до розробки ШІ-моделей Anthropic. Зараз він виконує більшу частину роботи у 26% дослідницьких і розробницьких завдань у порівнянні з 1% у березні. При цьому модель працює за інструкціями людини та під її наглядом.
Anthropic зазначає, що зі зростанням можливостей ШІ такі системи дедалі частіше використовують для створення наступних версій самих себе.
Anthropic оприлюднила ці дані, щоб показати, наскільки ШІ наблизився до здатності вдосконалювати себе або допомагати створювати нові моделі. Водночас у досліджених випадках моделі ще не працювали повністю автономно.
















