Дослідники зламали акаунт працівника OpenAI за допомогою інструмента Anthropic

Ярослава Несисюк6 годин тому

Час прочитання: 2 хвилини

Дослідники зламали акаунт працівника OpenAI за допомогою інструмента Anthropic

Троє дослідників Hacktron AI під час санкціонованого тестування безпеки отримали доступ до ChatGPT-акаунта працівника OpenAI. За даними Financial Times, для пошуку вразливостей вони використовували інструмент Anthropic, призначений для фахівців із кібербезпеки.

Процес пошуку вразливості

Hacktron AI шукала вразливості в межах програми bug bounty, за якою OpenAI платить незалежним дослідникам за виявлення проблем безпеки. За цю роботу троє фахівців отримали $6500.

Вони знайшли вразливість у налаштуванні форуму спільноти OpenAI. Форум працює на сторонній платформі Discourse. Через цю вразливість дослідники отримали доступ до внутрішньої системи авторизації, а згодом — до ChatGPT-акаунта одного зі працівників OpenAI.

Цей обліковий запис мав доступ через GitHub до внутрішнього програмного коду. Дослідники змогли переглядати закриту інформацію про програмне забезпечення та пропонувати зміни.

«Ми дякуємо дослідникам за те, що вони зв’язалися з нами та поділилися своїми висновками», — заявила OpenAI.

Компанія повідомила, що усунула виявлені проблеми.

Як Anthropic використовує власні моделі

Claude дедалі активніше залучають до розробки ШІ-моделей Anthropic. Зараз він виконує більшу частину роботи у 26% дослідницьких і розробницьких завдань у порівнянні з 1% у березні. При цьому модель працює за інструкціями людини та під її наглядом.

Anthropic зазначає, що зі зростанням можливостей ШІ такі системи дедалі частіше використовують для створення наступних версій самих себе.

Anthropic оприлюднила ці дані, щоб показати, наскільки ШІ наблизився до здатності вдосконалювати себе або допомагати створювати нові моделі. Водночас у досліджених випадках моделі ще не працювали повністю автономно.

Більше матеріалів з розділу НовиниУсі з розділу