Support us

Исследователи взломали OpenAI с помощью Claude — и получили доступ к внутреннему коду

Специалисты по кибербезопасности из Hacktron AI с помощью Claude получили доступ к аккаунту сотрудника OpenAI и через него — к внутреннему коду компании. В рамках программы bug bounty исследователи получили за работу $6500.

Оставить комментарий
Исследователи взломали OpenAI с помощью Claude — и получили доступ к внутреннему коду

Специалисты по кибербезопасности из Hacktron AI с помощью Claude получили доступ к аккаунту сотрудника OpenAI и через него — к внутреннему коду компании. В рамках программы bug bounty исследователи получили за работу $6500.

Исследователи из Hacktron AI использовали инструмент Anthropic на базе Claude, предназначенный для специалистов по безопасности. С его помощью они нашли две связанные уязвимости: одну — в обработке изображений на форуме OpenAI, работающем на Discourse, вторую — в системе единого входа OpenAI. Вся цепочка атаки — от поиска проблемы до доступа к внутреннему репозиторию — заняла меньше 72 часов. 

Сначала команда работала с Claude Opus 4.8, но модель не смогла сделать эксплойт достаточно надежным. После выхода Claude Opus 5 исследователи дали ей ту же задачу, и примерно за три часа она подготовила рабочий вариант для ARM64, а затем помогла адаптировать его под конфигурацию Discourse. При этом Claude отказался писать эксплойт для удаленной системы, поэтому часть работы исследователи проводили на собственной тестовой копии Discourse, оформленной как CTF-задача.

После получения доступа к форуму исследователи смогли добраться до системы внутренней авторизации, а затем — до ChatGPT- и Codex-аккаунта сотрудника OpenAI. Его Codex был подключен к GitHub компании и давал доступ к внутреннему монорепозиторию. Чтобы подтвердить уязвимость и не изучать закрытый код, команда попросила Codex создать безобидный pull request, после чего прекратила дальнейшее тестирование. 

«Мы благодарим исследователей за то, что они связались с нами и поделились своими выводами», — заявила OpenAI. Компания сообщила, что исправила найденные проблемы. По данным Hacktron, OpenAI закрыла уязвимость со своей стороны примерно через 14 часов после получения отчета, а позднее выплатила исследователям $6500 по программе bug bounty.

«Не надо делать из ИИ человека»: глава Microsoft AI раскритиковал Anthropic за «очеловечивание» Claude
«Не надо делать из ИИ человека»: глава Microsoft AI раскритиковал Anthropic за «очеловечивание» Claude
По теме
«Не надо делать из ИИ человека»: глава Microsoft AI раскритиковал Anthropic за «очеловечивание» Claude
Планы затормозить гонку ИИ поссорила сотрудников в OpenAI и Anthropic
Планы затормозить гонку ИИ поссорила сотрудников в OpenAI и Anthropic
По теме
Планы затормозить гонку ИИ поссорила сотрудников в OpenAI и Anthropic
Пользователь собрал «аналог Photoshop» с помощью GPT-6 Astra и Claude — за $2000
Пользователь собрал «аналог Photoshop» с помощью GPT-6 Astra и Claude — за $2000
По теме
Пользователь собрал «аналог Photoshop» с помощью GPT-6 Astra и Claude — за $2000
Читайте также
OpenAI запустила ИИ-агента, который сам ищет и фиксит баги
OpenAI запустила ИИ-агента, который сам ищет и фиксит баги
OpenAI запустила ИИ-агента, который сам ищет и фиксит баги
1 комментарий
Догоняя Anthropic: OpenAI пытается повторить успех суперпопулярного Claude Code
Догоняя Anthropic: OpenAI пытается повторить успех суперпопулярного Claude Code
Догоняя Anthropic: OpenAI пытается повторить успех суперпопулярного Claude Code
OpenAI запустила Daybreak — свой ответ на Claude Mythos от Anthropic
OpenAI запустила Daybreak — свой ответ на Claude Mythos от Anthropic
OpenAI запустила Daybreak — свой ответ на Claude Mythos от Anthropic
Модели Anthropic сбежали во время тестов и взломали три компании
Модели Anthropic сбежали во время тестов и взломали три компании
Модели Anthropic сбежали во время тестов и взломали три компании

Хотите сообщить важную новость? Свяжитесь с редакцией через страницу контактов

Главные события и полезные ссылки в нашем Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Комментариев пока нет.