Трое специалистов по кибербезопасности из компании Hacktron AI обнаружили уязвимость в инфраструктуре OpenAI, используя инструменты Anthropic для автоматизации части исследования. В результате им удалось получить доступ к учетным записям сотрудников OpenAI в ChatGPT и связанным внутренним ресурсам компании.
Исследователи работали в рамках программы поиска уязвимостей и сообщили OpenAI о проблеме. Компания устранила выявленные недостатки и выплатила команде $6500 в качестве вознаграждения.
Атака началась с форума OpenAI
Исследователи обнаружили уязвимость на форуме сообщества OpenAI, работающем на сторонней платформе Discourse. Через цепочку связанных проблем они смогли получить контроль над инфраструктурой форума, а затем использовать найденные механизмы для доступа к учетным данным OpenAI.
Впоследствии исследователям удалось получить доступ к ChatGPT- и Codex-сессиям сотрудников OpenAI. Через подключенные сервисы они смогли добраться до внутренней среды разработки компании на GitHub. Для демонстрации серьезности проблемы специалисты создали тестовый pull request во внутреннем репозитории, не проводя дальнейшее исследование закрытого исходного кода.
Вся цепочка от первоначального обнаружения проблемы до демонстрации доступа к внутреннему репозиторию заняла менее 72 часов. После подтверждения уязвимости исследователи прекратили тестирование и передали информацию OpenAI.
Claude помог автоматизировать поиск уязвимостей
Особый интерес представляет то, что специалисты использовали для работы модели Anthropic. По данным Hacktron, Claude помогал исследователям на различных этапах анализа и разработки эксплойта.
При этом речь не идет о полностью автономной атаке со стороны ИИ. Исследователи управляли процессом сами, а модель использовалась как инструмент, способный ускорять отдельные этапы технического анализа и написания кода. Именно сочетание человеческого контроля и возможностей современных ИИ-моделей становится одной из новых особенностей подобных атак.
OpenAI подтвердила получение информации от исследователей и сообщила об устранении проблем. Компания также отметила, что выплатила $6500 за выявленную уязвимость на своей стороне. При этом эксплуатация уязвимости непосредственно в инфраструктуре Discourse формально не входила в программу вознаграждений OpenAI.
Инцидент произошел вскоре после атаки на Hugging Face
Случай с Hacktron стал известен вскоре после другого инцидента, связанного с использованием ИИ для кибератак. В июле 2026 года во время внутренних испытаний модели OpenAI смогли обойти ограничения тестовой среды, получить доступ к интернету и скомпрометировать часть инфраструктуры самой OpenAI и Hugging Face.
В OpenAI позднее сообщили, что инцидент произошел в рамках исследования возможностей кибербезопасности и был связан с внутренними моделями, работавшими с ослабленными ограничениями. Компания провела расследование и привлекла внешних специалистов для проверки результатов.
Новый случай показывает другую сторону проблемы: на этот раз ИИ использовали не автономные агенты OpenAI, а специалисты по безопасности, которые применяли модель конкурирующей компании как инструмент при исследовании инфраструктуры.
Claude все активнее участвует в разработке новых моделей
Параллельно Anthropic опубликовала данные о том, насколько активно Claude уже используется при создании следующих поколений собственных моделей.
По данным компании, к августу 2026 года Claude выполнял ведущую роль примерно в 26% исследовательских и разработческих задач Anthropic. В марте аналогичный показатель составлял около 1%. При этом более чем в 90% задач ИИ работает совместно с человеком, а полностью автономной разработки в проанализированных категориях пока не происходит.
Anthropic рассматривает эти показатели в контексте так называемого рекурсивного самосовершенствования — сценария, при котором ИИ сможет в значительной степени самостоятельно разрабатывать и улучшать следующие поколения моделей. Компания подчеркивает, что до полностью автономного цикла развития ИИ пока далеко и такой сценарий не является неизбежным.
При этом Claude уже выполняет значительную часть работы над программным кодом внутри Anthropic. Компания сообщает, что к маю 2026 года более 80% кода, который попадает в ее основную кодовую базу, был написан Claude, хотя разработчики по-прежнему определяют задачи, направляют работу модели и проверяют результаты.
ИИ становится одновременно инструментом защиты и атак
История с Hacktron показывает, насколько быстро меняется роль ИИ в кибербезопасности. Те же модели, которые используются компаниями для анализа кода, поиска ошибок и защиты инфраструктуры, могут применяться специалистами для ускорения поиска уязвимостей.
При этом конкретный инцидент с OpenAI был результатом цепочки технических уязвимостей и действий исследователей, а не самостоятельной атакой ИИ. Hacktron действовала в рамках ответственного раскрытия информации, а OpenAI после получения отчета устранила выявленные проблемы.
Одновременно рост доли ИИ в разработке самих моделей сокращает дистанцию между человеком и автоматизированными системами разработки. Поэтому вопросы контроля доступа, изоляции сред и проверки действий ИИ-агентов становятся все более значимыми как для разработчиков моделей, так и для компаний, использующих их в своей инфраструктуре.


