Anthropic опубликовала данные о том, насколько активно Claude используется внутри компании при исследовании и разработке следующих поколений моделей искусственного интеллекта. По данным компании, Claude уже самостоятельно выполняет основную часть работы в 26% соответствующих задач. Еще в феврале 2026 года этот показатель составлял менее 1%.
При этом речь не идет о полностью автономной разработке. В описываемом сценарии сотрудник дает модели общее задание, после чего Claude может самостоятельно выполнить значительную часть работы. Человек контролирует процесс и проверяет полученный результат.
Claude участвует более чем в 90% исследовательских задач
Если учитывать не только задачи, которые Claude способен выполнить практически самостоятельно, но и работу под руководством человека, показатель значительно выше. Более чем в 90% исследовательских и разработочных задач модель выполняет как минимум значительную часть работы.
Таким образом, Claude уже используется не просто как вспомогательный инструмент для отдельных операций. Модель принимает участие в широком спектре процессов, связанных с созданием и исследованием новых ИИ-систем.
При этом Anthropic подчеркивает, что полной автономности пока не достигнуто. Ни в одной из проанализированных категорий Claude не выполняет весь процесс без участия человека.
Anthropic отслеживает приближение к рекурсивному самосовершенствованию
Компания использует уровень автоматизации как один из показателей для оценки того, насколько быстро ИИ приближается к возможности самостоятельно участвовать в создании следующих поколений моделей.
Особое внимание уделяется сценарию рекурсивного самосовершенствования. Под ним подразумевается ситуация, при которой система искусственного интеллекта сможет в значительной степени самостоятельно разрабатывать или улучшать свои преемники.
Показатель в 26% не означает, что Claude уже способен самостоятельно создавать новую модель. Он отражает долю внутренних задач определенного типа, где модель может выполнять основную работу после получения общего указания от человека.
Для анализа изучили около 15 тысяч задач
Чтобы получить эти данные, Anthropic проанализировала примерно 15 000 внутренних исследовательских и инженерных задач. Их распределили по категориям в зависимости от степени участия и самостоятельности ИИ.
При этом часть самого анализа и оценки также выполнялась с помощью Claude. Anthropic признает, что такой подход может создавать определенную погрешность и влиять на интерпретацию уровня автоматизации.
Компания считает важным продолжать отслеживать показатель по единой методике, чтобы со временем можно было сравнивать изменения и оценивать темпы роста автоматизации.
Внутри Anthropic работают десятки тысяч ИИ-агентов
Помимо отдельных задач, компания активно использует автономных и полуавтономных ИИ-агентов. На основной внутренней платформе Anthropic одновременно работает около 30 000 таких систем, которые используются для исследовательских и инженерных процессов.
В августе системы мониторинга проверили более миллиарда действий ИИ-агентов. Из них были заблокированы примерно 0,002% — около одного действия на каждые 47 000 проверенных операций.
Около 50 наиболее важных предупреждений каждую неделю передаются сотрудникам Anthropic для дополнительной проверки. Такой контроль позволяет компании отслеживать потенциально опасные или нежелательные действия автоматизированных систем.
На безопасность приходится часть вычислительных ресурсов
Anthropic также изучила распределение вычислительных мощностей за одну неделю в июле. Около 6% всех ресурсов, использованных для исследований и разработки ИИ, пришлось на задачи, связанные с безопасностью.
Если рассматривать только вычислительные ресурсы, которые использовали ИИ-агенты при разработке моделей, доля исследований безопасности была выше и составила около 12%.
Компания связывает эти показатели с необходимостью одновременно развивать возможности моделей и совершенствовать системы контроля. По мере увеличения объема работы, выполняемой ИИ, возрастает значение механизмов, способных отслеживать действия агентов и выявлять потенциальные проблемы.
Anthropic предлагает публиковать аналогичные данные
Компания призывает других разработчиков ИИ также раскрывать показатели автоматизации исследований и разработки по сопоставимой методике. Кроме того, Anthropic предлагает допускать к проверке таких данных независимых экспертов.
По мнению компании, открытое сравнение подобных показателей позволит лучше понять, насколько быстро ИИ берет на себя работу по созданию новых ИИ-систем и успевают ли механизмы безопасности адаптироваться к этим изменениям.
При этом опубликованные Anthropic цифры характеризуют прежде всего внутренние процессы самой компании и не позволяют напрямую переносить их на всю индустрию. Для более объективной картины потребуются аналогичные данные от других разработчиков и независимая проверка методики оценки.


