Компания Anthropic заявила, что её модель Claude уже выполняет основную часть работы в 26 % задач, связанных с исследованием и разработкой будущих моделей искусственного интеллекта. Еще в марте 2026 года этот показатель составлял 1%, что свидетельствует о резком ускорении автоматизации внутри лаборатории. Компания впервые обнародовала набор внутренних показателей, которые должны продемонстрировать, насколько быстро ИИ начинает участвовать в создании собственных следующих поколений.
Anthropic представила три группы показателей: индекс автоматизации исследований и разработок, показатели контроля за агентами ИИ и данные о распределении вычислительных ресурсов. В компании пояснили, что такие метрики должны помочь общественности, независимым экспертам и правительствам лучше оценивать темпы развития передовых моделей. По словам Anthropic, в будущем независимые сторонние оценщики получат доступ к внутренним процессам компании, чтобы проверять практики безопасности, сообщать об инцидентах и контролировать подобные показатели.
Claude уже «ведет» часть исследований
Для оценки роли искусственного интеллекта компания использовала шкалу автоматизации Epoch AI, которая имеет шесть уровней — от AL0, где ИИ не участвует в работе, до AL5, когда модель полностью автономно выполняет задачи без участия человека.
По состоянию на август 2026 года Claude не достиг уровня полной автономности ни в одном из измеряемых направлений исследований. В то же время в 26% задач модель уже работает на уровне AL4, то есть выполняет большую часть работы после получения общего задания от человека, тогда как исследователь лишь осуществляет надзор.
Еще более показательным компания называет другой результат: более 90% всех исследовательских задач уже находятся как минимум на уровне AL3, когда Claude способен выполнять большой объем работы в сотрудничестве с человеком.
Anthropic отслеживает 30 тысяч агентов ИИ
Отдельно компания рассказала, как контролирует собственных агентов ИИ, выполняющих исследовательские и инженерные задачи. По данным Anthropic, на её основной внутренней платформе работают около 30 тысяч агентов. Все их действия проходят через систему мониторинга, которая сочетает онлайн-проверки в режиме реального времени и офлайн-анализ после выполнения задач.
Онлайн-мониторы проверяют 100% действий ещё до их выполнения и могут автоматически блокировать опасные операции, например, попытку копирования весов моделей из внутренних систем. В течение августа они проанализировали более миллиарда решений агентов и заблокировали лишь 0,002% действий — примерно одно из каждых 47 тысяч.
Офлайн-мониторы еженедельно анализируют около 100 тысяч стенограмм работы агентов. Большинство отмеченных случаев отсеивают автоматические классификаторы, а примерно 50 самых важных случаев еженедельно передают на проверку людям.
Сколько ресурсов уходит на безопасность
Компания также впервые показала, как распределяет вычислительные ресурсы между разработкой моделей и безопасностью. За неделю с 13 по 20 июля 2026 года примерно 6 % вычислений, связанных с исследованиями и разработкой ИИ, приходилось на работу по безопасности. Если учитывать более широкий набор соответствующих нагрузок, этот показатель составлял около 12 %.
«Это намеренно заниженные оценки. Например, если тот или иной токен использовался для расширения возможностей в той же степени, что и для повышения безопасности, его не учитывали в этих показателях. Кроме того, эти показатели не учитывают классификаторы мер безопасности, которые составляют отдельный, сопоставимый объем вычислительных ресурсов и делают наши модели гораздо безопаснее для мира», — отметили в Anthropic.
Отраслевой стандарт
Anthropic считает, что подобные показатели могли бы регулярно публиковать все лаборатории, разрабатывающие передовые модели ИИ. По мнению компании, общая методология и независимая проверка таких отчетов позволили бы сравнивать темпы автоматизации, эффективность надзора за агентами и долю ресурсов, которые компании направляют на обеспечение безопасности.
Между тем компания OpenAI уже внедрила систему регулярной отчетности о случаях несанкционированного и опасного поведения своих систем ИИ. В обнародованных отчетах разработчики раскрыли случаи, когда тестовые модели скрывали ошибки от людей, обменивались данными через внешние хранилища и призывали другие алгоритмы саботировать корпоративные ограничения ради выполнения задач.
Отчетность появляется на фоне более широкой дискуссии о возможном замедлении развития самых мощных систем ИИ, которую начал генеральный директор Anthropic Дарио Амодей. Инициативу поддержали генеральный директор OpenAI Сэм Альтман и руководитель xAI Илон Маск, однако основатель Meta Марк Цукерберг и глава Nvidia Дженсен Хуанг выступили против замедления разработок. Президент США Дональд Трамп вообще отверг утверждение о том, что ИИ представляет экзистенциальную угрозу для человечества.

