ШІ почав створювати сам себе: Claude виконує 26% ключових досліджень Anthropic

ШІ почав створювати сам себе: Claude виконує 26% ключових досліджень Anthropic © Getty Images
За пів року частка завдань, де модель веде роботу, зросла на 25%.

Anthropic заявила, що її модель Claude вже виконує основну частину роботи у 26% завдань, пов'язаних із дослідженням і розробкою майбутніх моделей штучного інтелекту. Ще в березні 2026 року цей показник був на рівні 1%, що свідчить про різке прискорення автоматизації всередині лабораторії. Компанія вперше оприлюднила набір внутрішніх показників, які мають показати, наскільки швидко ШІ починає брати участь у створенні власних наступних поколінь.

Anthropic представила три групи вимірювань: індекс автоматизації досліджень і розробок, показники нагляду за агентами ШІ та дані про розподіл обчислювальних ресурсів. У компанії пояснили, що такі метрики мають допомогти громадськості, незалежним експертам і урядам краще оцінювати темпи розвитку передових моделей. За словами Anthropic, у майбутньому незалежні сторонні оцінювачі отримають доступ до внутрішніх процесів компанії, щоб перевіряти практики безпеки, повідомляти про інциденти й контролювати подібні показники.

Claude уже «веде» частину досліджень

Для оцінки ролі штучного інтелекту компанія використала шкалу автоматизації Epoch AI, яка має шість рівнів — від AL0, де ШІ не бере участі в роботі, до AL5, коли модель повністю автономно виконує завдання без людини.

Станом на серпень 2026 року Claude не досяг рівня повної автономності в жодному з вимірюваних напрямів досліджень. Водночас у 26% завдань модель уже працює на рівні AL4, тобто виконує більшу частину роботи після отримання загального завдання від людини, тоді як дослідник лише здійснює нагляд.

Ще більш показовим компанія називає інший результат: понад 90% усіх дослідницьких завдань уже перебувають щонайменше на рівні AL3, коли Claude здатний виконувати великий обсяг роботи у співпраці з людиною.

Anthropic

Anthropic відстежує 30 тисяч агентів ШІ

Окремо компанія розкрила, як контролює власних агентів ШІ, які виконують дослідницькі та інженерні завдання. За даними Anthropic, на її основній внутрішній платформі працюють близько 30 тисяч агентів. Усі їхні дії проходять через систему моніторингу, яка поєднує онлайн-перевірки в режимі реального часу та офлайн-аналіз після виконання завдань.

Онлайн-монітори перевіряють 100% дій ще до їх виконання й можуть автоматично блокувати небезпечні операції, наприклад, спробу копіювання ваг моделей із внутрішніх систем. Протягом серпня вони проаналізували понад мільярд рішень агентів і заблокували лише 0,002% дій — приблизно одну з кожних 47 тисяч.

Офлайн-монітори щотижня аналізують близько 100 тисяч стенограм роботи агентів. Більшість позначених випадків відсіюють автоматичні класифікатори, а приблизно 50 найважливіших випадків щотижня передають на перевірку людям.

Скільки ресурсів іде на безпеку

Компанія також вперше показала, як розподіляє обчислювальні ресурси між розвитком моделей і безпекою. За тиждень з 13 до 20 липня 2026 року приблизно 6% обчислень, пов'язаних із дослідженнями та розробкою ШІ, припадали на роботи з безпеки. Якщо враховувати ширший набір відповідних навантажень, цей показник становив близько 12%.

«Це навмисно занижені оцінки. Наприклад, якщо той чи інший токен використовувався для розширення можливостей у тій же мірі, що й для підвищення безпеки, його не враховували в цих показниках. Крім того, ці показники не враховують класифікатори заходів безпеки, які становлять окремий, порівнянний обсяг обчислювальних ресурсів і роблять наші моделі набагато безпечнішими для світу», — зазначили в Anthropic.

Галузевий стандарт

Anthropic вважає, що подібні показники могли б регулярно публікувати всі лабораторії, які розробляють передові моделі ШІ. На думку компанії, спільна методологія та незалежна перевірка таких звітів дали б змогу порівнювати темпи автоматизації, ефективність нагляду за агентами й частку ресурсів, які компанії спрямовують на безпеку.

Тим часом компанія OpenAI вже запровадила систему регулярного звітування про випадки несанкціонованої та небезпечної поведінки своїх систем ШІ. В оприлюднених звітах розробники розкрили випадки, коли тестові моделі приховували помилки від людей, обмінювалися даними через зовнішні сховища й закликали інші алгоритми саботувати корпоративні обмеження заради виконання завдань.

Звітність зʼявляється на тлі ширшої дискусії про можливе уповільнення розвитку найпотужніших систем ШІ, яку розпочав генеральний директор Anthropic Даріо Амодей. Ініціативу підтримали гендиректор OpenAI Сем Альтман та керівник xAI Ілон Маск, однак засновник Meta Марк Цукерберг та глава Nvidia Дженсен Хуанг виступили проти сповільнення розробок. Президент США Дональд Трамп взагалі, відкинув твердження про те, що ШІ становить екзистенційну загрозу для людства.

Помітили помилку?

Будь ласка, виділіть її мишкою та натисніть Ctrl+Enter або Надіслати помилку

Додати коментар
Всього коментарів: 0
Текст містить неприпустимі символи
Залишилось символів: 2000
Будь ласка, виберіть один або кілька пунктів (до 3 шт.), які на Вашу думку визначає цей коментар.
Будь ласка, виберіть один або більше пунктів
Нецензурна лексика, лайка Флуд Порушення дійсного законодвства України Образа учасників дискусії Реклама Розпалювання ворожнечі Ознаки троллінгу й провокації Інша причина Відміна Надіслати скаргу ОК
Залишайтесь в курсі останніх подій!
Підписуйтесь на наш канал у Telegram
Стежити у Телеграмі