Anthropic сообщает, что Claude теперь руководит 26% работ компании в области исследований и разработок ИИ, а более 90% достигает уровня сотр...

Anthropic опубликовала один из самых ясных на сегодняшний день внутренних обзоров того, насколько искусственный интеллект уже участвует в создании следующего поколения искусственного интеллекта.
По состоянию на август 2026 года Anthropic сообщает, что Claude руководит 26% работ компании в области исследований и разработок ИИ. Ранее в 2026 году этот показатель составлял менее 1%.
Заголовочная цифра впечатляет, но её легко неправильно интерпретировать.
«Claude руководит 26% исследований и разработок» не означает, что Claude самостоятельно выполняет четверть работы компании без участия людей. Anthropic использует шестиуровневую структуру автоматизации, и показатель 26% относится именно к задачам уровня AL4 — ИИ руководит: люди задают цель высокого уровня, Claude выполняет большую часть задачи от начала до конца, а люди сохраняют ответственность за контроль и утверждение результатов.
Anthropic также сообщает, что более 90% измеренных работ в области исследований и разработок ИИ достигли как минимум уровня AL3 — ИИ сотрудничает.
Одновременно компания разворачивает очень крупную внутреннюю инфраструктуру агентов. В августе около 30 000 агентов одновременно выполняли исследовательские и инженерные задачи на самой используемой внутренней платформе Anthropic, а компания проанализировала более одного миллиарда решений агентов, принятых за этот месяц.
Эти цифры помогают понять, почему обсуждение темы «ИИ создаёт ИИ» перешло от теории к измеримому явлению.
Они также показывают, почему особенно важна финальная оговорка:
Anthropic сообщает, что ни одна из измеренных работ не достигла полностью автономного уровня AL5.
Компания всё глубже внедряет ИИ в исследования и разработки — как в режиме помощи, так и в режиме руководства, — но не утверждает, что Claude может самостоятельно проектировать, обучать, оценивать и заменять себя без человеческого контроля.
Anthropic создала прототип индекса автоматизации исследований и разработок, чтобы отслеживать, какая доля исследований и разработок ИИ выполняется Claude.
Сначала компания классифицирует виды работ, входящих в разработку моделей, а затем присваивает каждой категории уровень автоматизации. Шкала основана на работе Epoch AI и простирается от AL0 до AL5.
| Уровень | Обозначение | Практическое значение |
|---|---|---|
| AL0 | Не используется | ИИ не принимает существенного участия в задаче. |
| AL1 | Незначительное участие | ИИ может помогать с отдельным поиском информации, мозговым штурмом или редактированием, но не меняет способ выполнения работы. |
| AL2 | Помогает | ИИ заметно ускоряет отдельные части задачи, но люди по-прежнему руководят работой и проверяют её. |
| AL3 | Сотрудничает | ИИ выполняет крупные фрагменты работы под пристальным руководством человека; люди по-прежнему принимают ключевые решения и интегрируют результат. |
| AL4 | Руководит | ИИ выполняет большую часть задачи от начала до конца по запросу высокого уровня, а люди контролируют процесс, корректируют его и утверждают результат. |
| AL5 | Автономный | ИИ выполняет работу от начала до конца при минимальном или полном отсутствии участия человека. |
Разница между AL3 и AL4 особенно важна.
На уровне AL3 человек сохраняет тесное участие. Он может предоставлять логи, предлагать гипотезы, отвечать на вопросы и решать, что делать при возникновении непредвиденной ситуации.
На уровне AL4 человек может передать Claude цель высокого уровня и позволить ему выполнить большую часть работы. Человек по-прежнему контролирует задачу, но ему не нужно постоянно направлять каждый шаг.
Anthropic сообщает о трёх основных результатах:
| Показатель | Результат, о котором сообщает Anthropic |
|---|---|
| Работа в области исследований и разработок ИИ, где Claude «руководит» на уровне AL4 | 26% |
| Работа в области исследований и разработок ИИ на уровне AL3 «сотрудничает» или выше | Более 90% |
| Работа в области исследований и разработок ИИ на уровне AL5 «автономный» | 0% измеренных подмножеств |
Таким образом, показатель 26% лучше всего понимать следующим образом:
Человек задаёт цель высокого уровня
↓
Claude выполняет большую часть рабочего процесса
↓
Человек контролирует и утверждает результат
Это не означает:
Claude самостоятельно выбирает исследовательскую повестку,
создаёт своего преемника, проверяет его и развёртывает
без участия человека
Это различие лежит в основе собственного определения рекурсивного самосовершенствования Anthropic.
Anthropic получила показатель 26% не просто опросив сотрудников о том, насколько часто они используют Claude.
Согласно опубликованной методологии, компания отобрала рабочие записи команд, участвующих в цикле разработки моделей, и составила восходящий перечень примерно из 15 000 детализированных задач за июль 2026 года.
Затем Claude помог организовать эти задачи в иерархию, включавшую:
Для каждой категории исследовательский агент изучал, как задача выполнялась на практике и какую часть процесса обрабатывал ИИ. Затем независимый оценщик на базе Claude присваивал уровень автоматизации.
Anthropic также попросила владельцев соответствующих направлений работы оценить автоматизацию отдельно.
Компания сообщает, что модель и люди дали абсолютно одинаковую оценку в 59% случаев, а в 97% случаев их оценки отличались не более чем на один уровень автоматизации.
Это полезное свидетельство, но не идеальное измерение.
Anthropic прямо отмечает, что пограничные случаи остаются субъективными, а модель-оценщик может допускать некоторые из тех же ошибок, что и системы, которые она оценивает.
В исходной статье также подчёркивается масштаб внутренней инфраструктуры агентов Anthropic.
Anthropic сообщает, что по состоянию на август 2026 года примерно 30 000 агентов одновременно выполняли исследовательские и инженерные задачи на самой используемой внутренней платформе компании.
Формулировка важна: речь идёт не о 30 000 постоянных сотрудниках, подобных людям, и не обязательно обо всех ИИ-агентах, используемых где-либо внутри Anthropic.
Это число агентов, одновременно активных на внутренней платформе, охваченной измерением.
Эти агенты могут работать в полуавтономном режиме в течение длительного времени и делегировать задачи друг другу.
Anthropic сообщает, что её внутренняя инфраструктура предоставляет агентам индивидуальные идентификаторы и использует открытую систему обмена сообщениями. Благодаря этому агенты могут видеть утверждения друг друга, ссылаться на исходные доказательства и исправлять ошибки, а не бездумно передавать информацию по цепочке.
Когда десятки тысяч агентов работают параллельно, контроль превращается в системную задачу.
Anthropic сообщает, что проанализировала более одного миллиарда решений, принятых исследовательскими и инженерными агентами в августе 2026 года.
Каждое действие на измеряемой внутренней платформе проходит через онлайн-монитор до выполнения.
Онлайн-монитор может:
Anthropic сообщает, что было заблокировано 0,002% из более чем одного миллиарда решений — примерно 1 из 47 000.
Этот низкий процент не следует автоматически интерпретировать как «агенты безопасны в 99,998% случаев». Частота блокировок — лишь один из показателей. Она зависит от того, что монитор способен обнаружить, как классифицируется поведение и какие рискованные действия вообще происходят.
Anthropic сама подчёркивает это: при таком масштабе трудно понять, видит ли система мониторинга каждое важное проявление поведения.
Anthropic описывает два уровня мониторинга.
Онлайн-мониторы проверяют действия до их выполнения.
Их задача — остановить поведение, которое может причинить немедленный и трудно обратимый вред, например попытку агента переместить чувствительные активы модели за пределы авторизованной системы.
Anthropic сообщает, что 100% действий агентов на измеряемой платформе проходят через этот уровень.
Офлайн-мониторинг изучает активность агентов после выполнения действий.
Он предназначен для выявления паттернов, которые могут развиваться постепенно, не причиняя немедленного ущерба.
Anthropic сообщает, что офлайн-система помечает примерно 100 000 расшифровок в неделю для дальнейшей проверки классификаторами.
Большинство случаев обрабатывается автоматически, но наиболее приоритетные — около 50 в неделю — передаются людям.
Таким образом, архитектура выглядит примерно так:
Агент предлагает действие
↓
Онлайн-монитор проверяет действие
↓
Действие выполняется, блокируется или перенаправляется
↓
Активность записывается
↓
Офлайн-мониторинг анализирует паттерны
↓
Наиболее приоритетные случаи попадают к людям-проверяющим
Эта система мониторинга — одна из важнейших частей заявления Anthropic, поскольку дальнейшая автоматизация приносит пользу только в том случае, если организация по-прежнему способна понимать происходящее и вмешиваться в действия агентов.
Второй важный тезис статьи AIBase касается объёма кода Anthropic, который теперь пишет Claude.
Здесь важно точно указать дату.
В официальном отчёте Anthropic «Когда ИИ создаёт себя» говорится, что по состоянию на май 2026 года более 80% кода, объединённого в кодовую базу Anthropic, было написано Claude.
До того как Claude Code перешёл в исследовательское превью в феврале 2025 года, этот показатель, по словам Anthropic, составлял низкие однозначные значения.
Это резкое изменение за немногим более чем год.
Эти два числа измеряют разные явления.
Опишите идею одной фразой, и We0 AI создаст сайт-витрину, страницы и CMS, а после запуска поможет привлечь клиентов и трафик.
Одна полная генерация проекта для бесплатной регистрации
Лучше всего попробовать один полный поток генерации и быстро увидеть первый черновик проекта.
| Показатель | Дата | Что измеряется |
|---|---|---|
| Более 80% | Май 2026 года | Доля кода Anthropic, объединённого в кодовую базу и написанного Claude |
| 26% | Август 2026 года | Доля взвешенной работы в области исследований и разработок ИИ, получившей оценку AL4 «ИИ руководит» |
| Более 90% | Август 2026 года | Доля взвешенной работы в области исследований и разработок ИИ, получившей оценку AL3 «сотрудничает» или выше |
Программный код — лишь одна часть разработки моделей.
Исследования ИИ также включают:
Именно поэтому Claude может писать 80% кода, а только 26% всех исследований и разработок ИИ классифицируются как работа под руководством ИИ.
Anthropic также сообщает, что типичный инженер объединял примерно в 8 раз больше кода в день во втором квартале 2026 года, чем в 2024 году.
Компания сразу добавляет важную оговорку: количество строк кода — несовершенный показатель производительности.
Большее количество кода не означает автоматически в восемь раз большую ценность.
Крупное изменение может включать:
Тем не менее Anthropic утверждает, что изменение достаточно велико, чтобы свидетельствовать о реальном ускорении инженерного процесса.
Эта динамика особенно примечательна потому, что объём результатов оставался относительно стабильным с 2021 по 2024 год, а затем начал расти после того, как Claude начал выполнять код, а не только предлагать фрагменты для вставки людьми.
В исходной статье работа Claude разделена на эксперименты с моделями, программирование, анализ данных и проверку результатов.
Собственные публикации Anthropic подтверждают более широкую картину: Claude всё активнее участвует в задачах на разных этапах цикла разработки моделей.
Это может включать такие виды работы, как:
Именно поэтому люди говорят о тенденции, при которой ИИ помогает создавать более совершенный ИИ.
Но существует важное различие между участием в разработке модели-преемника и полностью автономным созданием этой модели.
Согласно собственному определению Anthropic, нет.
Anthropic описывает рекурсивное самосовершенствование как момент, когда модель сможет полностью автономно создать своего преемника.
Данные об автоматизации за август прямо указывают, что ни одно измеренное подмножество исследований и разработок ИИ не достигло уровня AL5.
Поэтому наиболее точная формулировка на сегодня такова:
Claude существенно ускоряет процесс исследований и разработок, который создаёт будущие модели Claude, но Anthropic не утверждает, что Claude уже способен автономно выполнять весь цикл разработки модели-преемника.
Это различие важно, поскольку выражение «рекурсивное самосовершенствование» часто используется слишком свободно.
Можно выделить как минимум три разных этапа, которые люди могут иметь в виду:
Этап 1
ИИ помогает людям создавать следующую модель
Этап 2
ИИ руководит крупными частями рабочего процесса исследований и разработок
под контролем человека
Этап 3
ИИ автономно проектирует, создаёт, оценивает и совершенствует своего преемника
Опубликованные Anthropic данные убедительно подтверждают Этап 2 для растущей доли работы.
Они не демонстрируют Этап 3.
Anthropic утверждает, что цель измерений — не просто реклама производительности.
Компания считает, что если передовые модели начнут ускорять собственную разработку, обществу и государственным органам потребуются показатели, которые можно отслеживать во времени.
Предложенные компанией измерения сосредоточены на трёх аспектах:
Anthropic утверждает, что такие показатели со временем можно будет независимо проверять и использовать как основания для введения более строгих требований к безопасности.
Например, если доля исследований и разработок под руководством ИИ резко вырастет, лабораторию можно будет обязать использовать более длительные периоды тестирования или более строгую внешнюю оценку, прежде чем разрешить новой модели участвовать в дальнейших исследованиях и разработках.
Этот пункт отсутствует в краткой статье AIBase, но он приведён в том же измерительном отчёте Anthropic и помогает понять более широкую структуру оценки компании.
В рамках недельного среза за июль 2026 года Anthropic сообщает:
Anthropic называет эти оценки консервативными и отмечает, что разделение исследований безопасности и исследований возможностей по своей сути является сложной задачей.
Поэтому эти цифры следует рассматривать как снимок конкретного периода, а не как универсальное или постоянное соотношение.
Anthropic необычно подробно описывает ограничения своей методологии.
К важным оговоркам относятся:
Эти ограничения не делают показатели бессмысленными.
Они делают их более полезными, если интерпретировать их как измерения тенденций, а не как абсолютное доказательство автономности.
Это означает, что 26% взвешенной работы Anthropic в области исследований и разработок ИИ в настоящее время оценивается как AL4, при котором Claude может выполнять большую часть задачи от начала до конца по запросу высокого уровня. Люди по-прежнему контролируют, проверяют и утверждают работу, поэтому речь не идёт о полностью автономных исследованиях.
AL4 означает, что ИИ руководит большей частью задачи, а человек сохраняет ответственность за контроль и утверждение результата. AL5 означает, что работа выполняется автономно от начала до конца при минимальном или полном отсутствии участия человека; Anthropic сообщает, что ни одна из измеренных работ в области исследований и разработок ИИ не достигла AL5.
Anthropic сообщила, что по состоянию на май 2026 года более 80% кода, объединённого в её кодовую базу, было написано Claude. Этот показатель относится к объединённому коду, а не к 80% всех исследований, продуктовых решений или работ по разработке моделей.
Anthropic сообщает, что по состоянию на август 2026 года примерно 30 000 агентов одновременно выполняли исследовательские и инженерные задачи на самой используемой внутренней платформе компании. Это число относится к измеряемой внутренней платформе и не должно интерпретироваться как количество постоянных работников, эквивалентных людям.
Компания использует онлайн-мониторинг до выполнения действий и офлайн-мониторинг после них. Anthropic сообщает, что 100% действий на измеряемой платформе проходят через онлайн-монитор, а офлайн-системы помечают расшифровки для дальнейшей автоматической и человеческой проверки.
Anthropic сообщает, что онлайн-монитор заблокировал около 0,002% из более чем одного миллиарда решений агентов в августе 2026 года — примерно 1 из 47 000. Это статистика мониторинга, а не доказательство того, что каждое незаблокированное решение было безопасным или правильным.
Согласно собственному определению Anthropic, нет. Anthropic определяет более сильную форму рекурсивного самосовершенствования как полностью автономное создание моделью своего преемника, тогда как текущие данные компании показывают, что ни одна измеренная категория исследований и разработок ИИ не достигла автономности AL5.
Anthropic считает, что общественности, государственным органам и независимым оценщикам нужна прозрачность в отношении того, насколько быстро передовые лаборатории автоматизируют разработку моделей. Компания хочет, чтобы показатели автоматизации, контроля агентов и распределения вычислительных ресурсов стали отслеживаемыми сигналами, которые смогут влиять на будущие требования к безопасности.
Последние внутренние измерения Anthropic показывают быстрый переход к разработке моделей под руководством ИИ. По состоянию на август 2026 года Claude руководит 26% взвешенной работы в области исследований и разработок ИИ, более 90% достигает сотрудничества человека и ИИ или более высокого уровня, а около 30 000 агентов одновременно работали на самой используемой внутренней исследовательской платформе Anthropic.
Отдельно Anthropic сообщает, что по состоянию на май 2026 года Claude написал более 80% кода, объединённого в кодовую базу компании. Это убедительное свидетельство того, что ИИ уже глубоко участвует в создании систем, которые станут будущими моделями Claude, но этот показатель не следует путать с более широким уровнем автоматизации исследований и разработок.
Самое важное: Anthropic по-прежнему сообщает о нуле измеренных категорий исследований и разработок ИИ, достигших полной автономности AL5. Компания явно движется к более активной разработке ИИ с помощью ИИ, но не заявляет, что полностью автономное рекурсивное самосовершенствование уже наступило.
Сегодня наиболее ясный сигнал заключается не в том, что «Claude заменил исследователей Anthropic», а в том, что центр тяжести смещается от людей, выполняющих работу при поддержке ИИ, к людям, контролирующим рабочие процессы исследований и разработок, которые всё чаще возглавляются ИИ.
Начните с одной фразы и получите полноценный сайт за считанные минуты.