Почему эксперты получают больше пользы от Claude Code: выводы анализа 400 тысяч сессий

Антропологический взгляд на работу с ИИ-агентами всё чаще оказывается важнее очередного сравнения моделей по бенчмаркам. В июне 2026 года Anthropic опубликовала исследование реального использования Claude Code: авторы проанализировали около 400 тысяч интерактивных сессий примерно 235 тысяч пользователей за период с октября 2025-го по апрель 2026 года. Главный вывод — результат работы с агентом сильнее связан со знанием предметной области, чем с формальным опытом программирования.
Что именно изучала Anthropic
Исследователи рассматривали работу в командной строке, Claude.ai и настольном приложении Claude Code. Автоматические и «безголовые» сценарии, а также часть сторонних IDE в выборку не вошли. Сессии классифицировались по типу задачи, предполагаемой профессии пользователя, уровню предметной компетенции и признакам успешного завершения — например, прохождению тестов, коммитам или явному подтверждению результата.
Около 56% изученных сессий были связаны с написанием, исправлением и тестированием кода. Ещё 17% приходились на эксплуатацию ПО, 14% — на исследование системы и планирование изменений, а 13% — на анализ данных и подготовку текстовых материалов. Поэтому выводы относятся не только к разработчикам: агентный инструмент уже применяется для задач, где код выступает средством, а не конечным продуктом.
Человек выбирает цель, агент — способ исполнения
Исследование показывает устойчивое разделение ролей. В среднем пользователь принимает около 70% решений уровня планирования — что делать, какой подход выбрать и что считать завершённым результатом. На Claude приходится около 80% исполнительских решений: какие файлы изменить, какой код написать и какие команды запустить.
Типичная сессия включала примерно четыре обмена сообщениями. Один запрос пользователя запускал в среднем около десяти действий агента: чтение файлов, редактирование кода, запуск команд и проверку результата. Это важное уточнение для бизнеса: ценность агента возникает не из полностью автономной работы, а из правильного распределения ответственности. Человеку остаются постановка цели, ограничения и критерии качества; машине делегируется последовательность технических операций.
Почему предметная экспертиза важнее «магии промптов»
В сессиях, оценённых как начальный уровень, один запрос приводил примерно к пяти действиям Claude и около 600 словам вывода. У экспертов цепочка превышала 12 действий, а объём ответа достигал примерно 3200 слов. После учёта типа работы, стоимости задачи, месяца, профессии и семейства модели связь сохранялась.
Эксперт здесь — не обязательно старший программист. Классификатор оценивал компетентность применительно к конкретной задаче: насколько точно человек описывает контекст, задаёт проверяемые условия и способен заметить ошибку. Бухгалтер, хорошо понимающий правила сверки, может эффективнее руководить созданием скрипта, чем разработчик, незнакомый с предметными исключениями.
У сессий с экспертным уровнем проверяемый успех фиксировался более чем вдвое чаще, чем у новичков. При этом основной прирост происходил уже при переходе от начального к среднему уровню. Это означает, что для полезной работы с агентом не всегда нужна глубокая специализация: часто достаточно уверенного понимания процесса, данных и критериев приемки.
Что это меняет для компаний и интеграторов ИИ
Компаниям не стоит ограничивать внедрение кодовых агентов только IT-департаментом. В пилотные команды полезно включать сотрудников, которые хорошо знают реальные бизнес-процессы: финансовые правила, логистику, договорную работу, поддержку клиентов или производство. Разработчик может отвечать за архитектуру и безопасность, а предметный эксперт — за правильность постановки и проверку результата.
Обучение также следует строить не вокруг списка универсальных промптов. Сотруднику нужны навыки декомпозиции задачи, описания входных данных, формулирования ограничений и создания проверок. Хорошая инструкция агенту должна содержать контекст, ожидаемый результат и способ доказать, что задача выполнена: тесты, контрольные примеры, сверку показателей или процедуру ручной приемки.
Для интеграторов вывод практический: интерфейс агента должен помогать пользователю передать предметный контекст, а не только отправить короткую команду. Полезны шаблоны требований, подключение внутренних справочников, журналы действий, управляемые разрешения и обязательные контрольные точки перед изменениями в продуктивной среде.
Почему результаты нужно трактовать осторожно
Авторы называют выводы предварительными. Они не видят, был ли созданный код позже внедрён и принёс ли экономическую пользу. Оценки компетентности и успеха основаны на моделях-классификаторах, читающих обезличенные транскрипты, а не на независимой экспертизе каждого результата. Кроме того, исследование охватывает пользователей одного продукта и не обязательно полностью переносится на другие ИИ-агенты.
Тем не менее работа даёт редкий масштабный срез реального взаимодействия с кодовым агентом. Для рынка Узбекистана её главный смысл прост: внедрение ИИ не отменяет профессиональную компетентность. Напротив, сотрудники, которые понимают задачу, умеют задать ограничения и проверить итог, получают от агента больше самостоятельной работы и чаще доводят сессию до результата.
Первоисточник
Исследование Anthropic от 16 июня 2026 года: Agentic coding and persistent returns to expertise.









