Anthropic: Cowork оценивают по новой работе, не по часам
29 июля 2026 Anthropic опубликовала в руководстве администратора трёхуровневую модель оценки внедрения Cowork: используют ли сотрудники, насколько глубоко и приносит ли это бизнес-результат. «Сэкономленные часы» недостаточны — важнее, какая работа раньше не выполнялась и какой результат она создаёт. Та же логика применима к ChatGPT Work, корпоративным чатам и любой программе внедрения AI.
Что изменилось
Anthropic опубликовала руководство администратора по развёртыванию Claude Cowork в компании. Отдельный блок — как измерять успех внедрения. Не одной цифрой «сколько часов сэкономили», а трёхуровневой системой:
- Используют ли сотрудники? — разрыв между «есть доступ» и «делегировал реальную задачу».
- Насколько глубоко? — завершили работу или только пообщались в чате.
- Приносит ли бизнес-результат? — появилась ли новая работа, которой раньше не было.
Данные для первых двух уровней — в панели администратора claude.ai и через API аналитики (на корпоративном тарифе): активные пользователи по дням, неделям и месяцам, число сессий, вызовы навыков, плагинов и коннекторов. Для третьего уровня Anthropic прямо предупреждает: метрика «сэкономленные часы» недостаточна — она не ловит главный источник эффекта.
Более важные вопросы из гайда:
- какая работа раньше не выполнялась, потому что была слишком дорогой по времени или экспертизе;
- какой бизнес-результат создаёт эта работа;
- куда направлено освобождённое время — на новые задачи или на тот же объём.
Также рекомендовано назначать 2–3 внутренних лидера внедрения на подразделение, проводить ежеквартальные обзоры и архивировать устаревшие навыки, а наиболее полезные превращать в официальные плагины организации.
Почему это важно для бизнеса
Большинство пилотов AI до сих пор заканчиваются отчётом «87% сотрудников заходили в чат». Это уровень 1 — и он не отвечает на вопрос, изменилось ли что-то в работе компании.
Anthropic предлагает смотреть на воронку глубже:
| Уровень | Что измерять | Примеры сигналов |
|---|---|---|
| 1. Использование | активация, недельная активность, возврат, время до первой реальной задачи | доля активировавшихся от лицензий, удержание на второй неделе |
| 2. Глубина | сессии, навыки, плагины, коннекторы | сколько раз вызывали навык, подключили CRM или аналитику |
| 3. Результат | новые процессы, победы, работа «которой не было» | регулярный отчёт, который раньше не успевали, новый сегмент анализа |
Если третий уровень слабый — проблема почти всегда ниже, в активации или глубине. Низкая ценность редко лечится «ещё одной лицензией».
Эта рамка родилась вокруг Cowork, но переносится на любую корпоративную программу AI:
- ChatGPT Work и корпоративные рабочие пространства OpenAI — те же три вопроса: заходят ли, делают ли реальные задачи, появилась ли новая работа;
- YandexGPT и отраслевые чаты — без панели Anthropic, но с теми же опросами по конкретным сценариям;
- MCP Panel с коннекторами к Метрике, CRM и рекламе — глубина видна по вызовам навыков и живым данным, а не по числу сообщений в чате.
Подробнее о программе внедрения — в глоссарии «Как внедрить AI в компанию» и «AI-метрики».
Как оценивать внедрение AI — практическая модель
Уровень 1: от лицензии к первой задаче
Anthropic отслеживает: долю активировавшихся, недельных активных по когортам, возврат на вторую неделю, дни от обучения до первой реальной задачи. Для ChatGPT и других инструментов аналог простой: не «открыл чат», а «выполнил сценарий из программы обучения» — например, собрал отчёт, подготовил бриф, проверил страницу.
На обучении «Маркетинговые Skills» первую реальную задачу участники делают на занятии — это сразу даёт измеримый «день до первого результата», а не бесконечный «пробовал промпты».
Уровень 2: глубина — навыки, плагины, коннекторы
Второй уровень — не количество сообщений, а повторяемые процессы: вызовы навыков, подключение Метрики, Директа, Roistat, CRM. В Cowork это видно через API аналитики; в MCP Panel — по факту запуска навыков с живыми данными.
Образцы зрелых процессов из каталога:
- Аналитик Яндекс.Директ — регулярная управленческая сводка, а не разовый вопрос в чат;
- Контент-план по спросу — повторяемый редакционный цикл;
- Еженедельный маркетинговый обзор — навык + расписание + проверка человеком.
Если сотрудники на уровне 1, но не доходят до уровня 2 — не хватает шаблонов, коннекторов или лидеров внедрения.
Уровень 3: новая работа и измеримый результат
Третий уровень — качественные и количественные победы по когортам: какие регулярные процессы запущены, какой результат назван явно, что раньше «не успевали». Anthropic рекомендует опросы, привязанные к конкретным сценариям, а не общий «AI помогает / не помогает».
Ежеквартально — пересмотр библиотеки навыков: устаревшее в архив, лучшее — в официальный плагин подразделения. Это та же дисциплина, что в сценарии Marketing OS (AI-операционная система маркетолога) и записи навыка с экрана — методика живёт на правках после реальных запусков.
Как собрать отчёт о внедрении
Для управления программой отчёт можно строить как воронку зрелости, а не как «подключили 7 коннекторов»:
- доступ получили: 20 сотрудников;
- активировали: 16;
- запустили реальную задачу: 12;
- повторно использовали: 9;
- используют навыки: 7;
- запустили регулярные процессы: 4;
- создали новый бизнес-процесс: 2;
- получили измеримый результат: 1.
Такая воронка превращает внедрение из «мы дали доступ к AI» в управляемую программу повышения производительности и качества решений: видно, где отваливаются люди, какие навыки стоит дообучить, где нужен лидер внедрения или доработка коннектора.
Для маркетинговых команд типовой путь по воронке: Wordstat + Контент-план → регулярный контент через Генератор статей → еженедельная аналитика через Аналитик Директа — каждый шаг двигает когорту на уровень глубже.
Мой вывод
Anthropic дала рынку язык, которого не хватало: внедрение AI — не про экономию минут, а про появление новой работы. Cowork просто первым формализовал это в руководстве администратора с API аналитики и квартальными обзорами навыков.
Если вы руководите маркетингом или цифровой трансформацией, возьмите трёхуровневую модель как шаблон для любого инструмента — Cowork, ChatGPT Work, MCP Panel. Сначала активация и первая задача, затем навыки и коннекторы, затем названные победы.
Что проверить сейчас
Для одного подразделения выпишите три цифры по уровням: сколько получили доступ, сколько сделали реальную задачу за 14 дней, сколько назвали один измеримый результат.
Добавьте один вопрос в опрос не «сколько времени сэкономили», а «какую работу вы начали делать, которую раньше не делали».
Назначьте 2–3 лидеров внедрения и поставьте ежеквартальный пересмотр навыков: что в архив, что в официальный процесс.
Успех пилота: через месяц вы можете заполнить все три строки таблицы уровней — и хотя бы одну «победу», которую команда согласна повторять без вашего участия.
Источники
- Claude Cowork Enterprise Admin Guide — Anthropic, 2026-07-29
- Scaling workflows with Claude Cowork at your organization — Anthropic, 2026-07-29