Совет «начни с малого» — это не критерий выбора, а способ остаться без выбора. Он отбрасывает самый крупный кандидат и ничего не говорит про остальные двенадцать. Чтобы расставить их по порядку, нужны веса.
Первый вопрос, который обычно задают
«Где AI добавит больше всего ценности?» — так звучит стандартное открытие. Ответ выводит в топ процессы, на которых стоит бизнес: ценообразование, андеррайтинг, клиническая сортировка. И именно они — худшие первые проекты. Не потому, что технически сложные, а потому, что ошибка там дороже всего, а согласование длиннее всего.
Правильный вопрос другой: «Где мы узнаем больше всего за неделю работы?» Первый проект даёт две вещи одновременно: бизнес-результат и организационную компетенцию. Вы один раз проходите security-ревью, учитесь строить модель затрат, оставляете в репозитории eval-харнесс. Для ровно одного проекта вторая вещь важнее первой. Поэтому веса в рубрике такие, какие есть.
Пять осей
Каждая ось оценивается от 1 до 5. Решает не ощущение, а ответ на конкретный вопрос.
| Ось | Что значит |
|---|---|
| Измеримость | Можно ли понять, что сработало, по данным, которые уже существуют, внутри пилотного окна? 5 — метрика есть, базовую линию можно вытащить уже сегодня. 1 — придётся строить измерение и фичу одновременно, и измерение проиграет. |
| Готовность данных | Входные данные уже собраны, актуальны, разрешены и лежат в одном месте? 5 — одна система, и пилотная команда уже имеет к ней доступ. 1 — четыре системы, две требуют новых запросов доступа, одну вообще никто не администрирует. |
| Цена ошибки | Сколько стоит один неверный ответ. Инвертировано: дешёвые ошибки получают высокий балл. 5 — подсказка, которую пользователь может проигнорировать. 1 — результат уходит клиенту, регулятору или в платёжную систему без участия человека. |
| Радиус изменений | Сколько людей и систем изменится, если проект внедрят. Инвертировано: небольшой радиус = высокий балл. 5 — одна команда и один экран. 1 — изменение процесса в трёх отделах плюс программа обучения. |
| Ценность | Что задача стоит, если заработает. Считается в часах в неделю, умноженных на количество людей, или в строке затрат/выручки, которую кто-то уже отслеживает. 5 — цифра, которую финансы видят ежемесячно. 1 — улучшение, которого никто не заметит на дашборде. |
Осознанно отсутствуют: техническая новизна, стратегическое соответствие и восторг руководства. Первое — не бонус, второе нефальсифицируемо, третье влияет на выживание проекта, а не на его очерёдность.
Оценивать нужно с теми, кто будет делать работу. Не в планёрке. По одному кандидату за раз, не по одной оси. Только исполнители знают, что в «единой системе» три экспорта и ночной джоб, который падает по понедельникам. А если оценивать по осям через всех кандидатов, невольно начинаешь сравнивать: этот более измерим, чем тот. Рубрике нужна абсолютная оценка по якорным определениям выше, иначе результаты разных сессий несопоставимы.
Веса
Вот формула для первого проекта. Второй оценивается по-другому, об этом ниже.
score = 0.30 × измеримость + 0.25 × готовность данных + 0.20 × цена ошибки + 0.15 × радиус изменений + 0.10 × ценность
Ценность весит меньше всего, и это не опечатка. В первом проекте ограничение почти никогда не в размере приза. Ограничение в том, сможет ли кто-нибудь понять, что вообще произошло, и успеет ли проект закончиться, пока спонсору не надоело. Высокоценный, но неизмеримый проект даёт не решение, а спор, и споры решаются старшинством.
Измеримость — самый тяжёлый критерий, потому что именно она превращает проект в доказательство для следующих трёх. Готовность данных — второй по весу, потому что именно по этой оси чаще всего обманывают себя: честная оценка не то, что существует в принципе, а то, что пилотная команда сможет прочитать в день старта пилота.
Два кандидата, посчитанных по формуле
Оба примера выдуманы для иллюстрации. Важна форма результата, а не цифры. Кандидат A — черновики ответов на входящие письма поддержки. Кандидат B — саммари звонков с клиентами в CRM.
| Ось | Вес | A: черновики писем | B: саммари звонков |
|---|---|---|---|
| Измеримость | 0.30 | 4 (время обработки уже логируется) | 2 (метрики нет, «качество CRM») |
| Готовность данных | 0.25 | 4 (одна хелпдеск-система) | 2 (записи в другой системе, вопросы по согласиям открыты) |
| Цена ошибки | 0.20 | 4 (агент редактирует перед отправкой) | 3 (неверное саммари прочитают через недели) |
| Радиус изменений | 0.15 | 4 (одна команда, один экран) | 2 (меняется процесс продаж) |
| Ценность | 0.10 | 5 (большая команда) | 3 (приятно, но необязательно) |
Итого: A = 4.10, B = 2.30. A выигрывает с большим отрывом. И интересно, почему. B — вполне разумная идея, она выжила бы в разговоре о ценности. Проигрывает она по измеримости и готовности данных — по тем осям, которые определяют, появится ли у проекта результат как таковой, а не насколько этот результат велик. Прогоните по формуле свой список — как минимум одна перестановка случится. Кандидат, которого все считали первым, обычно проигрывает по оси, которую никто вообще не оценивал.
Поменяйте один вход и посмотрите на чувствительность. Если бы у команды B была метрика полноты CRM с годом истории, её измеримость выросла бы с 2 до 5, и итог стал бы 3.20. Всё ещё отстаёт, но уже достаточно близко, чтобы главным аргументом стал разрыв в готовности данных. Это гораздо более продуктивный спор.
Четыре дисквалификатора
Любой кандидат вылетает из списка, даже с высоким баллом, если не выполнено одно из условий. Рубрика молча предполагает, что все они выполнены.
- Нет названного владельца на принимающей стороне. Не спонсор. Человек, чья команда увидит изменения в работе. Если он не согласовал проект, баллы — украшение.
- Результат нельзя проверить. Если никто не может отличить хороший ответ от плохого, не переделывая задачу целиком, — такой проект нельзя ни оценить, ни мониторить.
- Данные, которые нельзя легально использовать для этой задачи. Особые категории, данные с другой целью сбора, контракт, запрещающий нового субагента. Вопрос решается юристами, и спросить их до оценки дешевле, чем после.
- Задача работает только если модель права каждый раз. Там, где недопустимо ни одной ошибки и некуда встроить проверяющего, — это задача из области систем управления, просто в одежде первого проекта.
Что меняется для второго проекта
После того как компетенция куплена — ревью пройдено, модель затрат построена, eval-харнесс написан, — веса инвертируются. Измеримость и радиус изменений уже не так важны, механизм есть. Наверх выходит ценность: ничто структурное не мешает за ней идти. Держите рубрику и перенастраивайте веса осознанно, а не позволяйте критериям первого проекта застыть в постоянную политику.
Вывод
Первый проект не должен быть самым ценным. Он должен быть самым обучаемым: с существующей метрикой, доступными данными, дешёвой ошибкой и узким радиусом. Тогда он заканчивается, а не зависает в согласованиях, и после него остаётся не только фича, но и способность оценивать следующие проекты.
Комментарии (0)
Войдите, чтобы комментировать.
Пока нет комментариев. Будьте первым.