Слогер Создать блог
AI

Как выбрать первый AI-проект: пять осей вместо «начни с малого»

Самые ценные процессы — худшие кандидаты для старта. Рабочая рубрика: измеримость, готовность данных, цена ошибки, радиус изменений и ценность, с конкретными весами.

Совет «начни с малого» — это не критерий выбора, а способ остаться без выбора. Он отбрасывает самый крупный кандидат и ничего не говорит про остальные двенадцать. Чтобы расставить их по порядку, нужны веса.

Первый вопрос, который обычно задают

«Где AI добавит больше всего ценности?» — так звучит стандартное открытие. Ответ выводит в топ процессы, на которых стоит бизнес: ценообразование, андеррайтинг, клиническая сортировка. И именно они — худшие первые проекты. Не потому, что технически сложные, а потому, что ошибка там дороже всего, а согласование длиннее всего.

Правильный вопрос другой: «Где мы узнаем больше всего за неделю работы?» Первый проект даёт две вещи одновременно: бизнес-результат и организационную компетенцию. Вы один раз проходите security-ревью, учитесь строить модель затрат, оставляете в репозитории eval-харнесс. Для ровно одного проекта вторая вещь важнее первой. Поэтому веса в рубрике такие, какие есть.

Пять осей

Каждая ось оценивается от 1 до 5. Решает не ощущение, а ответ на конкретный вопрос.

ОсьЧто значит
ИзмеримостьМожно ли понять, что сработало, по данным, которые уже существуют, внутри пилотного окна? 5 — метрика есть, базовую линию можно вытащить уже сегодня. 1 — придётся строить измерение и фичу одновременно, и измерение проиграет.
Готовность данныхВходные данные уже собраны, актуальны, разрешены и лежат в одном месте? 5 — одна система, и пилотная команда уже имеет к ней доступ. 1 — четыре системы, две требуют новых запросов доступа, одну вообще никто не администрирует.
Цена ошибкиСколько стоит один неверный ответ. Инвертировано: дешёвые ошибки получают высокий балл. 5 — подсказка, которую пользователь может проигнорировать. 1 — результат уходит клиенту, регулятору или в платёжную систему без участия человека.
Радиус измененийСколько людей и систем изменится, если проект внедрят. Инвертировано: небольшой радиус = высокий балл. 5 — одна команда и один экран. 1 — изменение процесса в трёх отделах плюс программа обучения.
ЦенностьЧто задача стоит, если заработает. Считается в часах в неделю, умноженных на количество людей, или в строке затрат/выручки, которую кто-то уже отслеживает. 5 — цифра, которую финансы видят ежемесячно. 1 — улучшение, которого никто не заметит на дашборде.

Осознанно отсутствуют: техническая новизна, стратегическое соответствие и восторг руководства. Первое — не бонус, второе нефальсифицируемо, третье влияет на выживание проекта, а не на его очерёдность.

Оценивать нужно с теми, кто будет делать работу. Не в планёрке. По одному кандидату за раз, не по одной оси. Только исполнители знают, что в «единой системе» три экспорта и ночной джоб, который падает по понедельникам. А если оценивать по осям через всех кандидатов, невольно начинаешь сравнивать: этот более измерим, чем тот. Рубрике нужна абсолютная оценка по якорным определениям выше, иначе результаты разных сессий несопоставимы.

Веса

Вот формула для первого проекта. Второй оценивается по-другому, об этом ниже.

score = 0.30 × измеримость + 0.25 × готовность данных + 0.20 × цена ошибки + 0.15 × радиус изменений + 0.10 × ценность

Ценность весит меньше всего, и это не опечатка. В первом проекте ограничение почти никогда не в размере приза. Ограничение в том, сможет ли кто-нибудь понять, что вообще произошло, и успеет ли проект закончиться, пока спонсору не надоело. Высокоценный, но неизмеримый проект даёт не решение, а спор, и споры решаются старшинством.

Измеримость — самый тяжёлый критерий, потому что именно она превращает проект в доказательство для следующих трёх. Готовность данных — второй по весу, потому что именно по этой оси чаще всего обманывают себя: честная оценка не то, что существует в принципе, а то, что пилотная команда сможет прочитать в день старта пилота.

Два кандидата, посчитанных по формуле

Оба примера выдуманы для иллюстрации. Важна форма результата, а не цифры. Кандидат A — черновики ответов на входящие письма поддержки. Кандидат B — саммари звонков с клиентами в CRM.

ОсьВесA: черновики писемB: саммари звонков
Измеримость0.304 (время обработки уже логируется)2 (метрики нет, «качество CRM»)
Готовность данных0.254 (одна хелпдеск-система)2 (записи в другой системе, вопросы по согласиям открыты)
Цена ошибки0.204 (агент редактирует перед отправкой)3 (неверное саммари прочитают через недели)
Радиус изменений0.154 (одна команда, один экран)2 (меняется процесс продаж)
Ценность0.105 (большая команда)3 (приятно, но необязательно)

Итого: A = 4.10, B = 2.30. A выигрывает с большим отрывом. И интересно, почему. B — вполне разумная идея, она выжила бы в разговоре о ценности. Проигрывает она по измеримости и готовности данных — по тем осям, которые определяют, появится ли у проекта результат как таковой, а не насколько этот результат велик. Прогоните по формуле свой список — как минимум одна перестановка случится. Кандидат, которого все считали первым, обычно проигрывает по оси, которую никто вообще не оценивал.

Поменяйте один вход и посмотрите на чувствительность. Если бы у команды B была метрика полноты CRM с годом истории, её измеримость выросла бы с 2 до 5, и итог стал бы 3.20. Всё ещё отстаёт, но уже достаточно близко, чтобы главным аргументом стал разрыв в готовности данных. Это гораздо более продуктивный спор.

Четыре дисквалификатора

Любой кандидат вылетает из списка, даже с высоким баллом, если не выполнено одно из условий. Рубрика молча предполагает, что все они выполнены.

  • Нет названного владельца на принимающей стороне. Не спонсор. Человек, чья команда увидит изменения в работе. Если он не согласовал проект, баллы — украшение.
  • Результат нельзя проверить. Если никто не может отличить хороший ответ от плохого, не переделывая задачу целиком, — такой проект нельзя ни оценить, ни мониторить.
  • Данные, которые нельзя легально использовать для этой задачи. Особые категории, данные с другой целью сбора, контракт, запрещающий нового субагента. Вопрос решается юристами, и спросить их до оценки дешевле, чем после.
  • Задача работает только если модель права каждый раз. Там, где недопустимо ни одной ошибки и некуда встроить проверяющего, — это задача из области систем управления, просто в одежде первого проекта.

Что меняется для второго проекта

После того как компетенция куплена — ревью пройдено, модель затрат построена, eval-харнесс написан, — веса инвертируются. Измеримость и радиус изменений уже не так важны, механизм есть. Наверх выходит ценность: ничто структурное не мешает за ней идти. Держите рубрику и перенастраивайте веса осознанно, а не позволяйте критериям первого проекта застыть в постоянную политику.

Вывод

Первый проект не должен быть самым ценным. Он должен быть самым обучаемым: с существующей метрикой, доступными данными, дешёвой ошибкой и узким радиусом. Тогда он заканчивается, а не зависает в согласованиях, и после него остаётся не только фича, но и способность оценивать следующие проекты.

По материалам: ai. Текст переработан редакцией Слогера.

← На главную

Рекламное место — Конец поста
Реклама · Слогер

Комментарии (0)

Войдите, чтобы комментировать.

Пока нет комментариев. Будьте первым.