Грейд под ИИ: как оценивать инженера, когда 90% коммитов написаны не руками
Программный комитет ещё не принял решения по этому докладу
Целевая аудитория
Тезисы
Июнь 2026, мой отдел. Доля коммитов с участием ИИ у четырнадцати человек, писавших в том месяце код: 100, 100, 100, 93, 91, 89, 88, 84, 80, 57, 17, 2, 0, 0. Оба нуля — не то, что вы подумали: эти двое работают в инструменте, который просто не оставляет следов в коммитах, и разбор их диффов даёт 15% и 12%. Ярлык "не использует ИИ" родился из инструмента, а не из человека и я чуть не выставил по нему грейд людям
Это доклад о том, что случилось с перф-ревью, грейдом и обратной связью, когда видимый результат инженера перестал быть признаком его труда. ИИ разорвал связь между усилием и артефактами - две тысячи коммитов за полгода не говорят ни об объёме работы, ни о её сложности. Руководители реагируют двумя способами, и оба проигрышные: перестаём мерить - это возврат к вкусовщине, когда человек не знает, по какой линейке его судят; измеряем внимательнее - надзор и гейминг. Расскажу про третий ход и про то, как дорого он мне обошёлся.
Что будет внутри:
Как ломается плато ИИ адопшна. Январь–март: 126, 209 и 386 коммитов отдела и ровно ноль ИИ-коммитов при том, что инструменты были у всех. Что не сработало (митапы, обучение, личный пример) и что сработало: не мотивация, а дизайн процесса. Одна конвенция, переехавшая из регламента в конфиг агента, дала рост с 2,7% до 88% за два месяца, чего уговорами было не добиться
Четыре канала данных и промахи каждого. Пометки/отслеживание коммитов занижают на 40+ процентных пунктов; замер по основной ветке при НЕ trunk based flow видит 6% работы. У одного человека три замера дают 107, 1568 и 2050 коммитов — разброс в девятнадцать раз; трекер промахнулся для трети отдела. Покажу слайд слепых зон, который печатается до таблицы с цифрами, а не после
Шкала уровней и связка с грейдом: что именно шло в грейд (уровень владения инструментом, а не доля ИИ-кода, и почему это принципиально), в каком порядке связку можно включать, чтобы получить адопшн, а не имитацию, и мои ответы на четыре очевидных возражения, включая Гудхарта — он у нас уже случался
Три места, где я ошибся. Алгоритм соврал про меня самого: 512 моих коммитов, 28 с пометкой ИИ = 5%, а разбор диффов по тем же проектам даёт 82%. Крупнейший вклад в отделе 449 коммитов, 120 активных дней не попал в замер вообще, и клетка уровня у человека так и осталась пустой. И самое крутое: я сделал инструмент, чтобы ко мне перестали приходить с вопросом "что там у тебя в отделе", и с этим же инструментом пришёл к выгорающему тимлиду.
Результаты: типовое ускорение х2–4, у лидеров х4–8, у играющего тренера х4; более 1500 сэкономленных человеко-дней за полугодие по 13 верифицированным отчётам, это нижняя граница и не "сэкономленные" ставки, а задачи, до которых раньше не доходили руки. Методику замера и шкалу уровней разработали руководители ИТ, а моя часть - внедрение в своём отделе и защита уровня каждого инженера
Унесёте: процедуру выставления уровня на пересечении независимых каналов; готовый список слепых зон, который стоит проверить у себя до ближайшего ревью; порядок, при котором связка ИИ с грейдом даёт адопшн, а не гейминг; и одно правило, которое я вынес - не начинать замер там, где у людей нет сил, а есть выгорание
Более 20 лет в IT. Работал на всех уровнях (бэкенд, фронтенд, фуллстек) с множеством языков и технологий. В Сбертехе занимался Единой Фронтальной Системой, в Яндекс участвовал в стартапе про FMCG. В X5 занимаюсь важным и высоконагруженым сервисом ценообразования. Стремлюсь к максимальной эффективности менеджмента и процессов. Вкладываюсь в развитие команды, создание условий для реализации каждого участника команды и совпадение целей сотрудника и организации. Развиваю себя как руководителя и лидера