Измервайте полезния напредък
ЗавършеноИзмервайте завършената работа, усилието за преглед и преработката. Не използвайте обема генериран код като мярка за стойност.
Проверете разбирането сиAI намалява реализацията от 60 на 30 минути. Прегледът нараства от 10 на 45 минути. Какво можете да заключите?Направете упражнението
Какво ще научите
- Разграничете дейността от полезния резултат.
- Включете подготовката, прегледа и поправките в сравнението на времето.
- Разпознайте ограниченията на твърдение за производителност.
Определете резултата преди показателя
AI инструмент може да генерира код бързо. Полезният резултат е промяна, която удовлетворява потребителска нужда при необходимото качество. Това са различни измервания.
Генерираните редове, приетите предложения и изпълненията на агента описват дейност. Те могат да помогнат да разберете използването на инструмента. Не доказват, че услугата се е подобрила или че екипът е доставил полезна работа по-рано.
Започнете с един въпрос. Например: „Намалява ли този работен процес общото усилие за завършване на малка задача по поддръжката?“ Определете завършването, преди да събирате резултати. Включете необходимите тестове, преглед и документация.
Отчетете цялата задача
Разгледайте измислена промяна във филтър на отчет. Без AI реализацията отнема 60 минути, а прегледът — 10 минути. С AI реализацията отнема 30 минути, а прегледът — 45 минути.
Реализацията е по-бърза. Измереното усилие за тези фази се увеличава от 70 на 75 минути. Нито един резултат не включва подготовката, по-късните поправки или дефектите след пускането. Пазете тези ограничения видими.
| Фаза | Пример без AI | Пример с AI |
|---|---|---|
| Реализация | 60 минути | 30 минути |
| Преглед | 10 минути | 45 минути |
| Измерено общо | 70 минути | 75 минути |
Тези числа илюстрират изчисление. Не са резултати от изследване или прогноза за Вашия екип. Повече време за преглед може да отразява по-голям diff, непознат код или липсващо изискване. Проучете причината, преди да променяте политиката за инструментите.
Разграничете усилието от изминалото време
Усилието измерва времето, което хората отделят за работа. Изминалото време включва изчакването. Агент може да изпълнява проверки, докато разработчикът работи по друга задача. Не отчитайте едно и също човешко време два пъти. Записвайте и колко дълго промяната чака преглед или среда.
Работен процес може да намали усилието, без да намали времето за доставка. Това може да се случи, когато опашката за одобрение определя датата на завършване. Спестеното усилие все пак може да има стойност, но организацията се нуждае от отделно решение как да го използва.
Попитайте разработчиците дали процесът им помага да разберат системата и да запазят концентрацията си. Третирайте тези отговори като данни за преживяното. Не превръщайте усещането за бързина в доказан процент подобрение.
Четете изследванията в рамките на ограниченията им
METR съобщи за забавяне в конкретно изследване от началото на 2025 г. с опитни разработчици на софтуер с отворен код. Изследването не установи ефект за всички разработчици или задачи. Актуализацията от февруари 2026 г. описва ефекти от подбора и проблеми с измерването в по-късен експеримент.
Полезната поука е за измерването. Версиите на инструментите, подборът на задачите, изискванията за качество и поведението на участниците могат да променят резултата. Не използвайте един исторически процент като постоянно правило за разработката с AI.
Изследването на DORA от 2025 г. също насочва вниманието към организацията около инструментите. Екипът се нуждае от ефективни практики за разработка, за да превърне способностите на инструмента в полезни резултати от доставката.
Направете малко, повторяемо сравнение
Използвайте представителни задачи и еднакви критерии за завършване. Запишете версиите на модела и инструментите. Включете неуспешните опити и усилието за преглед. Сравнете няколко задачи, вместо да подберете най-добрата демонстрация.
Отчетете диапазона и основните ограничения. Ако промяна намалява усилието, но увеличава дефектите, проучете я, преди да разширите използването. Ако резултатът е смесен, ограничете препоръката до типовете задачи с полезни доказателства.
Доброто измерване подкрепя конкретно следващо решение. Не е необходимо да доказва, че AI е универсално добър или лош.
Направете упражнението
Изберете пет сравними завършени задачи. Запишете времето за подготовка, реализация, преглед, поправки и изчакване. Запишете дефектите отделно. Сравнете общото усилие и изминалото време. Отбележете разликите в трудността на задачите, хората и версиите на инструментите, преди да правите извод.
Изтеглете работния лист (Markdown)Премахването на тази отметка изтрива целия напредък, запазен в този браузър.
Напредъкът остава в този браузър. Без акаунт и проследяване.
Източници и допълнително четене
- METR: Early-2025 developer productivity study ↗
- METR: February 2026 study update and measurement limitations ↗
- DORA: 2025 research report ↗