Мерете корисен напредок
ЗавршеноМерете завршена работа, труд за преглед и повторна работа. Не користете го обемот на генериран код како мерка за вредност.
Објавува TaigaКако пишуваме
Проверете го разбирањетоAI го намалува времето за имплементација од 60 на 30 минути. Прегледот се зголемува од 10 на 45 минути. Што може да заклучите?Направете ја вежбата
Што ќе научите
- Разликувајте активност од корисен исход.
- Вклучете подготовка, преглед и поправка во споредбата на времето.
- Препознајте ги ограничувањата на тврдење за продуктивност.
Одредете го исходот пред мерката
AI-алатка може брзо да создава код. Корисниот исход е промена што задоволува корисничка потреба на потребното ниво на квалитет. Ова се различни мерења.
Генерираните редови, прифатените предлози и извршувањата на агентот опишуваат активност. Може да помогнат да ја разберете употребата на алатката. Не потврдуваат дека услуга се подобрила или дека тимот порано испорачал корисна работа.
Почнете со едно прашање. На пример: „Дали овој работен тек го намалува вкупниот труд за завршување мала задача за одржување?“ Одредете ги критериумите за завршување пред да собирате резултати. Вклучете ги потребните тестови, прегледот и документацијата.
Пресметајте ја целата задача
Разгледајте измислена промена на филтер за извештај. Без AI, имплементацијата трае 60 минути, а прегледот 10 минути. Со AI, имплементацијата трае 30 минути, а прегледот 45 минути.
Имплементацијата е побрза. Измерениот труд за овие фази расте од 70 на 75 минути. Ниту еден резултат не ги вклучува подготовката, подоцнежните поправки или дефектите по издавањето. Јасно наведете ги тие ограничувања.
| Фаза | Пример без AI | Пример со AI |
|---|---|---|
| Имплементација | 60 минути | 30 минути |
| Преглед | 10 минути | 45 минути |
| Измерен вкупен труд | 70 минути | 75 минути |
Овие бројки илустрираат пресметка. Не се резултати од истражување или прогноза за вашиот тим. Зголемениот преглед може да одразува поголем обем на промени, непознат код или барање што недостига. Истражете ја причината пред да ја промените политиката за алатките.
Одделете го трудот од изминатото време
Трудот го мери времето што луѓето го трошат на работа. Изминатото време го вклучува чекањето. Агент може да извршува проверки додека програмер работи на друга задача. Не сметајте го истото човечко време двапати. Запишете и колку долго промената чека преглед или околина.
Работен тек може да го намали трудот без да го намали времето до испорака. Ова може да се случи кога редицата за одобрување го одредува датумот на завршување. Заштедениот труд сепак може да има вредност, но организацијата треба одделно да одлучи како да го искористи.
Прашајте ги програмерите дали работниот тек им помага да го разберат системот и да останат фокусирани. Третирајте ги одговорите како податоци за искуството. Не претворајте чувство на брзина во потврден процент на подобрување.
Читајте ги истражувањата во рамките на нивните ограничувања
METR објави забавување во конкретно истражување од почетокот на 2025 година со искусни програмери на софтвер со отворен код. Истражувањето не утврди ефект за сите програмери или задачи. Ажурирањето од февруари 2026 година ги опиша ефектите од изборот на учесници и проблемите со мерењето во подоцнежен експеримент.
Корисната поука се однесува на мерењето. Верзиите на алатките, изборот на задачи, барањата за квалитет и однесувањето на учесниците може да го сменат резултатот. Не користете еден историски процент како трајно правило за развој со AI.
Истражувањето на DORA од 2025 година го насочува вниманието и кон организациската средина во која се користат алатките. На тимот му требаат ефикасни развојни практики за да ја претвори способноста на алатките во корисни резултати од испораката.
Направете мала споредба што може да се повтори
Користете репрезентативни задачи и исти критериуми за завршување. Запишете ги верзиите на моделот и алатката. Вклучете ги неуспешните обиди и трудот за преглед. Споредете повеќе задачи наместо да ја изберете најдобрата демонстрација.
Пријавете ги опсегот на резултатите и главните ограничувања. Ако промена го намалува трудот, но ги зголемува дефектите, истражете пред да ја проширите. Ако резултатот е мешан, ограничете ја препораката на видовите задачи за кои има корисни докази.
Добро мерење поддржува конкретна следна одлука. Не мора да докаже дека AI е добра или лоша за сè.
Направете ја вежбата
Изберете пет споредливи завршени задачи. Запишете го времето за подготовка, имплементација, преглед, поправка и чекање. Запишете ги дефектите одделно. Споредете ги вкупниот труд и изминатото време. Пред заклучокот, забележете ги разликите во тежината на задачите, луѓето и верзиите на алатките.
Преземи работен лист (Markdown)Поништување на овој избор го брише целиот напредок зачуван во овој прелистувач.
Напредокот останува во овој прелистувач. Без сметка и следење.
Извори и дополнително читање
- METR: Early-2025 developer productivity study ↗
- METR: February 2026 study update and measurement limitations ↗
- DORA: 2025 research report ↗