← DevEval Complexity Units

Jednostka, którą Story Pointy zawsze udawały, że są.

CU mierzy wkład pull requesta w sposób porównywalny między ludźmi, zespołami, dostawcami i narzędziami. Story Pointy są negocjowane osobno w każdym zespole i tracą porównywalność, gdy narzędzia się poprawiają. CU opiera się na samej pracy: to samo zadanie jest warte tyle samo CU w 2023 i w 2026.

Definicja

Zakres pracy oraz wkład wymagający doświadczenia powyżej poziomu mid.

CU to nie karta do planning pokera. To miara dostarczonego wkładu, zbudowana z dwóch części: ilości wykonanej pracy oraz tego, jaka jej część wymagała doświadczenia powyżej poziomu mid bez wsparcia AI.

01 · Baza wolumenu — Scope

Wszystkie logiczne zagadnienia: funkcje, endpointy, ekrany, workflow, migracje. Powtarzalność jest dyskontowana subliniowo — 10 podobnych ekranów jest wartych mniej niż 10× jeden ekran, ale nigdy nie jest zaokrąglane do jednego. Czysta mechanika (masowe rename'y, codegen) punktuje blisko zera niezależnie od liczby plików.

02 · Bonus ekspercki — 5 osi

Technical, Domain, Integration, Investigation i Safeguarding. Każda z tych osi uwzględnia wartość, którą deweloper na poziomie mid dostarczyłby gorzej, wolniej lub wcale: nową architekturę, złożone reguły biznesowe, trudne integracje z systemami zewnętrznymi, wielodniowe dochodzenie do źródła problemu oraz świadome projektowanie zabezpieczeń.

6 osi

Każdy PR oceniany 0–10 na sześciu osiach.

Jedna oś zakresu pracy plus pięć bonusów eksperckich. Wysoki wynik na jednej lub dwóch osiach nie jest obniżany przez zera na pozostałych. Nawet poprawka obejmująca trzy linie może otrzymać wysokie CU, jeśli wymagała tygodnia debugowania.

VOLUME 20%

Scope

Ilość dostarczonej pracy, z dyskontem za powtarzalność. Liczą się decyzje, nie mechanika.

BONUS 20%

Technical

Nowe wzorce, standardy, architektura; trudność algorytmiczna. Pierwsze użycie w bazie kodu też się liczy.

BONUS 15%

Domain

Reguły biznesowe i regulacyjne, które deweloper musiał zrozumieć i poprawnie zakodować.

BONUS 15%

Integration

Systemy spoza Twojej bazy kodu — zewnętrzne API, SDK, cloud, legacy. Zaczyna się na granicy sieci.

BONUS 15%

Investigation

Praca niewidoczna w diffie — debugowanie, tropienie, analiza przyczyn. Trudność problemu, nie zegar autora.

BONUS 15%

Safeguarding

Świadoma inżynieria bezpieczeństwa, ważona wyżej w systemach 24/7, finansowych i regulowanych.

Wagi są domyślne i konfigurowalne per projekt — bank może podnieść Safeguarding, a obniżyć Scope. Osie scalają się w finalne CU na skali 0–30.

Kalibracja

Zakotwiczona w realnej pracy, nie w odczuciach.

Skala jest przypięta do konkretnych kotwic kalibracyjnych, więc CU znaczy to samo w każdym zespole, w każdym repo, zawsze.

CU Kotwica Jak to wygląda
2 1 endpoint CRUD Standardowe wzorce, bez niespodzianek
4 5 ekranów (pattern) Powtarzalność zdyskontowana, decyzje wciąż się liczą
7.5 Wielowarstwowa funkcja API + logika + UI, umiarkowana nowość
11.5 Vertical slice End-to-end przez wszystkie warstwy
14 Senior foundations Nowe standardy, na których buduje zespół
17.5 Greenfield infra Nowa infrastruktura od zera
20 Sprint mid-dev · 10 MD Główna kotwica: solidny sprint, bez AI
24.5 Epic na wiele sprintów Powinien być pocięty — ale się zdarza
30 Outlier (rzadko) Szczyt skali, z założenia rzadki
GŁÓWNA KOTWICA
20 CU ≈ 10 MD
solidny sprint mid-deva bez AI
POWTARZALNE
~1,5 CU / MD
subliniowy dyskont za powtarzalność
EKSPERCKIE
3–4 CU / MD
mały diff, duże osie bonusowe
SKALA
0 → 30
co 0,5 · 21 ≈ typowy epic
Dlaczego nie Story Pointy

CU pozostaje stałe, nawet gdy zmieniają się narzędzia.

Story Pointy mierzą wysiłek względem zespołu. Gdy AI przyspiesza wszystkich, liczba punktów stopniowo maleje, a wykres velocity może tworzyć mylący obraz wzrostu. CU opiera się na wykonanej pracy.

Właściwość Story Pointy Complexity Units
Kalibrowane względem Historii i nawyków każdego zespołu z osobna Stałych kotwic — tych samych dla każdego zespołu i dostawcy
Porównywalność między zespołami Brak — 5 SP tutaj ≠ 5 SP tam Tak — zaprojektowane do porównań między zespołami
Gdy AI przyspiesza wszystkich To samo zadanie dostaje mniej punktów; zysk znika z wykresu To samo zadanie trzyma swoje CU; zysk widać we wzroście PI
Ustalane przez Negocjację na planningu Ocenę AI dostarczonego PR-a, per oś, audytowalną

Zadanie, które w 2023 było warte CU 8, w 2026 nadal jest warte CU 8. Dzięki temu produktywność pozostaje mierzalna przez cały okres transformacji związanej z AI.

Rygor

Zbudowane tak, żeby nie dało się grać pod metrykę.

Rubryka oceny koduje jawne antywzorce — sztuczki, które pompują każdą inną metrykę, tutaj są warte zero.

Sztuczka
Przeszyj 30 plików jednym booleanem
Co mówi rubryka
Liczba plików ≠ liczba zagadnień. Jedna decyzja w 30 plikach to Scope 1–2, nie 8.
Sztuczka
Masowy rename / odpal generator kodu
Co mówi rubryka
Czysta mechanika punktuje blisko zera na Scope niezależnie od rozmiaru diffa.
Sztuczka
Dodaj domenowe słownictwo do nazw
Co mówi rubryka
invoice/policy/claim to nazewnictwo, nie reguły. Domain punktuje złożoność reguł, które trzeba było zrozumieć.
Sztuczka
Napompuj diff, żeby wyglądał na wielkie śledztwo
Co mówi rubryka
Same commity nie dowodzą przeprowadzonej analizy. Świadczą o niej wycofane podejścia, zmiany kierunku rozwiązania i odwołania do wewnętrznych mechanizmów frameworka.
Sztuczka
Nazwij każdy null check „inżynierią bezpieczeństwa”
Co mówi rubryka
Rutynowe kodowanie defensywne to nie Safeguarding — chyba że działa mnożnik kontekstu: 24/7, pieniądze, regulacje, twarde SLA.

Zobacz swój backlog w CU.

Podłącz repozytorium i patrz, jak realne pull requesty lądują na skali — z rozbiciem na osie przy każdej ocenie.

Wypróbuj bezpłatnie
30 dni · bez karty · anuluj kiedy chcesz
Zamknięta beta · wczesny dostęp

Self-service ruszy niebawem

Priorytetem są teraz wdrożenia enterprise. Zostaw e-mail, a powiadomimy Cię, kiedy self-service ruszy.

Użyjemy tego tylko po to, żeby skontaktować się w sprawie DevEval. Bez newslettera, bez udostępniania osobom trzecim.