Zadanie
Zespół OpenVINO w Intelu (przez Alten Poland) uzbierał ponad 20 różnorodnych stron raportów ewaluacji LLM — każda budowana ręcznie, bez wspólnego szablonu. Zadanie: zwinąć ten rozrzut w kilka szablonów wielokrotnego użytku, a potem zbudować dashboardy, których inżynierowie naprawdę potrzebowali — szybki sposób, by zobaczyć, jak wydajność inferencji przesunęła się między wydaniami.
Krótki, świadomie spec-driven kontrakt — ścisłe specyfikacje komponentów i serwisów Angulara napisane z góry, potem implementacja krok po kroku z GitHub Copilot i Claude Opus.
Co powstało
Ponad 20 różnorodnych stron raportów ewaluacji LLM przebudowanych w 2 szablony stron Angulara wielokrotnego użytku z konfigurowalnymi potokami danych RxJS.
Ok. 10 nowych, składanych raportów na bazie tych szablonów — bez prac frontendowych pod każdy z osobna.
Dashboardy dziennych porównań metryk inferencji LLM — opóźnienie, przepustowość, parametry runtime — między wydaniami: regresje widoczne natychmiast względem poprzedniego dnia i poprzedniego builda.
Spec-driven proces z agentami: najpierw pisemne specyfikacje, potem iteracyjna implementacja z GitHub Copilot i Claude Opus.