Przewodnik tematyczny

AI SDLC

Jak wytwarzać i zmieniać system AI bez utraty kontroli nad jakością?

AI SDLC to cykl pracy nad rozwiązaniem: od wymagania, przez projekt, testy i wdrożenie, po obserwację oraz wycofanie zmiany. Trzeba rozdzielić dwa nurty: budowanie produktu, który korzysta z AI, oraz używanie AI do pisania oprogramowania. W pierwszym zmienia się zachowanie systemu wobec użytkownika; w drugim narzędzie pomaga zespołowi, ale nie przejmuje odpowiedzialności za kod.

Jak podejść do tematu

  1. Krok 1

    Zapisz wymagania i granice

    Określ użytkownika, cel, dozwolone źródła i działania, przykłady poprawnych wyników oraz sytuacje, gdy system ma odmówić albo oddać sprawę człowiekowi. Ustal właściciela decyzji o publikacji.

  2. Krok 2

    Zbuduj zestaw ewaluacyjny

    Zbierz reprezentatywne przypadki, wyjątki i błędy wysokiego ryzyka. Oceniaj wynik, odwołania do źródeł, koszt oraz przebieg działania narzędzi; porównuj nowe wersje z poprzednią, nie tylko z idealnym przykładem.

  3. Krok 3

    Wdrażaj z możliwością wycofania

    Wersjonuj kod, instrukcje, konfigurację modelu, źródła danych i zestaw testów. Ustal progi bramki wdrożenia, zakres pilota, monitoring oraz sposób powrotu do poprzedniego procesu.

Nurt pierwszy: produkt z AI

Specyfikacja powinna opisywać nie tylko funkcję, lecz także zachowanie przy niepewności: brak źródła, sprzeczne dokumenty, prośbę o działanie poza uprawnieniami i dane wrażliwe. Projekt obejmuje interfejs, źródła, model, narzędzia oraz właścicieli reguł. Architektura tych elementów należy do filaru A02; AI SDLC opisuje, jak sprawdzić ich współdziałanie i kontrolować zmianę wersji.

Przykładowa bramka odbioru może wymagać, by odpowiedź wskazywała źródło, działanie zapisywało ślad audytowy, a sprawa bez danych trafiała do człowieka. Nie jest to uniwersalny próg liczbowy: poziom błędów możliwy do przyjęcia zależy od procesu, skutków pomyłki i sposobu nadzoru. Kryteria trzeba ustalić przed pilotem, aby nie wybierać ich po obejrzeniu wygodnych wyników.

Nurt drugi: AI jako narzędzie programisty

Kod wygenerowany przez narzędzie wymaga tych samych kontroli co kod napisany ręcznie: zrozumienia, przeglądu, testów, sprawdzenia zależności i uprawnień. Krótki, działający przykład nie dowodzi bezpieczeństwa w repozytorium, gdzie istnieją inne ścieżki wykonania. Zespół powinien też wiedzieć, jakie dane wolno wysyłać do używanego narzędzia.

Przy zadaniach z agentem programistycznym określ zakres plików, oczekiwane zachowanie, testy i zakazy dotyczące sekretów. Odbiór polega na sprawdzeniu zmian oraz ich skutków, nie na samym zatwierdzeniu odpowiedzi czatu. Odpowiedzialność za wdrożenie pozostaje przy osobach i procesie organizacji.

Zmiana modelu lub danych też jest wydaniem produktu

Nowa wersja modelu, poprawka promptu lub świeży zestaw dokumentów mogą zmienić odpowiedzi bez zmiany kodu aplikacji. Dlatego zapisuj konfigurację, datę źródeł i wyniki zestawu ewaluacyjnego przy każdym wydaniu. Po wdrożeniu obserwuj przypadki odmowy, błędne działania, koszty oraz zgłoszenia użytkowników, a nie tylko dostępność endpointu.

Plan wycofania powinien wskazać, co można przywrócić natychmiast, które działania trzeba zatrzymać i jak poinformować właściciela procesu. Jeżeli stary zestaw danych nie może być odtworzony, rollback kodu może nie przywrócić poprzedniego zachowania. Tę zależność warto sprawdzić w pilocie, zanim system zacznie podejmować skuteczne działania w firmie.

  • Wymaganie: cel, odbiorca, zakazane działania i osoba odpowiedzialna.
  • Ewaluacja: zestaw zwykłych i trudnych przypadków z uzgodnioną oceną.
  • Wydanie: wersje kodu, modelu, instrukcji, danych i progów akceptacji.
  • Eksploatacja: monitoring, zgłoszenia błędów, zatrzymanie i przywrócenie.

Jak podjąć decyzję

Wybierz sygnał, który najlepiej opisuje obecny problem, i sprawdź właściwy następny krok.

SygnałCo oznaczaNastępny krok
Budujesz aplikację, która odpowiada lub działa za użytkownikaTestuj zachowanie całego systemu na reprezentatywnych sprawach.Ustal kryteria odmowy, źródła, uprawnienia i bramkę wydania.
Programiści używają AI do tworzenia koduNarzędzie zmienia sposób pracy, ale nie standard odbioru kodu.Włącz przegląd, testy, skanowanie zależności i zasady danych do zwykłego procesu PR.
Zmienia się model, prompt lub zbiór wiedzyMoże zmienić się wynik produktu bez commitu w logice aplikacji.Uruchom ewaluacje porównawcze i przygotuj drogę wycofania konfiguracji.

Wybierz zagadnienie

Każda grupa odpowiada na węższe pytanie. Zacznij od obszaru, który jest najbliższy Twojej decyzji.

Budowa aplikacji AI

Pokaż pozostałe materiały (8)

Interfejsy i design systems aplikacji AI

Testy i ewaluacje aplikacji AI

Agenci programistyczni i środowiska pracy

Pokaż pozostałe materiały (14)

Specyfikacje i instrukcje dla agentów

Pokaż pozostałe materiały (1)

Następny krok

Zanim zaczniesz pilot, przygotuj jedną stronę wymagań, zestaw testowych spraw i decyzję, kto zatrzyma wdrożenie po nieudanym teście. Jeśli potrzebujesz pomocy w określeniu architektury, pilota lub późniejszego utrzymania, zakres współpracy opisuje aktualna oferta.

Sprawdź zakres współpracy