Wydanie zatrzymane, zanim brakujący krok trafi na produkcję
Sprawdza testy, migracje, przełączniki funkcji, akceptacje, plan wycofania i monitoring względem planu wydania.
Na czym polega ten pomysł
Sprawdza testy, migracje, przełączniki funkcji, akceptacje, plan wycofania i monitoring względem planu wydania. Oddziela obserwowane fakty od wniosków, pokazuje sprzeczne dowody i dostarcza zestaw ustaleń gotowy do przeglądu zamiast nieprzejrzystej odpowiedzi.
Co zyskujesz
Znane braki wydania wychodzą na jaw przed wdrożeniem.
Co zmienia agent AI
Jak wyglądało to wcześniej
Tradycyjna automatyzacja potrafiła zebrać rekordy, ale człowiek nadal musiał porównać źródła, rozstrzygnąć sprzeczności i opisać wnioski.
Co zmienia agent AI
Agent planuje research, sprawdza wiele źródeł, oddziela fakty od wniosków i zwraca raport z odnośnikami.
Kiedy agent zaczyna działać
Kandydat do wydania zostaje oznaczony jako gotowy do przeglądu produkcyjnego.
Dane wejściowe
- Kontekst procesu: plan wydania, pull requesty, testy, migracje, flagi, runbook i monitoring
- Zatwierdzone zasady, odpowiedzialność i reguły wyjątków
Jak agent działa krok po kroku
- 1
Zbiera materiały z zatwierdzonych systemów i zapisuje czas ich pozyskania.
- 2
Porównuje sprzeczne sygnały i oddziela fakty od wniosków.
- 3
Przygotowuje decyzję wdrażaj, popraw lub zaakceptuj ryzyko wraz z dowodami z cytowaniami, niewiadomymi i poziomem pewności.
- 4
Dostarcza zatwierdzony raport i zachowuje jego zestaw dowodów.
Decyzje człowieka
Po kroku 3
Osoba odpowiedzialna za proces zatwierdza decyzję wdrażaj, popraw lub zaakceptuj ryzyko wraz z dowodami.
Rezultat
- Decyzja o wydaniu zatwierdzona przez tech leada
- Dowody, wyjątki i ślad audytowy
Zasady bezpieczeństwa
- Oznaczaj wnioski oddzielnie od obserwowanych faktów.
- Nie zamykaj dochodzenia, gdy wymagane źródła są niedostępne.
Ryzyka i zabezpieczenia
Brakujące lub nieaktualne dowody mogą dać pewne, ale niepełne ustalenie.
Pokazuj wykorzystane źródła, sprzeczności, daty danych i pytania bez odpowiedzi.
Na czym opieramy ten pomysł
Źródła pokazują, że taki scenariusz jest wykonalny. Podany zakres poprawy to punkt odniesienia, a nie obietnica wyniku.
OpenAI
New tools for building agents
OpenAI opisuje agentów łączących research w sieci, pliki, sterowanie przeglądarką, narzędzia, handoffy, guardraile i śledzone wykonanie wielu kroków.
Langfuse
Evaluating AI agent skills
Langfuse pokazuje agentów zamieniających trace produkcyjne i feedback ludzi w datasety, eksperymenty i mierzalne testy regresji.