Context engineering dla agentów AI: dlaczego więcej kontekstu nie znaczy lepiej
Context engineering to projektowanie informacji dostępnej agentowi. Zobacz, jak ograniczać szum, context rot i koszt bez utraty jakości.

Context engineering to projektowanie informacji, które agent AI widzi przed podjęciem decyzji. Nie chodzi o napisanie jednego idealnego promptu. Chodzi o cały przepływ: instrukcje, wybrane pliki, historię, wyniki narzędzi, pamięć i sposób kompresowania wcześniejszej pracy. Dobry kontekst pomaga modelowi działać precyzyjnie. Zły może pogorszyć wynik nawet wtedy, gdy zawiera wszystkie potrzebne fakty.
Więcej kontekstu nie znaczy lepiej
Najprostsza strategia brzmi: dajmy agentowi wszystko. Całe repozytorium, całą rozmowę i komplet dokumentacji. Problem w tym, że kontekst jest zasobem ograniczonym nie tylko liczbą tokenów. Ograniczona jest też uwaga modelu.
Gdy ważna zasada znajduje się między tysiącem linii logów a trzema starymi wersjami specyfikacji, agent może jej nie użyć. Anthropic opisuje ten problem jako context rot: wraz ze wzrostem kontekstu zdolność do trafnego wykorzystania informacji może spadać. Dlatego selekcja jest ważniejsza niż samo zwiększanie limitu.
Z czego składa się kontekst agenta
W praktycznym systemie znajdziemy kilka warstw:
- instrukcje nadrzędne i granice uprawnień,
- opis aktualnego celu oraz kryterium ukończenia,
- minimalny fragment kodu lub dokumentów potrzebny do zadania,
- wyniki ostatnich narzędzi,
- trwałe decyzje pobrane z pamięci agenta,
- krótkie podsumowanie wcześniejszych kroków.
Każda warstwa ma inny czas życia. Zasady bezpieczeństwa są stabilne. Wynik zapytania do API może być prawdziwy tylko przez kilka minut. System powinien traktować je inaczej.
Najpierw cel, potem materiały
Dobry kontekst zaczyna się od odpowiedzi na pytanie: jaką decyzję agent ma teraz podjąć? Inny zestaw informacji jest potrzebny do napisania funkcji, inny do przeglądu bezpieczeństwa, a jeszcze inny do opublikowania artykułu.
Zamiast przesyłać cały projekt, można zbudować prosty proces:
- nazwij cel i wynik końcowy,
- wskaż ograniczenia, których agent nie może naruszyć,
- wyszukaj kilka najbardziej trafnych plików lub notatek,
- po wykonaniu narzędzia dołącz tylko wynik potrzebny do następnego kroku,
- kompresuj zakończone etapy do decyzji i dowodów.
To nie tylko obniża koszt. Ułatwia też audyt, bo wiadomo, na jakiej podstawie agent działał.
Kompresja bez utraty sensu
Przy dłuższej pracy nie da się zachować każdej wiadomości. Trzeba podsumowywać. Złe podsumowanie streszcza rozmowę. Dobre przechowuje stan zadania:
- co zostało zrobione,
- co zostało sprawdzone,
- jakie decyzje podjęto,
- czego nie wolno zmienić,
- jaki jest następny krok,
- jakie pytania pozostają otwarte.
Warto oddzielić fakty od wniosków. „Test przeszedł na commit SHA…” jest faktem. „Zmiana jest bezpieczna” jest oceną, która może wymagać dodatkowego dowodu.
Narzędzia też produkują kontekst
Agent często tonie nie w dokumentacji, tylko w wynikach komend. Pełny log buildu albo odpowiedź API z setkami pól może zająć większość dostępnej uwagi. Narzędzie powinno zwracać wynik w formie użytecznej dla następnej decyzji: istotny błąd, identyfikator zasobu, status i link do pełnego logu.
To łączy context engineering z projektowaniem narzędzi i API dla agentów. Dobrze opisane wejście nie wystarczy, jeśli wyjście jest wielkim, nieustrukturyzowanym tekstem.
Jak mierzyć jakość kontekstu
Nie wystarczy ocenić, czy odpowiedź „brzmi dobrze”. W testach warto zmieniać skład kontekstu i obserwować wynik:
- usuń jedną kluczową instrukcję i sprawdź, czy test wykryje błąd,
- dodaj podobny, ale nieaktualny dokument,
- zwiększ liczbę nieistotnych wyników narzędzi,
- sprawdź, czy agent potrafi poprosić o brakujący fakt zamiast go wymyślić,
- zmierz koszt i czas dla tej samej jakości wyniku.
Jeśli system działa tylko przy idealnie ułożonym promptcie, nie jest odporny. Context engineering powinno prowadzić do powtarzalnego procesu, nie jednorazowej sztuczki.
Praktyczna zasada
Każdy element kontekstu powinien odpowiadać na jedno z trzech pytań: co agent ma osiągnąć, czego nie może naruszyć albo jaki dowód jest potrzebny do następnej decyzji. Jeśli nie odpowiada na żadne, prawdopodobnie nie powinien być aktywny w tej chwili.
Najlepszy kontekst nie jest największy. Jest aktualny, uporządkowany i wystarczający.
Źródła: