Blog JSystems - uwalniamy wiedzę!

Szukaj

Claude Code

Subagenci zżerają tokeny - jak kontrolować koszt

W skrócie

  • Po wprowadzeniu subagentów zużycie tokenów w Claude Code gwałtownie rośnie i nie wiesz, jak to okiełznać.
  • Każdy subagent to osobny kontekst i osobne wywołania modelu, a ich wyniki wracają do głównej rozmowy - im więcej agentów i im obszerniejsze raporty, tym większy rachunek.
  • Rozwiązanie: zawężaj zakres i narzędzia agentów, proś o krótkie podsumowania zamiast surowych zrzutów, dobieraj tańszy model do prostych ról i pilnuj kontekstu komendą /context.

Subagenci potrafią świetnie porządkować pracę w Claude Code, oficjalnym narzędziu CLI od Anthropic, ale mają swoją cenę - dosłownie. Każdy uruchomiony agent zużywa tokeny na własny kontekst i własne kroki, a gdy jest ich wielu i zwracają obszerne wyniki, koszt sesji szybko rośnie. Dobra wiadomość: da się to kontrolować bez rezygnacji z zespołu agentów. Pokazujemy jak.

Jak to wygląda w praktyce

Zanim zacząłeś używać subagentów, sesje były przewidywalne kosztowo. Po ich wprowadzeniu zauważasz, że pojedyncze zadanie potrafi zużyć wielokrotnie więcej tokenów, a okno kontekstu głównej rozmowy zapełnia się szybciej. Szczególnie boli to przy równoległym uruchamianiu kilku agentów naraz - każdy dokłada swoją część, a ich raporty lądują z powrotem w głównym wątku. Efekt: wyższy rachunek i częstsze ostrzeżenia o zapełnianiu kontekstu.

Dlaczego Claude Code tak działa

Subagent działa we własnym, odseparowanym kontekście i wykonuje własne kroki - to znaczy, że każdy z nich generuje osobne wywołania modelu i zużywa tokeny niezależnie od głównej rozmowy. Gdy subagent kończy pracę, jego wynik wraca do głównej sesji. Jeśli ten wynik jest obszerny (na przykład pełny zrzut przeszukanych plików), zajmuje miejsce w kontekście i podnosi koszt dalszych kroków. Uruchomienie wielu subagentów, które każdy zwracają szczegółowe raporty, mnoży ten efekt.

Dlatego dokumentacja Claude Code wprost ostrzega, że uruchamianie wielu subagentów zwracających szczegółowe wyniki potrafi zużyć znaczną część kontekstu. To nie jest usterka - to naturalna konsekwencja tego, że każdy agent to osobny, pełnoprawny wykonawca. Kluczem jest projektowanie zadań tak, aby agenci robili dokładnie tyle, ile trzeba, i oddawali zwięzły efekt.

Jak to rozwiązać krok po kroku

  1. Ogranicz liczbę subagentów do faktycznie niezależnych zadań. Nie odpalaj osobnego agenta do czynności, którą główna sesja zrobi jednym krokiem.
  2. Zawężaj zakres każdego zadania. Zamiast przeanalizuj cały projekt poproś o konkretny moduł albo konkretne pytanie - mniejszy zakres to mniej tokenów.
  3. Proś o zwięzłe podsumowania. W instrukcji subagenta napisz wprost, że ma zwrócić krótkie wnioski i tylko istotne fragmenty, a nie surowy zrzut wszystkich przeczytanych plików.
  4. Ogranicz narzędzia w nagłówku agenta (pole tools). Agent z prawem tylko do odczytu i wyszukiwania wykona mniej kosztownych kroków niż agent z pełnym zestawem.
  5. Dobierz model do roli. Do prostych, mechanicznych zadań ustaw w nagłówku tańszy model (na przykład sonnet albo haiku), a mocniejszy zostaw do zadań naprawdę wymagających.
  6. Kontroluj kontekst na bieżąco komendą /context, a gdy główna rozmowa się zapełnia, użyj /compact do jej streszczenia albo /clear między niezwiązanymi zadaniami.
  7. Do bardzo dużej pracy użyj osobnych sesji zamiast wielu subagentów w jednej - osobne sesje mają własne okna kontekstu i nie dokładają swoich raportów do jednego, wspólnego wątku.

Jak sprawdzić, że zadziałało

Uruchom to samo zadanie po zmianach i porównaj zużycie kontekstu komendą /context - powinno rosnąć wolniej niż wcześniej. Sprawdź też, że subagenci zwracają krótkie wnioski, a nie wielostronicowe zrzuty. Jeśli korzystasz z planu rozliczanego tokenami, obserwuj licznik zużycia w kolejnych sesjach: przy zawężonych zadaniach, ograniczonych narzędziach i tańszym modelu dla prostych ról rachunek za porównywalną pracę powinien być zauważalnie niższy.

Wróć do listy: 100 najczęstszych problemów z Claude Code

Szkolenie Claude Code - od zera do zespołu agentów AI, prowadzi Łukasz Matuszewski (JSystems)

Szkolenie Claude Code - od zera do zespołu agentów AI -->

Szkolenie Claude Code - od zera do zespołu agentów AI

Tryb planowania, tryby uprawnień, komendy, MCP, hooki i systemy multi-agent - wszystko na żywym kodzie podczas trzydniowego szkolenia. Prowadzi Łukasz Matuszewski. Szkolenie ma terminy gwarantowane - odbędzie się niezależnie od liczby zgłoszeń.

Sprawdź szkolenie Claude Code

To szkolenie może być dofinansowane dla Ciebie z KFS lub BUR.

★★★★★Średnia ocena naszych szkoleń w Google: 5/5

Najczęściej zadawane pytania

Dlaczego subagenci w Claude Code zużywają tyle tokenów?
Każdy subagent działa we własnym, osobnym kontekście i wykonuje własne kroki, więc generuje niezależne wywołania modelu. Dodatkowo jego wynik wraca do głównej rozmowy i zajmuje miejsce w kontekście. Gdy uruchomisz wielu agentów zwracających obszerne raporty, te efekty się sumują i koszt sesji wyraźnie rośnie.
Jak zmniejszyć koszt subagentów bez rezygnacji z nich?
Zawęź zakres każdego zadania i liczbę agentów, poproś ich o zwięzłe podsumowania zamiast surowych zrzutów oraz ogranicz im narzędzia w polu tools. Do prostych ról ustaw tańszy model w nagłówku definicji. Dzięki temu agenci wykonują mniej kroków i oddają krótszy wynik, co bezpośrednio obniża zużycie tokenów.
Czy dobór modelu subagenta wpływa na koszt?
Tak, w nagłówku definicji subagenta możesz ustawić model, na którym ma działać. Do prostych, mechanicznych zadań opłaca się wybrać tańszy i szybszy model, a mocniejszy zostawić do zadań naprawdę wymagających. Taki dobór modelu do roli potrafi znacząco obniżyć rachunek przy zachowaniu jakości tam, gdzie jest ona potrzebna.
Jak monitorować zużycie kontekstu w trakcie pracy?
Użyj komendy /context, która pokazuje, ile okna kontekstu jest zajęte w bieżącej sesji. Gdy rozmowa się zapełnia, możesz ją streścić komendą /compact albo wyczyścić komendą /clear między niepowiązanymi zadaniami. Regularne sprawdzanie kontekstu pomaga w porę wychwycić, że subagenci zwracają zbyt obszerne wyniki.

Komentarze (0)

Musisz być zalogowany by móc dodać komentarz. Zaloguj się przez Google

Brak komentarzy...