Blog JSystems - uwalniamy wiedzę!

Szukaj

Claude Code

Claude Code zżera za dużo tokenów - jak obniżyć koszty

W skrócie

  • Claude Code zużywa limit szybciej, niż się spodziewasz - długie sesje, wielki kontekst i praca na najmocniejszym modelu potrafią zjeść budżet w kilka godzin.
  • Każda tura rozmowy wysyła cały narastający kontekst, więc im dłuższa i bardziej zapchana sesja, tym drożej kosztuje każde kolejne polecenie.
  • Rozwiązanie to higiena kontekstu (/clear, /compact), dobór modelu do zadania i pilnowanie, co ląduje w rozmowie - plus śledzenie zużycia komendą /cost.

Claude Code potrafi zużyć limit zaskakująco szybko. Odpalasz go rano, pracujesz nad kilkoma zadaniami, a po południu dostajesz komunikat, że zbliżasz się do granicy planu - choć wydawało się, że robiłeś rzeczy raczej drobne. To nie awaria. Koszt w narzędziu tego typu bierze się głównie z tego, ile tekstu przepływa przez model, a na to masz realny wpływ. Kilka nawyków potrafi wydłużyć czas pracy na tym samym limicie o rząd wielkości.

Jak to wygląda w praktyce

Typowo wygląda to tak: prowadzisz jedną długą sesję przez pół dnia, dokładając zadanie za zadaniem, i z każdą godziną odpowiedzi przychodzą wolniej, a zużycie rośnie coraz szybciej. Albo pracujesz na najmocniejszym modelu przy zadaniach, które spokojnie udźwignąłby słabszy, i palisz limit na trywialnych poprawkach. Częsty scenariusz to też wciąganie do kontekstu ogromnych plików - Claude czyta cały wygenerowany artefakt, log albo plik z danymi, a to wszystko zostaje w rozmowie i jest wysyłane ponownie przy każdej kolejnej turze. Efekt jest wspólny: pojedyncze polecenie na końcu długiej, zapchanej sesji kosztuje wielokrotnie więcej niż to samo polecenie w świeżej rozmowie.

Dlaczego Claude Code tak działa

Model językowy jest bezstanowy - żeby kontynuować rozmowę, przy każdej turze trzeba wysłać mu cały dotychczasowy kontekst: instrukcje, pliki, które przeczytał, i całą historię wymiany. Dlatego koszt nie jest stały. Im dłuższa sesja i im więcej w niej materiału, tym większy kontekst leci przy każdym poleceniu, a rachunek rośnie nieliniowo wraz z długością rozmowy. Do tego dochodzi wybór modelu: mocniejsze modele liczą się drożej za tę samą ilość tekstu, więc trzymanie najsilniejszego na wszystko podnosi koszt każdej tury. Dobra wiadomość jest taka, że część tego kosztu ogranicza się sama - Anthropic stosuje cache'owanie promptu, dzięki któremu powtarzalny początek kontekstu (np. Twój CLAUDE.md) jest tańszy przy kolejnych turach. Ale to nie zwalnia z pilnowania, co w tym kontekście ląduje i jak długo trzymasz jedną rozmowę.

Jak to rozwiązać krok po kroku

  1. Rozdzielaj zadania na osobne sesje. Gdy kończysz jedno zadanie i bierzesz się za niepowiązane, wpisz /clear. Wyczyścisz kontekst i zaczniesz od świeżej, taniej rozmowy zamiast ciągnąć wszystko poprzednie.
  2. Gdy sesja robi się długa, ale chcesz zachować ciągłość, użyj /compact. Claude Code streści dotychczasową rozmowę do zwięzłego podsumowania i będzie kontynuował na jego podstawie, zamiast wozić pełną historię.
  3. Dobierz model do zadania. Trzymaj model zrównoważony (Sonnet) na co dzień, sięgaj po najmocniejszy (Opus) tylko przy naprawdę trudnych rzeczach, a proste, seryjne zadania rób na najszybszym (Haiku). Model przełączysz komendą /model.
  4. Pilnuj, co wciągasz do kontekstu. Nie każ czytać ogromnych plików danych, logów ani wygenerowanych artefaktów w całości, jeśli nie musisz. Wskazuj konkretne fragmenty albo proś o przeszukanie zamiast wczytania wszystkiego.
  5. Zbuduj dobry CLAUDE.md, ale trzymaj go zwięzłym. Dzięki niemu asystent nie musi w kółko przeszukiwać projektu, żeby zrozumieć podstawy - a że jest cache'owany, jego koszt w kolejnych turach jest niższy.
  6. Śledź zużycie na bieżąco komendą /cost. Zobaczysz, ile bieżąca sesja już kosztowała, i szybko zauważysz, że długa, zapchana rozmowa pali limit szybciej niż seria krótkich.

Jak sprawdzić, że zadziałało

Najprościej porównać zużycie przed zmianą nawyków i po niej. Odpal /cost na koniec dnia pracy prowadzonej po staremu, w jednej długiej sesji, a potem powtórz to samo, dzieląc pracę na krótsze rozmowy z /clear i przełączaniem modelu. Różnica bywa wyraźna. W trakcie pracy zwróć uwagę na tempo: świeża sesja odpowiada szybciej niż zapchana, bo model przetwarza mniejszy kontekst - spadek płynności to sygnał, że czas na /compact albo /clear. Jeśli korzystasz z planu subskrypcyjnego z limitem, miarą sukcesu jest po prostu to, że przestajesz dobijać do granicy w środku dnia. A gdy widzisz, że po zejściu na słabszy model przy prostych zadaniach jakość się nie pogorszyła, masz potwierdzenie, że wcześniej przepłacałeś mocą, której nie potrzebowałeś.

Wroc do listy: 100 najczestszych problemow z Claude Code

Szkolenie Claude Code - od zera do zespołu agentów AI, prowadzi Łukasz Matuszewski (JSystems)

Szkolenie Claude Code - od zera do zespołu agentów AI -->

Szkolenie Claude Code - od zera do zespołu agentów AI

Tryb planowania, tryby uprawnień, komendy, MCP, hooki i systemy multi-agent - wszystko na żywym kodzie podczas trzydniowego szkolenia. Prowadzi Łukasz Matuszewski. Szkolenie ma terminy gwarantowane - odbędzie się niezależnie od liczby zgłoszeń.

Sprawdź szkolenie Claude Code

To szkolenie może być dofinansowane dla Ciebie z KFS lub BUR.

★★★★★Średnia ocena naszych szkoleń w Google: 5/5

Najczęściej zadawane pytania

Dlaczego dluga sesja Claude Code kosztuje coraz wiecej?
Model jest bezstanowy, wiec przy kazdej turze trzeba wyslac mu caly narastajacy kontekst: instrukcje, przeczytane pliki i cala historie rozmowy. Im dluzsza i bardziej zapchana sesja, tym wiekszy kontekst leci przy kazdym poleceniu, a koszt rosnie nieliniowo wraz z jej dlugoscia.
Czym rozni sie komenda /clear od /compact?
Komenda /clear czysci kontekst i zaczyna cala rozmowe od nowa - uzywasz jej, gdy przechodzisz do niepowiazanego zadania. Komenda /compact streszcza dotychczasowa rozmowe do zwiezlego podsumowania i kontynuuje na jego podstawie, gdy chcesz zachowac ciaglosc, ale sesja zrobila sie dluga.
Jak sprawdzic, ile kosztuje sesja Claude Code?
Wpisz w sesji komende /cost - pokaze ona, ile biezaca rozmowa juz kosztowala. Sledzenie tego na biezaco pozwala zauwazyc, ze jedna dluga, zapchana sesja pali limit szybciej niz seria krotkich, i w pore siegnac po /clear albo /compact, zanim koszt urosnie.
Czy wybor modelu wplywa na koszt w Claude Code?
Tak - mocniejsze modele licza sie drozej za te sama ilosc tekstu, wiec trzymanie najsilniejszego Opusa na wszystko podnosi koszt kazdej tury. Dobor modelu do zadania, czyli Sonnet na co dzien i Haiku do prostych rzeczy, wyraznie wydluza czas pracy na tym samym limicie.

Komentarze (0)

Musisz być zalogowany by móc dodać komentarz. Zaloguj się przez Google

Brak komentarzy...