Blog JSystems - uwalniamy wiedzę!
Blog JSystems - uwalniamy wiedzę!
Claude Code
Claude Code zżera za dużo tokenów - jak obniżyć koszty
/clear, /compact), dobór modelu do zadania i pilnowanie, co ląduje w rozmowie - plus śledzenie zużycia komendą /cost.Claude Code potrafi zużyć limit zaskakująco szybko. Odpalasz go rano, pracujesz nad kilkoma zadaniami, a po południu dostajesz komunikat, że zbliżasz się do granicy planu - choć wydawało się, że robiłeś rzeczy raczej drobne. To nie awaria. Koszt w narzędziu tego typu bierze się głównie z tego, ile tekstu przepływa przez model, a na to masz realny wpływ. Kilka nawyków potrafi wydłużyć czas pracy na tym samym limicie o rząd wielkości.
Typowo wygląda to tak: prowadzisz jedną długą sesję przez pół dnia, dokładając zadanie za zadaniem, i z każdą godziną odpowiedzi przychodzą wolniej, a zużycie rośnie coraz szybciej. Albo pracujesz na najmocniejszym modelu przy zadaniach, które spokojnie udźwignąłby słabszy, i palisz limit na trywialnych poprawkach. Częsty scenariusz to też wciąganie do kontekstu ogromnych plików - Claude czyta cały wygenerowany artefakt, log albo plik z danymi, a to wszystko zostaje w rozmowie i jest wysyłane ponownie przy każdej kolejnej turze. Efekt jest wspólny: pojedyncze polecenie na końcu długiej, zapchanej sesji kosztuje wielokrotnie więcej niż to samo polecenie w świeżej rozmowie.
Model językowy jest bezstanowy - żeby kontynuować rozmowę, przy każdej turze trzeba wysłać mu cały dotychczasowy kontekst: instrukcje, pliki, które przeczytał, i całą historię wymiany. Dlatego koszt nie jest stały. Im dłuższa sesja i im więcej w niej materiału, tym większy kontekst leci przy każdym poleceniu, a rachunek rośnie nieliniowo wraz z długością rozmowy. Do tego dochodzi wybór modelu: mocniejsze modele liczą się drożej za tę samą ilość tekstu, więc trzymanie najsilniejszego na wszystko podnosi koszt każdej tury. Dobra wiadomość jest taka, że część tego kosztu ogranicza się sama - Anthropic stosuje cache'owanie promptu, dzięki któremu powtarzalny początek kontekstu (np. Twój CLAUDE.md) jest tańszy przy kolejnych turach. Ale to nie zwalnia z pilnowania, co w tym kontekście ląduje i jak długo trzymasz jedną rozmowę.
/clear. Wyczyścisz kontekst i zaczniesz od świeżej, taniej rozmowy zamiast ciągnąć wszystko poprzednie./compact. Claude Code streści dotychczasową rozmowę do zwięzłego podsumowania i będzie kontynuował na jego podstawie, zamiast wozić pełną historię./model./cost. Zobaczysz, ile bieżąca sesja już kosztowała, i szybko zauważysz, że długa, zapchana rozmowa pali limit szybciej niż seria krótkich.Najprościej porównać zużycie przed zmianą nawyków i po niej. Odpal /cost na koniec dnia pracy prowadzonej po staremu, w jednej długiej sesji, a potem powtórz to samo, dzieląc pracę na krótsze rozmowy z /clear i przełączaniem modelu. Różnica bywa wyraźna. W trakcie pracy zwróć uwagę na tempo: świeża sesja odpowiada szybciej niż zapchana, bo model przetwarza mniejszy kontekst - spadek płynności to sygnał, że czas na /compact albo /clear. Jeśli korzystasz z planu subskrypcyjnego z limitem, miarą sukcesu jest po prostu to, że przestajesz dobijać do granicy w środku dnia. A gdy widzisz, że po zejściu na słabszy model przy prostych zadaniach jakość się nie pogorszyła, masz potwierdzenie, że wcześniej przepłacałeś mocą, której nie potrzebowałeś.
Wroc do listy: 100 najczestszych problemow z Claude Code
Szkolenie Claude Code - od zera do zespołu agentów AI -->
Tryb planowania, tryby uprawnień, komendy, MCP, hooki i systemy multi-agent - wszystko na żywym kodzie podczas trzydniowego szkolenia. Prowadzi Łukasz Matuszewski. Szkolenie ma terminy gwarantowane - odbędzie się niezależnie od liczby zgłoszeń.
Sprawdź szkolenie Claude CodeTo szkolenie może być dofinansowane dla Ciebie z KFS lub BUR.
★★★★★Średnia ocena naszych szkoleń w Google: 5/5
Komentarze (0)
Brak komentarzy...