Zużycie Claude Code nie opiera się tylko na liczbie wysyłanych wiadomości, lecz na liczbie tokenów, które system musi przetworzyć przy każdej odpowiedzi. Oznacza to, że im więcej historii (kontekstu), powtórzeń, tym szybciej rośnie zużycie.
- Liczba tokenów, a nie wiadomości, wpływa na zużycie Claude Code.
- Krótka, konkretna i uporządkowana sesja zmniejsza „palenie” tokenów.
- Unikaj nadmiernego iterowania poleceń, pisz pełne za jednym razem.
- Grupuj zadania, unikając dzielenia na wiele kroków.
- Udostępniaj tylko istotne informacje, unikaj nadmiaru danych.
Dobra wiadomość jest taka, by ograniczyć zużycie tokenów, to wystarczy trzymać się kilku naprawdę prostych zasad. I nie jest to jakieś trudne. Sam korzystam z nich i widzę różnicę.
Warto o tym pamiętać również mając wersję Claude Code Enterprise gdzie „sky is the limit”.
1. Zachowaj krótkie i uporządkowane sesje
Długie wątki konwersacji to jedno z największych źródeł marnowania tokenów. Każda nowa wiadomość wymusza na Claude ponowne prześledzenie całej rozmowy, w tym starych instrukcji i nieaktualnego kodu. Z biegiem czasu to się niepostrzeżenie kumuluje.
- Rozpoczynaj nową sesję przy każdym nowym zadaniu.
- W tym celu użyj komendy
/clear, gdy kontekst nie jest już potrzebny. - Nie mieszaj ze sobą różnych zadań.
To utrzymuje kontekst małym i skoncentrowanym, co bezpośrednio zmniejsza zużycie tokenów. Wyjątkiem są modele z kontekstem 1M.
2. Unikaj nadmiernego iterowania poleceń
Naturalnym wydaje się wysyłanie wielu uzupełniających wiadomości typu: „zmień to trochę…”, „teraz popraw to…”, „dostosuj to również…”. Problem polega na tym, że każda wiadomość zmusza model do ponownego przetworzenia wszystkiego. Każda kolejna wiadomość musi zawierać poprzednie.
Efektywniej będzie jeśli poświęcisz trochę więcej czasu by lepsze polecenie, które wyjdzie na przeciw potencjalnym problemom w danym zadaniu.
3. Grupuj zadania zamiast je dzielić
Ten punkt wynika z poprzedniego. Dajemy jedno większe polecenie zamiast jednego po drugim. Zamiast:
- Napraw błąd
- Refaktoryzuj kod
- Dodaj testy
Lepiej będzie napisać:
- „Napraw błąd, refaktoryzuj kod i dodaj testy”
Dzięki temu Claude Code przetwarza kontekst raz, dostarcza jedno kompletne rozwiązanie i unika powtarzającego się ładowania tych samych informacji.
Idealnym rozwiązaniem dla punktów 2 i 3 jest skill /grill-me, który dopytuje o szczegóły, szuka ewentualnych problemów. Dzięki temu mamy wszystko uporządkowane. Na ten skill trzeba poświęcić oddzielny wpis.
4. Panuj nad tym co udostępniasz w kontekście
Znaczne ukryte koszty wynikają z wklejania zbyt dużej ilości informacji. Częste błędy, to:
- Całe pliki, gdy potrzebna jest tylko mała część,
- Ogromne logi z nieistotnymi liniami,
- Wielokrotne udostępnianie tego samego kodu.
Claude przetwarza wszystko, co wyślesz, nawet jeśli większość tego nie jest przydatna. Lepsze nawyki:
- Udostępniaj tylko istotny fragment,
- Przycinaj logi przed wklejeniem,
- Odnoś się do plików zamiast je ponownie wklejać.
To samo dotyczy plików CLAUDE.md czy skilli. Im krótsze tym lepiej. Idealnie maks 200-300 linii.
Powyższe strategie pozwalają znacznie ograniczyć zużycie tokenów, zwiększając jednocześnie efektywność pracy.
Dobrym rozwiązaniem może być użycie innego skilla /caveman, który nakazuje agentowi odpowiadać krótko i na temat. Tak w skrócie działa agent AI po użyciu tego skilla:
- usuwa zbędne słowa, grzeczności i wstępy,
- skraca zdania do minimum,
- zachowuje treść techniczną i kod,
- często używa równoważników zdań zamiast pełnej gramatyki.