← Wszystkie wpisy

Poradniki

AI Helper pokazuje teraz dokładnie, ile z Twojego promptu trafia w cache

Do v3.2.70 wskaźnik kontekstu w AI Helperze szacował zużycie tokenów regułą „liczba znaków / 4". Działało, ale rozjeżdżało się o 10–30% w zależności od modelu i języka. W v3.2.71–73 przełączyliśmy się na realne liczby z API — z dodatkowym rozbiciem na to, ile tokenów trafia w cache (czyli kosztuje ~10× mniej niż świeży input).

Co to jest prompt cache

Wszystkie trzy duże API LLM-ów (Anthropic Claude, OpenAI GPT, Google Gemini) wspierają mechanizm cache-owania długich prefiksów promptu. Jeśli wysyłasz wielokrotnie zapytanie z tym samym początkiem (np. ten sam system prompt + zrzut DOM-u strony + historia rozmowy), drugie i kolejne wywołania nie liczą tych tokenów ponownie — dostawca rozpoznaje, że to ten sam prefix i obciąża Cię tylko cache-hit price (~10% pełnej ceny tokenu).

Dla AI Helper-a, który prowadzi rozmowę krok po kroku — system prompt nie zmienia się, drzewo DOM-u zmienia się rzadko, historia rośnie liniowo — cache trafia zwykle w 70–95% promptu. To różnica między dolarem a dziesięcioma centami za rundę.

Co widzisz teraz w AI Helperze (v3.2.73)

Pod oknem chatu, w pasku statystyk, są trzy oddzielne wskaźniki tokenów:

Suma input + cached to całkowita długość Twojego promptu w tej turze — równowartość starego pojedynczego „input". Rozłączny — żadnego double-countingu.

Skąd biorą się te liczby

Dostawcy zwracają usage w polach odpowiedzi API. Każdy ma własne nazewnictwo:

AI Helper czyta odpowiedź z każdego dostawcy i sprowadza do jednolitego formatu (input/cached/output). Wskaźnik pojawia się natychmiast po zakończeniu tury — bez żadnych dodatkowych zapytań ani szacowań.

Co Ci to daje w praktyce

Trzy konkretne rzeczy, których przed v3.2.73 nie wiedziałeś:

Dlaczego to ma znaczenie

API LLM-ów są tańsze niż były rok temu, ale wciąż liczą się grosze przy intensywnym użyciu. AI Helper w JustZix-ie używamy do tworzenia złożonych reguł CSS/JS na dziesiątkach domen — każda runda 5–20 tysięcy tokenów. Bez cache to dolarów miesięcznie; z 90% cache hit to dziesiątki centów. Wskaźnik realnych liczb pomaga zoptymalizować workflow w tę stronę.

Wpływ na trzy dostawców

Cache jest specyficzny dla dostawcy — różne TTL, różne minima rozmiaru prefix-u, różne ceny. Dla orientacji:

Wartości dostępne w czasie pisania (maj 2026) — sprawdzaj aktualne stawki u dostawcy.

Zobacz też

Zainstaluj JustZix — i miej realne liczby zamiast szacunków.

Oceń ten wpis

Brak ocen — oceń jako pierwszy.

Wypróbuj samodzielnie

Zainstaluj JustZix i wklej dowolny snippet z tego artykułu. Dwie minuty od zera do działającej reguły na wszystkich Twoich urządzeniach.

Pobierz JustZix

Funkcje · Jak to działa · Przykłady · Zastosowania