← Alle Beiträge

Anleitungen

Der AI-Helper zeigt jetzt genau, wie viel deines Prompts in den Cache geht

Bis v3.2.70 schätzte die Kontextanzeige im AI-Helper den Token-Verbrauch nach der Regel „Zeichen / 4". Es funktionierte, lag aber je nach Modell und Sprache um 10–30% daneben. In v3.2.71–73 sind wir auf echte Zahlen aus der API umgestiegen — mit zusätzlicher Aufschlüsselung, wie viele Tokens im Cache landen (was ~10× weniger kostet als frischer Input).

Was Prompt-Cache ist

Alle drei großen LLM-APIs (Anthropic Claude, OpenAI GPT, Google Gemini) unterstützen das Caching langer Prompt-Präfixe. Wenn du immer wieder Anfragen mit demselben Anfang sendest (derselbe System-Prompt + DOM-Snapshot + Konversationsverlauf), bezahlst du beim zweiten und jedem weiteren Aufruf nicht erneut für diese Tokens — der Provider erkennt dasselbe Präfix und stellt dir nur den Cache-Hit-Preis in Rechnung (~10% des vollen Token-Preises).

Für den AI-Helper, der schrittweise über eine Konversation arbeitet — der System-Prompt ändert sich nicht, der DOM-Baum ändert sich selten, die Historie wächst linear — fängt der Cache typischerweise 70–95% des Prompts ab. Das ist der Unterschied zwischen einem Dollar und zehn Cent pro Runde.

Was du jetzt im AI-Helper siehst (v3.2.73)

Unter dem Chat-Fenster, in der Statistikleiste, gibt es drei separate Token-Indikatoren:

Die Summe von input + cached ist die gesamte Länge deines Prompts für diese Runde — das Äquivalent des alten einzelnen „Input". Disjunkt — keine Doppelzählung.

Woher die Zahlen kommen

Die Provider liefern den Verbrauch in Feldern der API-Antwort. Jeder hat seine eigene Benennung:

Der AI-Helper liest die Antwort jedes Providers und normalisiert sie in ein einheitliches Format (input / cached / output). Die Anzeige aktualisiert sich direkt nach dem Ende der Runde — keine zusätzlichen Aufrufe, keine Schätzung.

Was es dir in der Praxis bringt

Drei konkrete Dinge, die du vor v3.2.73 nicht wusstest:

Warum das wichtig ist

LLM-APIs sind billiger als vor einem Jahr, aber bei intensiver Nutzung summieren sich die Cent immer noch. Wir nutzen den AI-Helper, um komplexe CSS/JS-Regeln über Dutzende Domains zu bauen — jede Runde sind 5–20 Tausend Tokens. Ohne Cache sind das Dollar pro Monat; mit 90% Cache-Hit zehn Cent. Das Anzeigen echter Zahlen hilft, den Workflow entsprechend zu gestalten.

Provider-Hinweise

Cache ist providerspezifisch — unterschiedliche TTL, unterschiedliche Mindestpräfix-Größe, unterschiedliche Preise. Zur Orientierung:

Werte aktuell zum Zeitpunkt des Schreibens (Mai 2026) — prüfe Live-Tarife bei deinem Provider.

Siehe auch

JustZix installieren — und nutze echte Zahlen statt Schätzungen.

Bewerte diesen Beitrag

Noch keine Bewertungen — sei der Erste.

Probiere es selbst aus

Installiere JustZix und füge ein beliebiges Snippet aus diesem Artikel ein. Zwei Minuten von null bis zu einer funktionierenden Regel auf allen deinen Geräten.

JustZix holen

Funktionen · So funktioniert es · Beispiele · Anwendungsfälle