AI Helper теперь показывает, какая именно часть вашего промпта попадает в кэш
До v3.2.70 индикатор контекста в AI Helper оценивал расход токенов по правилу «символы / 4». Это работало, но погрешность составляла 10–30% в зависимости от модели и языка. В v3.2.71–73 мы перешли на реальные числа из API — с дополнительной разбивкой, сколько токенов попадает в кэш (что стоит примерно в 10× дешевле свежего ввода).
Что такое кэш промпта
Все три крупных LLM-API (Anthropic Claude, OpenAI GPT, Google Gemini) поддерживают кэширование длинных префиксов промпта. Если вы продолжаете отправлять запросы с одинаковым началом (тот же системный промпт + снимок DOM + история разговора), то при втором и каждом последующем вызове за эти токены вы больше не платите — провайдер распознаёт тот же префикс и взимает только цену кэш-хита (примерно 10% от полной цены токена).
Для AI Helper, который работает пошагово в рамках разговора — системный промпт не меняется, дерево DOM меняется редко, история растёт линейно — кэш обычно ловит 70–95% промпта. Это разница между одним долларом и десятью центами за раунд.
Что вы теперь видите в AI Helper (v3.2.73)
Под окном чата, в строке статистики, расположены три отдельных индикатора токенов:
- Свежий ввод — токены текущего хода, которые API пришлось обработать с нуля (ваше новое сообщение + любой новый DOM).
- Из кэша — токены, распознанные как префикс предыдущего хода — они стоят долю обычной цены.
- Вывод — то, что сгенерировала модель (всегда полная цена, никогда не кэшируется).
Сумма input + cached — это общая длина вашего промпта на этом ходе, эквивалент прежнего единого «input». Непересекающиеся — без двойного счёта.
Откуда берутся числа
Провайдеры возвращают usage в полях ответа API. У каждого своё именование:
- Anthropic (Claude) —
usage.input_tokens,usage.cache_creation_input_tokens,usage.cache_read_input_tokens,usage.output_tokens. - OpenAI (GPT-4o, o1) —
usage.prompt_tokens,usage.prompt_tokens_details.cached_tokens,usage.completion_tokens. - Google (Gemini) —
usageMetadata.promptTokenCount,usageMetadata.cachedContentTokenCount,usageMetadata.candidatesTokenCount.
AI Helper читает ответ каждого провайдера и нормализует его в единый формат (input / cached / output). Индикатор обновляется сразу после завершения хода — без дополнительных вызовов, без оценки.
Что это даёт на практике
Три конкретные вещи, которые вы не знали до v3.2.73:
- Реальная стоимость раунда — у вас есть точные числа, которые можно умножить на тариф вашего провайдера. Никаких онлайн-калькуляторов, никаких догадок. Что выставляется к оплате = что показано.
- Доля кэш-хитов — когда вы начинаете новый разговор, cached = 0 (кэш только строится). В последующих ходах вы видите, как значение растёт. Кэш-хит 90%+ означает, что разговор идёт эффективно; 30% — что вы всё ещё подбрасываете большой объём нового контекста.
- «Продолжать или начать заново» — когда вы видите, что cached начинает падать (например, дерево DOM изменилось и префикс больше не совпадает), вы понимаете, что проще перезапустить разговор с новым контекстом, чем добавлять ещё ходы.
Почему это важно
LLM-API стали дешевле, чем год назад, но при интенсивном использовании центы всё равно складываются. Мы используем AI Helper для построения сложных CSS/JS-правил на десятках доменов — каждый раунд это 5–20 тыс. токенов. Без кэша это доллары в месяц; с кэш-хитом 90% — десятки центов. Показ реальных чисел помогает выстраивать рабочий процесс в этом направлении.
Заметки по провайдерам
Кэш специфичен для провайдера — разный TTL, разный минимальный размер префикса, разные цены. Для ориентира:
- Anthropic Claude — TTL кэша 5 минут, минимум 1024 токена в префиксе, запись в кэш = 1.25× цены input, чтение из кэша = 0.1× цены input.
- OpenAI GPT-4o / o1 — автоматический кэш от 1024 токенов, отдельной платы за запись нет, чтение из кэша = 0.5× цены input.
- Google Gemini 1.5 — явное API контекстного кэширования, пользователь сам выбирает, что кэшировать, плата за запись + хранение, чтение дешевле свежего ввода.
Значения актуальны на момент написания (май 2026) — проверяйте текущие тарифы у своего провайдера.
См. также
- Окна на странице — AI Helper как одно из окон разработчика
- AI Helper в shadow DOM — недавний шаг в изоляции стилей окна
- Интерактивное обучение для новых пользователей — от нуля до рабочего правила с AI Helper
Установите JustZix — и используйте реальные числа вместо оценок.
Оцени эту статью
Оценок пока нет — оцени первым.