← Todos los artículos

Tutoriales

El AI Helper ahora muestra exactamente cuánto de tu prompt va a la caché

Hasta la v3.2.70 el indicador de contexto en el AI Helper estimaba el consumo de tokens con la regla "caracteres / 4". Funcionaba, pero se desviaba un 10–30% según el modelo y el idioma. En la v3.2.71–73 hemos pasado a cifras reales desde la API — con un desglose adicional de cuántos tokens caen en la caché (que cuesta unas 10× menos que el input fresco).

Qué es la caché de prompt

Las tres grandes APIs de LLM (Anthropic Claude, OpenAI GPT, Google Gemini) admiten cachear prefijos largos del prompt. Si sigues enviando peticiones con el mismo principio (el mismo system prompt + snapshot del DOM + historial de la conversación), a partir de la segunda llamada ya no pagas por esos tokens — el proveedor reconoce el mismo prefijo y solo te cobra el precio de cache-hit (~10% del precio normal del token).

Para el AI Helper, que trabaja paso a paso dentro de una conversación — el system prompt no cambia, el árbol del DOM cambia poco, el historial crece linealmente — la caché captura típicamente el 70–95% del prompt. Esa es la diferencia entre un dólar y diez centavos por ronda.

Lo que ves ahora en el AI Helper (v3.2.73)

Debajo de la ventana del chat, en la barra de estadísticas, hay tres indicadores de tokens separados:

La suma de input + cached es la longitud total de tu prompt en este turno — el equivalente del antiguo "input" único. Disjuntos — sin doble conteo.

De dónde salen los números

Los proveedores devuelven el uso en campos de la respuesta de la API. Cada uno tiene su propia nomenclatura:

El AI Helper lee la respuesta de cada proveedor y la normaliza a un formato uniforme (input / cached / output). El indicador se actualiza justo después de terminar el turno — sin llamadas extra, sin estimaciones.

Qué te da en la práctica

Tres cosas concretas que no sabías antes de la v3.2.73:

Por qué importa

Las APIs de LLM son más baratas que hace un año, pero con uso intensivo los centavos siguen sumando. Usamos el AI Helper para construir reglas CSS/JS complejas en docenas de dominios — cada ronda son 5–20 mil tokens. Sin caché, son dólares al mes; con un 90% de cache-hit, decenas de centavos. Mostrar números reales ayuda a moldear el workflow en esa dirección.

Notas por proveedor

La caché es específica de cada proveedor — TTL distinto, tamaño mínimo de prefijo distinto, precios distintos. Para orientarte:

Valores vigentes al momento de escribir (mayo de 2026) — comprueba tarifas actualizadas con tu proveedor.

Ver también

Instala JustZix — y usa números reales en lugar de estimaciones.

Valora este artículo

Sin valoraciones — sé el primero.

Pruébalo tú mismo

Instala JustZix y pega cualquier snippet de este artículo. Dos minutos de cero a una regla funcionando en todos tus dispositivos.

Obtener JustZix

Funciones · Cómo funciona · Ejemplos · Casos de uso