1) Solicitud = UNA llamada que tu programa hace a la IA
Una solicitud es cuando un programa hace una pregunta a la IA una vez y recibe una respuesta una vez. ATENCIÓN: 1 mensaje que tú escribes NO SIGNIFICA 1 solicitud. En cuántas solicitudes se convierte un mensaje depende de la herramienta que uses.
El programa pregunta→El modelo piensa→El modelo responde
= 1 SOLICITUDYa sea que tu mensaje tenga 5 palabras o 500, esa ÚNICA llamada cuenta como 1 solicitud. La longitud no cambia el NÚMERO de solicitudes — pero sí cambia los tokens consumidos y, por tanto, lo que pagas con PAYG.
Entonces, ¿en cuántas solicitudes se convierte 1 mensaje tuyo?
Si escribes en una pantalla de chat: 1 mensaje = 1 solicitud. Sencillo. Pero en las herramientas de código (Claude Code, Cline, Codex…) la situación es MUY distinta. Estas herramientas funcionan como “agentes”: tú escribes una sola frase y ellas trabajan paso a paso por detrás, preguntando de nuevo al modelo en CADA PASO.
Ejemplo: le dijiste a Claude Code “corrige este error”. Lo que pasa por detrás:1Lee los archivos → 1 solicitud
2Examina el código para encontrar el error → 1 solicitud
3Escribe la corrección → 1 solicitud
4Ejecuta la prueba y lee el resultado → 1 solicitud
5Si la prueba falló, vuelve a corregir → 1 solicitud más… y así sucesivamente
Es decir, tu ÚNICA frase puede convertirse en 20–30 solicitudes por detrás. Esa es la razón por la que un paquete de “1.000 solicitudes/día” se agota más rápido de lo que esperabas. Esto no es un error — es la forma en que funcionan las herramientas con agentes.
Siempre puedes ver cuántas solicitudes has consumido en la página de Actividad del panel; cada solicitud es una línea aparte.
2) Token = fragmentos de palabras
La IA no lee las palabras como nosotros. Divide el texto en pequeños fragmentos; a cada uno de esos fragmentos se le llama TOKEN. Un token a veces es una palabra entera, a veces la mitad de una palabra, a veces un signo de puntuación.
Esta frase: “Hoy hace muy buen tiempo.”Bugün hava çok güzel.
Son unos 5 tokens. A grandes rasgos: 1 token ≈ 4 caracteres. Como en español las palabras suelen ser algo largas, salen unos cuantos tokens más. La tarifa se calcula por tokens — no por palabras ni caracteres.
3) Hay dos tipos de token: los que salen y los que entran
En una solicitud los tokens fluyen en ambas direcciones. Ambos se cuentan.
- ENTRADA (lo que envías) — tu pregunta + las instrucciones dadas a la IA + la conversación anterior, si la hay.
- SALIDA (lo que escribe el modelo) — toda la respuesta que recibes. La salida suele ser más cara que la entrada, porque es la parte que realmente hace trabajar al modelo.
⚠ Lo más sorprendente: en un chat, el historial se reenvía cada vez
La IA NO tiene memoria. No recuerda tu mensaje anterior. Por eso, cuando continúas un chat, el programa reenvía TODA la conversación desde el principio — de lo contrario, el modelo no sabría de qué estás hablando. Es decir: cuanto más largo es el chat, más caro sale cada mensaje:
1Mensaje 1 — solo se envía tu pregunta~30 token
2Mensaje 2 — se envían la pregunta 1 + la respuesta 1 + la pregunta 2~90 token
3Mensaje 3 — se envía todo lo anterior + la pregunta 3~200 token
Qué hacer: abre un CHAT NUEVO cuando cambie el tema. Acumular 50 mensajes en el mismo chat encarece mucho cada mensaje nuevo.
4) En las herramientas de código, ni siquiera “hola” viaja solo
Herramientas como Claude Code y Cline envían muchas cosas en segundo plano sin que te des cuenta: el contenido de los archivos que tienes abiertos, la estructura del proyecto, las instrucciones dadas a la herramienta… Por eso, aunque escribas “hola” en la pantalla, por detrás pueden enviarse miles de tokens.
Esto no es un error, es la forma en que funciona la herramienta — y explica por qué incluso una pregunta pequeña genera un costo.
5) ¿Cómo se cuenta? Es DIFERENTE en el paquete y en el saldo
📦 Si compraste un paqueteTienes un cupo diario de créditos. Cada SOLICITUD (cada llamada a la API) descuenta 1 crédito — no cada mensaje que escribes. Corto o largo, da igual. Si tienes un paquete de 500 solicitudes/día, una herramienta con agentes puede agotarlo en unas pocas tareas.
1 llamada a la API = 1 crédito 💳 Si pagas desde el saldo (PAYG)No hay créditos. En cada solicitud, se descuenta de tu saldo el dinero correspondiente a los tokens que consumiste. Pregunta corta = poco dinero. Chat largo = mucho dinero.
paga según los tokens
Ejemplo real: en el modelo claude-haiku-4-5, 1M de tokens cuesta 0.3 $. Es decir, una solicitud de 1.000 tokens cuesta aproximadamente 0.0142 ₺. (Precios del catálogo en vivo.)6) ¿Por qué veo TRES líneas en el libro contable?
Al mirar Actividad en el panel, verás tres líneas para una sola solicitud. No te asustes — el dinero se descuenta una sola vez. Funciona así: al iniciar la solicitud no podemos saber cuánto costará, así que primero “apartamos” una cantidad. Al terminar, devolvemos TODO lo que apartamos y descontamos solo lo que realmente se gastó.
Reserva — apartado (máximo estimado)−$0,05
Reembolso — se devolvió todo lo apartado+$0,05
Uso — se descontó lo realmente gastado−$0,01
Resultado: de tu bolsillo solo sale lo que realmente se gastó. Las tres llevan el mismo número de solicitud, así que no se confunden.
7) ¿Cómo gasto menos?
- Abre un chat nuevo cuando cambie el tema — para que la conversación antigua no se reenvíe cada vez.
- Escribe tu pregunta con claridad. En lugar de explayarte, di exactamente lo que quieres.
- Para tareas sencillas, elige un modelo económico (como GLM, Kimi). No hace falta usar el modelo más caro para todo.
- Si lo usas con regularidad, compra un paquete — al basarse en créditos, sale mucho más barato en solicitudes largas.