"escribe mi biografía" prompt → "correo electrónico en frío" name: serge </> skill.md { run() }
MK
Marketing y crecimiento
Campañas, SEO y anuncios
LG
Legal y finanzas
Contratos, dirección financiera e impuestos
Skill .md
Para cualquier AI
SK
Agents de AI
Tareas de principio a fin
AG
Tus datos

Tus tokens desperdiciados al mes aparecerán aquí.
Introduce tus datos de uso y haz clic en Calcular.

¿Quieres acabar con el desperdicio, no solo medirlo?
Convierte tu AI en el ingeniero de prompts que soluciona esto.
Noor, el Skill de ingeniería de prompts, convierte Claude, ChatGPT o cualquier chat de AI en un ingeniero sénior de prompts: diseño de prompts para producción, entornos de evaluación y optimización de tokens, costes y latencia integrados. No se necesita experiencia en prompts.
Ver el Skill de ingeniería de prompts →

¿Qué es una calculadora de costes de tokens de AI?

Una calculadora de costes de tokens de AI estima cuántos tokens —y cuánto dinero— gastas en ChatGPT, Claude o cualquier chat de AI, según cómo lo uses realmente. Esta calculadora gratuita de costes de tokens de AI se centra en una fuente de desperdicio muy específica y habitual: volver a pegar las mismas instrucciones sobre el rol, el formato o la voz de marca en el chat en cada mensaje, en lugar de cargarlas una sola vez.

Indica cuántas conversaciones inicias al día, cuántos mensajes de seguimiento tiene cada una y aproximadamente qué longitud tiene el contexto que repites. La calculadora estima tus tokens desperdiciados al mes, cuánto cuesta eso con los precios habituales de las API de pago y cuánto de ese desperdicio desaparece cuando ese mismo contexto se guarda en un archivo de Skill persistente o en las instrucciones del proyecto, en lugar de mantenerlo en el portapapeles. Cambia al modo equipo para ver el mismo cálculo aplicado al uso de AI de todo un equipo; a menudo, la cifra es mucho mayor.

Medir el desperdicio es el primer paso. Noor, el Skill de ingeniería de prompts de KissMySkills, convierte Claude, ChatGPT o cualquier chat de AI en un ingeniero sénior de prompts que diseña los prompts y archivos de Skill reutilizables y listos para producción que acaban con este desperdicio de una vez por todas; no se necesitan conocimientos previos de ingeniería de prompts.

Por qué un token no es una palabra

Todos los proveedores publican aproximadamente la misma estimación para el inglés: un token equivale a unos cuatro caracteres o a unas tres cuartas partes de una palabra. Google lo expresa diciendo que 100 tokens equivalen aproximadamente a entre 60 y 80 palabras en inglés. Anthropic da una cifra algo más precisa, de unos 3,5 caracteres por token, y añade la salvedad importante: el recuento exacto varía según el idioma y el tipo de contenido.

Esa salvedad es más importante de lo que parece. Los recuentos de tokens ni siquiera son estables entre los modelos de un mismo proveedor: Anthropic señala que su tokenizador más reciente produce aproximadamente un 30 % más de tokens para el mismo texto que el anterior. Misma entrada, mismo proveedor, factura considerablemente distinta.

Por eso, considera cualquier estimación de tokens —incluida esta— como una cifra aproximada. Si necesitas el número real, cuéntalos en lugar de estimarlos: todos los proveedores principales ofrecen un tokenizador o un campo de uso en la respuesta de la API que indica exactamente por qué se te cobró.

La salida cuesta varias veces más que la entrada

Lo más importante que debes saber sobre los precios de los tokens es que las dos direcciones no tienen el mismo precio. La entrada es lo que envías; la salida es lo que genera el modelo; la salida es sistemáticamente la más cara.

Según los datos comprobados en agosto de 2026, las tarifas publicadas de Anthropic por millón de tokens mantienen una proporción exacta de 5× en toda la gama: Opus 5 cuesta 5 $ por la entrada frente a 25 $ por la salida, y Haiku 4.5, 1 $ frente a 5 $. El modelo insignia actual de OpenAI cuesta 5 $ frente a 30 $, una proporción de 6×, mientras que su nivel más económico cuesta 0,20 $ frente a 1,20 $. La gama Gemini de Google abarca aproximadamente de 4× a 8×.

Las cifras exactas habrán cambiado para cuando leas esto; consulta la página de precios del proveedor. La proporción es lo que se mantiene: en los tres proveedores, la salida cuesta aproximadamente entre cuatro y ocho veces más que la entrada. Esto tiene una consecuencia práctica. Recortar un prompt del sistema demasiado extenso te ahorra tokens de entrada, que son los baratos. Pedir una respuesta más corta te ahorra tokens de salida, que no lo son. Si el problema de costes es real, fíjate en cuánto escribe el modelo antes de fijarte en cuánto estás enviando.

Por qué el turno diez cuesta más que el primero

Las API de chat no tienen estado. OpenAI lo explica claramente: cada solicitud de generación de texto es independiente, y construyes una conversación de varios turnos reenviando los mensajes anteriores como parámetros. Anthropic describe el mismo modelo de facturación: la entrada de cada turno contiene todo el historial de la conversación anterior más el mensaje actual, y todo lo incluido en la solicitud cuenta, incluido el prompt del sistema y las definiciones de tus herramientas.

Por eso, una conversación no cuesta la suma de sus mensajes. El turno diez vuelve a facturar los turnos del uno al nueve como entrada nueva. Si cada turno añade una cantidad de texto aproximadamente constante, la entrada acumulada facturada a lo largo de una conversación crece con el cuadrado del número de turnos, no linealmente. Ese cálculo es nuestro, no una afirmación de un proveedor, pero se deduce directamente del modelo de reenvío que documentan ambas empresas, y por eso un chat largo se encarece de una forma que sorprende a la gente.

Hay dos mecanismos documentados que contrarrestan este efecto. El almacenamiento en caché de prompts aplica un recargo por escribir una entrada de caché y un descuento considerable por leerla: Anthropic cobra 1,25× la tarifa base de entrada por escribir una caché de cinco minutos y 0,1× por leerla, por lo que se amortiza después de un solo uso. OpenAI aplica el mismo recargo de 1,25× por escritura y un descuento del 90 % en las entradas almacenadas en caché, con un prefijo de al menos 1.024 tokens. Por separado, los tres proveedores ofrecen un descuento del 50 % por el procesamiento por lotes asíncrono, y Anthropic afirma que los descuentos por caché y por lotes se acumulan.

Lo que esta calculadora no puede hacer

No estima tu factura total. Modela un único modo de fallo —el contexto repetido—, no tu gasto total. En tu factura real influye sobre todo cuánto escriben los modelos, algo que esta herramienta no puede ver.

La cifra en dólares puede no ser dinero que realmente gastes. Esto es lo más importante y es fácil pasarlo por alto. ChatGPT Plus y Claude Pro son suscripciones de tarifa fija, no servicios facturados por token. Si trabajas dentro de una suscripción de chat en lugar de usar la API, el valor equivalente en API del desperdicio que se muestra aquí no es un cargo en tu extracto. Los tokens desperdiciados son reales de todos modos: consumen espacio de la ventana de contexto y te cuestan velocidad y espacio para el trabajo real; pero solo los usuarios de la API los ven como una partida.

No conoce tus descuentos. El almacenamiento en caché, el procesamiento por lotes y las tarifas negociadas pueden cambiar el importe de una factura de API en un orden de magnitud, y ninguno de esos factores está incluido en este modelo.

Los precios cambian. Cada cifra de esta página incluye la fecha en que se comprobó por una razón. Los proveedores cambian las tarifas, lanzan nuevos niveles de modelos y, ocasionalmente, cambian el tokenizador subyacente. Verifícala antes de tomar una decisión presupuestaria al respecto.