Contador de Tokens IA
Cuenta tokens para GPT, Claude, Gemini, Llama y cualquier modelo de IA. Estima costes de API con precios personalizados. Gratis y privado en tu navegador.
¿Qué es un token en IA?
Un token es la unidad básica de texto que procesan los modelos de IA. En inglés, aproximadamente 1 token equivale a 4 caracteres o unas 0,75 palabras. Por ejemplo, \"hello\" suele ser 1 token, mientras que \"unbelievable\" puede dividirse en 2 tokens: \"un\" y \"believable\".
¿Funciona para todos los modelos de IA?
Sí. Utiliza un algoritmo de aproximación universal compatible con todos los modelos LLM principales incluyendo GPT-4, GPT-3.5, Claude, Gemini, Llama, Mistral, DeepSeek y más. La estimación suele estar dentro del 5-10% de los conteos exactos.
¿Qué tan preciso es el conteo de tokens?
El conteo usa un algoritmo de aproximación universal basado en patrones de tokenización BPE (Byte Pair Encoding). Proporciona estimaciones cercanas generalmente dentro del 5-10%, pero puede diferir ligeramente de los conteos exactos de la API porque cada modelo usa su propio tokenizador.
¿Cómo estimo los costes de la API?
Despliegue la sección de Estimación de Costes e introduzca los precios de API para tokens de entrada, salida y aciertos de caché. La herramienta calculará automáticamente el coste estimado basándose en los tokens contados y su precio por millón de tokens.
¿Se envía mi texto a algún servidor?
No. Todo el conteo de tokens se realiza completamente en su navegador. Su texto nunca sale de su dispositivo ni se envía a ningún servidor. Esta herramienta es 100% del lado del cliente para total privacidad.
¿Qué es la tokenización BPE?
BPE (Byte Pair Encoding) es el método de tokenización más utilizado por los grandes modelos de lenguaje. Funciona fusionando iterativamente los pares de caracteres más frecuentes en un corpus de entrenamiento para construir un vocabulario que equilibra eficiencia y cobertura.
¿Cómo varían los tokens entre idiomas?
La eficiencia de tokens varía significativamente entre idiomas. El texto en inglés promedia aproximadamente 1 token por cada 4 caracteres. Los idiomas CJK (chino, japonés, coreano) suelen necesitar 1,5-2 caracteres por token debido a la complejidad de sus sistemas de escritura.
¿Cuál es la diferencia entre tokens y palabras?
Los tokens no son lo mismo que las palabras. Las palabras comunes en inglés suelen ser 1 token, pero las palabras largas o poco frecuentes pueden dividirse en varios tokens. Los signos de puntuación y los espacios también pueden ser tokens independientes.
¿Puedo usarlo con modelos fine-tuned o personalizados?
Sí. El algoritmo de aproximación universal funciona para cualquier modelo independientemente de su tokenizador específico. Aunque la estimación puede variar ligeramente, proporciona una aproximación fiable para la estimación de costes y planificación de texto.
¿Cómo funciona el precio de aciertos de caché?
Muchos proveedores de IA como OpenAI y Anthropic ofrecen precios con descuento para tokens en caché, prompts vistos recientemente. Los tokens de caché suelen cobrarse al 10% del precio normal de entrada. Introduzca su precio de caché para ver los ahorros.