Your session has been flagged for unusual activity.
Confirma que eres una persona para continuar.
Cuenta los tokens de GPT-4, Claude, Gemini y Grok antes de enviar un prompt. Tu texto nunca sale de tu dispositivo — el tokenizador se ejecuta localmente.
Tokens
0
Caracteres
0
Palabras
0
Caract. / token
—
Coste estimado
Escribe algo para ver el coste aproximado en los principales modelos.
Los grandes modelos de lenguaje no leen caracteres ni palabras directamente — leen tokens. Un token es un fragmento de texto que el modelo ha aprendido a tratar como una unidad. En inglés, un token equivale en promedio a unos cuatro caracteres: una palabra corta como “the” es un solo token, mientras que “tokenization” puede llegar a ser dos o tres.
Los tokens importan por tres razones prácticas. Primero, cada modelo tiene un número máximo de tokens que puede procesar a la vez — su ventana de contexto. Segundo, los proveedores de API cobran por token, por separado para entrada y salida. Tercero, la velocidad de respuesta depende del número de tokens: más tokens implican más cómputo y una espera más larga.
Conocer tu número de tokens antes de enviar un prompt te permite mantenerte dentro de la ventana, prever el coste y recortar el texto que no aporta nada.
En los modelos de chat de OpenAI que usan este tokenizador, esta herramienta utiliza tiktoken con la codificación cl100k_base — igual que el tokenizador que usa la API en el servidor. El recuento es exacto byte a byte.
Claude, Gemini y Grok usan tokenizadores propios que no son totalmente públicos. Los estimamos a partir de estadísticas de texto: Claude tokeniza el inglés a aproximadamente 0.95× la tasa de GPT, Gemini a 0.90×, y Grok casi a la par con GPT. La estimación debería estar dentro de un 5–10% del recuento real — suficientemente precisa para planificar la ventana de contexto y estimar el coste.
No. El tokenizador se ejecuta por completo en tu navegador — sin llamadas de red, sin registros, sin almacenamiento.
Los tokenizadores dividen las palabras largas o poco comunes en varias partes. “Unbelievable” es una sola palabra, pero normalmente son tres tokens. El código, los emojis y las escrituras no latinas se fragmentan en aún más tokens.
Sí. Cada byte que envías — mensaje de sistema, mensaje de usuario, historial de la conversación — se tokeniza y se factura.
Sí — y normalmente son más caros que los tokens de entrada. Este contador solo mide la entrada. Usa nuestra calculadora de coste para estimar el gasto total.
En MultipleChat puedes ejecutar el mismo prompt en todos los modelos principales — y el número de tokens se registra automáticamente.
Prueba MultipleChat gratis