Saltar al contenido
PotenzIAValorar mi proyecto

Uso de modelos

Qué son los tokens y cómo estimar el coste de usar IA

Un token es una unidad que un modelo utiliza para procesar información. En texto puede representar una palabra, parte de ella o un signo. Muchas APIs calculan parte de su consumo mediante tokens de entrada y salida; la tarifa y las categorías facturadas dependen del proveedor y del modelo.

3 min de lectura · Edición editorial: septiembre de 2026

Qué cuenta como entrada y como salida

La entrada puede incluir instrucciones, mensajes anteriores, documentos y resultados de herramientas, no solo la última pregunta. La salida es lo que genera el modelo. Algunos servicios distinguen otras categorías de uso, como caché o razonamiento, con condiciones específicas que conviene consultar.

El número de palabras no permite calcular exactamente los tokens. La división depende del modelo, el idioma y el contenido. Para preparar un presupuesto, utiliza el contador compatible con el modelo o los datos de consumo que devuelve el servicio durante las pruebas.

Ejemplo didáctico: estimar un volumen de consultas

Supongamos 1.000 consultas de prueba, cada una con 1.200 tokens de entrada y 300 de salida. El volumen sería 1.200.000 tokens de entrada y 300.000 de salida. Son cantidades hipotéticas elegidas para explicar el cálculo, no consumos observados de PotenzIA.

Si una tarifa se expresa por millón de tokens, se multiplican 1,2 millones por la tarifa de entrada y 0,3 millones por la de salida. Después se suman los conceptos adicionales que correspondan. Aquí no se asigna un precio: debe utilizarse la tarifa vigente del modelo y del servicio elegidos.

El coste de una respuesta no siempre es el de una tarea

Una tarea puede requerir varias llamadas: clasificar una entrada, buscar información, redactar y revisar. También puede repetir pasos si una herramienta falla. El cálculo útil reúne ese recorrido, no únicamente la llamada que produjo el texto final.

Además del modelo, pueden existir costes de almacenamiento, búsqueda, alojamiento y revisión humana. Para valorar una solución, compara el coste total por tarea correctamente completada con el proceso de partida. Una respuesta barata que exige rehacer el trabajo puede no aportar la mejora esperada.

Ventana de contexto, límite de salida y presupuesto

La ventana de contexto describe cuánto puede manejar el modelo en una interacción; no es una tarifa ni un saldo contratado. El límite de salida acota cuánto puede generar. Poner un límite demasiado corto puede cortar una respuesta necesaria, por lo que debe probarse con los casos de uso.

Un límite de gasto del proveedor tampoco sustituye los límites de la aplicación. Es útil controlar número de pasos, reintentos y tamaño de documentos según la tarea, además de observar el consumo acumulado. La forma exacta de aplicar esos controles depende del servicio.

Cómo reducir consumo sin perder utilidad

Empieza por localizar dónde se gasta: contexto repetido, documentos irrelevantes, respuestas demasiado extensas o pasos que no aportan al resultado. Prueba un cambio cada vez y comprueba que mantiene la calidad. Los descuentos, cachés y tarifas deben verificarse en la documentación correspondiente.

  • Envía el contexto necesario para la tarea, con versiones y fuentes claras.
  • Pide la extensión de respuesta que necesita la persona o aplicación receptora.
  • Limita reintentos y define cuándo una ejecución debe pasar a revisión.
  • Registra volumen, calidad y coste por tarea para comparar alternativas con el mismo criterio.

Fuentes y documentación

Documentación del proveedor o del organismo citado. Los ejemplos de esta ficha son didácticos; no describen resultados de clientes.

CONECTA LAS IDEAS

El siguiente paso.

← Volver a glosario

DE ENTENDER A APLICAR

Trabaja estas decisiones
sobre tu propio proyecto.

Conoce el programa, el acompañamiento y cómo valoramos tu punto de partida.

Conoce PotenzIA