Coste de IA: de la tarifa por token al trabajo aceptado
Compara Sol, Terra, Luna y Sonnet 5 con unidades correctas. Incluye salida, intentos, herramientas y revisión antes de hablar de retorno.

La menor tarifa por millón de tokens no identifica por sí sola la opción más económica. Una tarea puede necesitar varios intentos, generar respuestas largas o usar herramientas adicionales. La medida útil es el gasto necesario para conseguir un resultado aceptado con la calidad requerida.
Las tablas oficiales consultadas el 21 de septiembre de 2026 indicaban estas tarifas estándar de texto por millón de tokens de entrada sin caché y salida: GPT-5.6 Sol: US$4 / US$20; Terra: US$2 / US$12; Luna: US$0,20 / US$1,20. Para Claude Sonnet 5: US$2 / US$10. Son referencias de API estándar; otras modalidades, contexto largo, caché y herramientas tienen condiciones propias.
Calcula con las unidades correctas
Para texto sin caché, multiplica los tokens de entrada por su tarifa y los de salida por la correspondiente, dividiendo cada cantidad entre un millón. Después suma las dos partes. No apliques el precio de entrada a todo el volumen: la salida puede tener una tarifa distinta.
Como ejemplo aritmético, no como consumo medido de un proyecto, considera una solicitud a Sol con 100.000 tokens de entrada y 20.000 de salida. A las tarifas anteriores corresponden US$0,40 y US$0,40: US$0,80 antes de otros cargos aplicables. El ejemplo no predice el consumo real ni cuántos intentos harán falta.

Cuenta los intentos sin entrega
Si tres respuestas se descartaron antes de aceptar una solución, forman parte del coste de esa tarea. Distingue las causas: contexto insuficiente, instrucciones ambiguas, errores de herramienta o solución inadecuada. Esa clasificación ayuda a identificar mejoras. Cambiar a un modelo más barato no resuelve todos esos problemas.
Registra también el trabajo incompleto. Dividir una factura solo entre tareas exitosas e ignorar las abandonadas puede ocultar desperdicio. Una vista útil muestra tareas iniciadas, aceptadas e interrumpidas con sus gastos asociados. Mantén estable la definición de aceptación durante toda la comparación.
Incluye herramientas y esfuerzo humano
Búsqueda, ejecución, almacenamiento, suscripciones e infraestructura pueden añadir costes según el producto. Consulta las condiciones correspondientes y no confundas tarifas de API con límites de una suscripción. Dos servicios pueden utilizar el mismo modelo y cobrar la experiencia de maneras distintas.
El tiempo de revisión también importa. Registra minutos observados e intervención necesaria. Si conviertes ese tiempo en dinero, declara la tasa y si representa un coste efectivo o una hipótesis de planificación. Las horas aparentemente liberadas no se transforman automáticamente en menor nómina ni en ingresos adicionales. Hay que decidir cómo aprovechar esa capacidad.
Revisa el gasto por tipo de tarea
Agrupa trabajos similares antes de comparar medias. Una clasificación breve y una investigación larga de código no deben compartir referencia sin contexto. Empieza por categorías con mayor gasto o fallos repetidos, manteniendo muestras de calidad para que ahorrar no oculte resultados peores.
La guía de Sol, Terra y Luna organiza alternativas. La comparación de desarrollo con Claude Fable 5 ayuda a definir trabajo aceptado. El retorno necesita costes y beneficios identificables, no una promesa general de productividad ni una previsión presentada como si ya fuera un resultado observado.
Conserva la fecha de las tarifas y revisa el cálculo cuando cambien las condiciones contratadas.
Sobre el autor
Tiago F SantiagoComentarios
Todavía no hay comentarios
Comparte una pregunta o una experiencia relacionada con el artículo.


