Commet
  • Precios
Iniciar SesiónRegistrarse

¿Qué es el Token-Based Billing?

El token-based billing cobra a cada cliente por los tokens que consume su producto de IA: input, output y cacheados. Aprendé cómo funciona y cómo cobrarlo con margen.


El token-based billing es un modelo de pricing donde el cliente paga por cada token que consume su producto de IA en lugar de una tarifa fija o un precio por asiento. Es la forma estándar de cobrar productos de LLM y IA generativa, porque el token es la unidad que mapea directo al costo de correr un modelo.

Cómo funciona el token-based billing

Un token es la unidad más chica que procesa un modelo de lenguaje — unos pocos caracteres de texto. Cada request a un modelo consume tokens de input para el prompt y tokens de output para la respuesta, y muchos proveedores además cobran los tokens cacheados a una tarifa reducida.

El token-based billing mide cada uno por separado, porque tienen costos distintos. El producto registra la cantidad de tokens por request, la multiplica por una tarifa por token y le suma un margen para cubrir infraestructura y dejar ganancia.

Por ejemplo, si un modelo cuesta $3 por millón de tokens de input y $15 por millón de output, un producto podría cobrar $5 y $20 respectivamente — pasando el costo y quedándose con el spread.

Diferencia con el precio por asiento y el precio fijo

El token-based billing es una forma de usage-based billing, y se comporta distinto de los dos modelos que suele reemplazar.

El seat-based pricing cobra por usuario, así que los ingresos quedan desacoplados de cuánto se usa el producto. Un equipo de cinco que corre millones de tokens paga lo mismo que uno de cinco que casi no lo toca — lo que hace perder plata con los usuarios pesados y cobrar de más a los livianos.

El precio fijo cobra un solo monto sin importar el consumo. Es simple, pero en un producto de IA significa comerte el costo cuando el uso de un cliente se dispara. El token-based billing mantiene tus ingresos alineados con tus costos de modelo en cualquier nivel de uso.

Ejemplos en producción

Los asistentes de escritura con IA, chatbots, agentes de código y aplicaciones RAG cobran todos por tokens. Un agente de código cobra por los tokens que gasta razonando sobre un repositorio. Un bot de soporte cobra por los tokens de cada conversación. Una herramienta de análisis de documentos cobra por los tokens que lee y el resumen que escribe.

El patrón es el mismo: el cliente paga en proporción al trabajo de modelo que disparó su request, así un usuario liviano y uno pesado se cobran de forma justa por lo que cada uno consumió.

Cuándo usar token-based billing

Usá token-based billing cuando el costo de tu producto escala con el uso del modelo y ese uso varía mucho entre clientes. Si una cuenta puede generar 100× los tokens de otra, un precio fijo o por asiento te va a fundir con las cuentas pesadas o dejar afuera a las livianas.

Es menos adecuado cuando el uso es uniforme y predecible entre clientes, donde un plan fijo es más simple para las dos partes.

Cómo proteger tu margen

Como tu costo es el precio del token del modelo, tu margen es el spread entre lo que el modelo te cobra a vos y lo que le cobrás al cliente. Dos cosas protegen ese spread: cobrar tokens de input, output y cacheados por separado para nunca cobrar de menos los caros, y aplicar un margen consistente sobre la tarifa real de cada modelo.

El prompt caching y rutear modelos más baratos para tareas simples bajan tu costo por request, lo que ensancha el spread sin subirle el precio al cliente.

Cómo lo maneja Commet

Commet registra el uso de tokens de IA a través del @commet/ai-sdk y lo cobra con el modelo de consumo balance. Su catálogo de modelos tiene tarifas por millón de tokens, y vos definís un margen configurable por feature para que cada cargo pase el costo del modelo más tu spread.

Los tokens de input, output y cacheados se miden por separado, y el uso de varios modelos se agrega en un solo balance que el cliente va gastando.

Empezá con la documentación de tracking de uso, o leé la guía de cobro por uso en productos de IA.

Preguntas Frecuentes

El token-based billing es una forma de usage-based billing donde la unidad de consumo es el token. Aplica a productos de IA y LLM; otros productos usage-based miden llamadas a API, almacenamiento o cómputo.

Cada tipo de token tiene un costo distinto, así que se miden y cobran por separado. Los tokens de output suelen costar más que los de input, y los cacheados son los más baratos. Aplicás un margen sobre la tarifa de cada modelo.

Registrás el uso de tokens de cada modelo por separado con su propia tarifa por millón de tokens, y después agregás el costo de todos los modelos en un solo descuento de balance o línea de factura al cierre del período.

Desarrolladores

  • Documentación
  • Templates
  • GitHub

Frameworks

  • Next.js
  • Remix
  • Nuxt
  • SvelteKit
  • Astro
  • Express
  • Hono
  • Django
  • FastAPI

Recursos

  • Blog
  • Changelog
  • Precios

IA

  • Agentes
  • Servidor MCP
  • Agent Skills
  • Claude Code
  • Codex
  • Cursor

Aprender

  • Guías
  • Glosario
  • Soluciones
  • Facturación por Modelo de IA
  • Commet VS otros

Comparar

  • Alternativa a Stripe
  • Alternativa a Orb
  • Alternativa a Recurly
  • Alternativa a Paddle
  • Alternativa a Chargebee
  • Alternativa a Lago

Nosotros

  • Nosotros
  • Open Source
  • Términos y condiciones
  • Política de privacidad

Países

  • México
  • Argentina
  • Colombia
  • Chile
  • Perú
  • Ecuador
  • Uruguay
  • Paraguay
  • Bolivia
  • Panamá
  • El Salvador
  • Brasil
System statusXLinkedInGitHub