Ejemplos de facturación
Ejemplos de precios resueltos para modelos típicos de LLM, video, imagen y audio — facturación por tokens de LLM, video facturado por tokens, video por segundo, por imagen, imagen facturada por tokens y audio facturado por caracteres
Esta página recorre cálculos de facturación reales para algunos modelos típicos, uno por cada estilo de precios. La mecánica detrás de cada estilo se explica en Cómo se facturan los modelos.
Las tarifas mostradas son instantáneas
Las tarifas a continuación son precios de lista, exactos al momento de escribir (julio de 2026), y pueden cambiar. Cualquier descuento de plataforma o de cuenta se aplica automáticamente de forma adicional. La página de detalles del modelo y la API de estimación de costos siempre devuelven el precio actual y autoritativo.
Tokens de LLM — zai-org/glm-5.2
Los modelos LLM se facturan por millón de tokens, con tarifas separadas para los tokens de entrada (prompt), de entrada en caché y de salida (completion) (consulta modelos LLM):
| Tipo de token | Precio de lista |
|---|---|
| Tokens de entrada | $1.40 por 1M |
| Tokens de entrada en caché | $0.26 por 1M |
| Tokens de salida | $4.40 por 1M |
Se te cobra después de que la solicitud se completa, según los recuentos de tokens reportados en el campo usage de la respuesta — las solicitudes con y sin streaming se facturan de forma idéntica, y las solicitudes fallidas no se facturan.
Ejemplo — una solicitud de chat con 12,000 tokens de prompt (10,000 de ellos servidos desde la caché de prompt) y 1,500 tokens de salida:
- Entrada nueva: 2,000 × $1.40 ÷ 1M = $0.0028
- Entrada en caché: 10,000 × $0.26 ÷ 1M = $0.0026
- Salida: 1,500 × $4.40 ÷ 1M = $0.0066
- Total: $0.0120
Sin caché de prompt, la misma solicitud facturaría los 12,000 tokens de entrada a la tarifa completa de entrada — $0.0168 + $0.0066 = $0.0234, casi el doble. Mantener un prompt de sistema estable entre solicitudes permite que la tarifa de caché se aplique a la porción repetida.
Video facturado por tokens — bytedance/seedance-2.0/reference-to-video
Seedance 2.0 reference-to-video se factura por tokens de video de salida cuando la tarea se completa (consulta modelos de video facturados por tokens). Se aplican dos tarifas por token, según tus entradas:
| Tipo de entrada | Tarifa por token |
|---|---|
| Solo imágenes de referencia (sin video de entrada) | $11.20 por 1M de tokens de video |
| Incluye video(s) de referencia | $6.88 por 1M de tokens de video |
Multiplicadores de resolución: 480p / 720p / 1080p × 1.0, 4k × 0.57, 720p-sr / 1080p-sr × 1.8, 1440p-sr × 3.2. Los tokens facturados se miden a partir de la salida generada (y, para las solicitudes con videos de referencia, incluyen la contribución del video de entrada), así que usa /calculate para obtener una cotización exacta en los niveles 4K y SR.
Los tokens escalan con la resolución, la tasa de fotogramas y la duración:
A 1080p (1920 × 1080, 24 fps) esto equivale a 48,600 tokens por segundo de video.
Ejemplo A — solo imágenes de referencia, 10s a 1080p:
- Tokens de salida: 48,600 × 10s = 486,000 tokens
- Precio de lista: 486,000 ÷ 1,000,000 × $11.20 × 1.0 = $5.44
Ejemplo B — con un video de referencia de 8s, salida de 10s a 1080p:
- Los tokens facturados cuentan el video de entrada más la salida: (10s + 8s) × 48,600 = 874,800 tokens
- Se aplica la tarifa más baja con video: 874,800 ÷ 1,000,000 × $6.88 × 1.0 = $6.02
Al enviar se coloca una pequeña retención temporal que se libera una vez que la tarea se factura; las tareas fallidas no se cobran.
Video por segundo — alibaba/wan-2.7/image-to-video
Wan 2.7 image-to-video usa el precio clásico por segundo: una tarifa base de $0.10 por segundo, escalada según la resolución de salida, con un mínimo de 5 segundos:
| Resolución | Tarifa efectiva |
|---|---|
| 720p | $0.10 / segundo |
| 1080p | $0.15 / segundo |
| 1080p-SR (mejorada desde 720p) | $0.12 / segundo |
| 1440p-SR (mejorada desde 720p) | $0.2133 / segundo |
Ejemplo — 8s a 1080p:
$0.10 × 8 × 1.5 = $1.20, reservado de tu saldo al enviar y cobrado cuando el video se entrega.
Ejemplo — 3s a 720p:
La duración está por debajo del mínimo, así que se facturan 5 segundos: $0.10 × 5 × 1.0 = $0.50.
Por imagen con opciones — google/nano-banana-pro/edit
Nano Banana Pro (variante edit) tiene precio por imagen de salida, con un nivel de resolución y un recargo opcional por búsqueda web:
| Concepto | Precio de lista |
|---|---|
| Imagen hasta 2K | $0.14 / imagen |
| Imagen 4K | $0.24 / imagen |
| Búsqueda web (opcional) | $0.014 / solicitud |
Ejemplo — 2 imágenes a 4K con búsqueda web habilitada:
- Imágenes: 2 × $0.24 = $0.48
- Búsqueda web: + $0.014 (se añade una vez por solicitud)
- Total de lista: $0.494
El monto se reserva al enviar y se libera automáticamente si la tarea falla.
Imagen facturada por tokens — openai/gpt-image-2/edit
GPT Image 2 se factura como un LLM — por tokens — pero los recuentos de tokens se calculan a partir de los parámetros de tu solicitud al enviarla:
| Tipo de token | Tarifa | Cómo se cuenta |
|---|---|---|
| Tokens de imagen de salida | $30 por 1M | A partir de size y quality de la salida |
| Tokens de imagen de entrada | $8 por 1M | A partir de las dimensiones reales de cada imagen de entrada |
| Tokens de texto de entrada | $5 por 1M | 1,000 tokens fijos por imagen generada |
Recuentos de tokens de salida para una imagen de 1024×1024: 196 (low), 1,756 (medium), 7,024 (high). Los tamaños mayores producen proporcionalmente más tokens; las imágenes de entrada siempre usan la base de tokens medium sin importar quality.
Ejemplo — editar una imagen de 1024×1024, quality: medium, size: 1024x1024, n: 1:
- Texto de entrada: 1,000 tokens × $5/1M = $0.0050
- Imagen de entrada: 1,756 tokens × $8/1M = $0.0140
- Imagen de salida: 1,756 tokens × $30/1M = $0.0527
- Total: ≈ $0.072 por imagen
Solicitar n imágenes multiplica el monto total por n.
Audio facturado por caracteres (TTS) — xai/tts-v1 y bytedance/seed-audio-1.0
Ambos modelos de texto a voz tienen precio según la longitud del texto de entrada, a $0.015 por 1,000 caracteres:
Los caracteres se cuentan como caracteres Unicode, así que un carácter CJK cuenta como un carácter, igual que una letra latina.
Ejemplo — un guion de 1,200 caracteres:
1,200 ÷ 1,000 × $0.015 = $0.018, cobrado al enviar.
Ejemplo — un prompt corto de 300 caracteres:
300 ÷ 1,000 × $0.015 = $0.0045.
Comprueba cualquier modelo tú mismo
Cada ejemplo anterior se puede reproducir con la API de estimación de costos — envía el cuerpo exacto de tu solicitud a /api/v1/model/calculate y devuelve el precio de lista, tu precio efectivo y el descuento aplicado sin crear ninguna tarea.
Last updated on