Calculadora de precios LLM — estimación del costo de tokens

Estima el costo en USD por llamada a partir de los tokens de entrada y de salida. Pega un prompt para derivar los tokens de entrada en vivo, o introduce totales desde los logs. Batch API, caché de prompt y proyección mensual — íntegramente en el navegador.

Estimaciones de coste LLM en el navegador
Convierte recuentos de tokens en estimaciones USD por llamada con nuestra tabla de precios por modelo mantenida a mano — sin scraping en vivo ni API de facturación de proveedores.

Cómo funcionan los precios

Las tarifas salen de una tabla mantenida a mano en llm-models.json, revisada al menos una vez al mes. La fecha verificada de esta página refleja la última revisión — no tu factura. Las tarifas por millón de entrada y salida se aplican en local: (tokens / 1,000,000) × $/1M. Esta herramienta es un planificador indicativo, no una autoridad de facturación. Litigios → el panel de tu proveedor.

Entradas de tokens

Usa los campos numéricos cuando ya tengas recuentos de logs o de nuestro contador de tokens LLM. Opcionalmente pega un prompt en Monaco: los tokens de entrada se derivan por el mismo camino countTokensAsync que el contador (Exact para encodings OpenAI, Estimación para Claude/Gemini). Los tokens de salida no se derivan automáticamente en v1 — indícalos a mano cuando esperes tokens de completion.

Batch API y caché de prompt

Batch API (−50 %) aplica un descuento plano del 50 % sobre el subtotal — un sustituto simplificado v1 de los tramos de precios batch de los proveedores. Entrada en caché factura la porción cacheada al 10 % de la tarifa de entrada (90 % de ahorro en esa parte). Indica cuántos tokens de entrada esperas servir desde el caché de prompt en llamadas repetidas.

Privacidad

Todos los cálculos se ejecutan en tu navegador. FastMinify no llama a las API de precios de los proveedores, no hace scraping de tarifas en vivo ni sube tus prompts. La derivación de tokens usa la misma pila local de tokenizer/heurística que el contador.

Limitaciones

Solo USD en v1. Las tarifas cambian sin aviso en los sitios de los proveedores: verifica antes de un gasto grande. Los recuentos de entrada derivados en modelos de nivel Estimación son heurísticos (±5–15 %). Embeddings, imágenes y reglas de tokens de llamadas a herramientas quedan fuera del alcance.

Herramientas relacionadas del cluster

Cuenta tokens con el contador de tokens LLM, comprueba el ajuste de contexto con la calculadora de ventana de contexto o formatea el JSON de mensajes con el formateador JSON.

Opciones que cambian la estimación

Modelo
Cambia las tarifas por millón de entrada y salida de la tabla del registro. Los modelos sin precio de entrada aparecen como no disponibles en la vista comparativa.
Formato de entrada
Al derivar tokens de entrada desde texto pegado: la detección automática trata arrays válidos [{role, content}] como mensajes Chat API con sobrecarga por mensaje.
Batch API (−50 %)
Aplica un descuento plano del 50 % sobre el subtotal (USD de entrada + salida antes del descuento). Modelo simplificado v1 de los precios batch de los proveedores.
Tarifas personalizadas
Ignora la tabla del modelo y usa tus propios $/1M de entrada y salida: útil para acuerdos empresariales o endpoints privados.
Comparar todos los modelos
Lista cada modelo del registro con columnas Fresh, Cached, Output y Total USD para los mismos recuentos de tokens. Copia la tabla con campos de tokens y costes por modelo. Batch y opciones personalizadas se aplican de forma uniforme. Haz clic en una fila para seleccionar ese modelo.

FAQ

Estimaciones de precios, precisión e hipótesis

¿Coincidirá exactamente con mi factura?

Casi nunca al céntimo. Aplicamos las tarifas de lista publicadas de nuestra tabla; tu cuenta puede tener descuentos, matices de facturación de tokens en caché o precios regionales. Úsalo para planificar: concilia el gasto en el panel del proveedor.

¿Quién es elegible para precios Batch API?

Los proveedores ofrecen endpoints batch con procesamiento diferido y tarifas por token más bajas. El interruptor −50 % modela un descuento plano simplificado sobre el subtotal. Confirma la elegibilidad y las tarifas batch reales en el sitio del proveedor antes de usarlo para presupuestos.

¿Cómo se modela el caché de prompt?

Indica los tokens de entrada en caché por separado. Esa porción se factura al 10 % de la tarifa de entrada (90 % de ahorro frente a entrada sin caché). Las tasas reales de acierto de caché dependen de tu aplicación: es una palanca what-if, no una garantía del comportamiento del caché.

¿Cómo se calcula la proyección mensual?

Cuando las llamadas por día son mayores que cero: USD diario = total por llamada × llamadas por día; USD mensual = diario × 30. Es una extrapolación lineal a 30 días, sin ajuste de fin de semana ni estacionalidad.

¿Puedo comparar modelos por coste?

Sí: activa Comparar todos los modelos para ver el USD total de cada modelo del registro con los mismos recuentos de tokens y opciones. Haz clic en una fila para volver a la vista de un solo modelo con ese modelo seleccionado.

IA y LLM

Conteo de tokens, estimación de costes y ajuste a la ventana de contexto — 100 % en el navegador.

Explorar otras categorías de herramientas

Minificar

Reduce código y assets para producción — minifica JavaScript, CSS, HTML, JSON y XML antes de gzip o un despliegue CDN.

Embellecer

Haz el código legible con una indentación coherente — embellece JavaScript, CSS, TypeScript, SCSS, LESS, Markdown, GraphQL, SQL, YAML y más en tu navegador.

Desminificar

Expande código minificado o comprimido — desminifica JavaScript, CSS, TypeScript, SCSS, LESS, SQL, YAML y otros formatos al depurar o revisar.

Conversión

Transforma datos entre JSON, YAML, XML y CSV en local — sin subidas a un servidor.

Preprocesadores CSS

Compila SCSS o LESS a CSS estándar en el navegador — combínalo con embellecer o minificar para un flujo de hoja de estilos completo.

Herramientas JSON

Valida, formatea, compara y explora payloads JSON — complementarias a minificadores y convertidores.

Herramientas SVG

Previsualiza, optimiza con SVGO, exporta Data URI, redimensiona, embellece, convierte a JSX y valida SVG — todo en tu navegador.

DevOps e Infra

Formato, validación y minificación de Terraform HCL, formato y lint de Dockerfile, validación de Docker Compose y .env.

CI/CD

GitHub Actions y GitLab CI — formatear YAML y comprobar la estructura de workflows/jobs en el navegador.

Logs y observabilidad

JSON/NDJSON línea a línea y access logs de Nginx/Apache — formato, filtro, validación y CSV/TSV.

Kubernetes

Manifiestos multi-doc, validación estructural, starters Ingress/Deployment y formato de values de Helm.

Red / IP

CIDR, subredes y ayudas IPv4/IPv6 — en tu navegador.

Seguridad y tokens

JWKS, certificados X.509 y escaneo de secretos — en local en el navegador.

API y esquemas

Herramientas OpenAPI para formatear, validar y analizar tus specs.

Codificación

Codifica o decodifica Base64, componentes URL y entidades HTML — solo en el cliente.

Utilidades para desarrolladores

Timestamps, UUID, ULID, Nanoid, cron, contraseñas, regex, slugify, bases numéricas, mayúsculas, diff de texto y chmod — todo en el cliente.

Texto y Markdown

Cuenta palabras, genera TOC Markdown y limpia listas de líneas — todo en tu navegador.

Datos de prueba

Valores de campo sintéticos para fixtures y seed de BD — primero números de teléfono en rangos reservados.

Serialización

Serializa y deserializa estructuras PHP junto a los flujos JSON.