Calculadora de precios LLM — estimación del costo de tokens
Estima el costo en USD por llamada a partir de los tokens de entrada y de salida. Pega un prompt para derivar los tokens de entrada en vivo, o introduce totales desde los logs. Batch API, caché de prompt y proyección mensual — íntegramente en el navegador.
Cómo funcionan los precios
Las tarifas salen de una tabla mantenida a mano en llm-models.json, revisada al menos una vez al mes. La fecha verificada de esta página refleja la última revisión — no tu factura.
Las tarifas por millón de entrada y salida se aplican en local: (tokens / 1,000,000) × $/1M. Esta herramienta es un planificador indicativo, no una autoridad de facturación. Litigios → el panel de tu proveedor.
Entradas de tokens
Usa los campos numéricos cuando ya tengas recuentos de logs o de nuestro contador de tokens LLM. Opcionalmente pega un prompt en Monaco: los tokens de entrada se derivan por el mismo camino countTokensAsync que el contador (Exact para encodings OpenAI, Estimación para Claude/Gemini).
Los tokens de salida no se derivan automáticamente en v1 — indícalos a mano cuando esperes tokens de completion.
Batch API y caché de prompt
Batch API (−50 %) aplica un descuento plano del 50 % sobre el subtotal — un sustituto simplificado v1 de los tramos de precios batch de los proveedores. Entrada en caché factura la porción cacheada al 10 % de la tarifa de entrada (90 % de ahorro en esa parte). Indica cuántos tokens de entrada esperas servir desde el caché de prompt en llamadas repetidas.
Privacidad
Todos los cálculos se ejecutan en tu navegador. FastMinify no llama a las API de precios de los proveedores, no hace scraping de tarifas en vivo ni sube tus prompts. La derivación de tokens usa la misma pila local de tokenizer/heurística que el contador.
Limitaciones
Solo USD en v1. Las tarifas cambian sin aviso en los sitios de los proveedores: verifica antes de un gasto grande. Los recuentos de entrada derivados en modelos de nivel Estimación son heurísticos (±5–15 %). Embeddings, imágenes y reglas de tokens de llamadas a herramientas quedan fuera del alcance.
Herramientas relacionadas del cluster
Cuenta tokens con el contador de tokens LLM, comprueba el ajuste de contexto con la calculadora de ventana de contexto o formatea el JSON de mensajes con el formateador JSON.
Opciones que cambian la estimación
FAQ
Estimaciones de precios, precisión e hipótesis
¿Coincidirá exactamente con mi factura?
Casi nunca al céntimo. Aplicamos las tarifas de lista publicadas de nuestra tabla; tu cuenta puede tener descuentos, matices de facturación de tokens en caché o precios regionales. Úsalo para planificar: concilia el gasto en el panel del proveedor.
¿Quién es elegible para precios Batch API?
Los proveedores ofrecen endpoints batch con procesamiento diferido y tarifas por token más bajas. El interruptor −50 % modela un descuento plano simplificado sobre el subtotal. Confirma la elegibilidad y las tarifas batch reales en el sitio del proveedor antes de usarlo para presupuestos.
¿Cómo se modela el caché de prompt?
Indica los tokens de entrada en caché por separado. Esa porción se factura al 10 % de la tarifa de entrada (90 % de ahorro frente a entrada sin caché). Las tasas reales de acierto de caché dependen de tu aplicación: es una palanca what-if, no una garantía del comportamiento del caché.
¿Cómo se calcula la proyección mensual?
Cuando las llamadas por día son mayores que cero: USD diario = total por llamada × llamadas por día; USD mensual = diario × 30. Es una extrapolación lineal a 30 días, sin ajuste de fin de semana ni estacionalidad.
¿Puedo comparar modelos por coste?
Sí: activa Comparar todos los modelos para ver el USD total de cada modelo del registro con los mismos recuentos de tokens y opciones. Haz clic en una fila para volver a la vista de un solo modelo con ese modelo seleccionado.
IA y LLM
Conteo de tokens, estimación de costes y ajuste a la ventana de contexto — 100 % en el navegador.
Explorar otras categorías de herramientas
Minificar
Reduce código y assets para producción — minifica JavaScript, CSS, HTML, JSON y XML antes de gzip o un despliegue CDN.
Embellecer
Haz el código legible con una indentación coherente — embellece JavaScript, CSS, TypeScript, SCSS, LESS, Markdown, GraphQL, SQL, YAML y más en tu navegador.
Desminificar
Expande código minificado o comprimido — desminifica JavaScript, CSS, TypeScript, SCSS, LESS, SQL, YAML y otros formatos al depurar o revisar.
Conversión
Transforma datos entre JSON, YAML, XML y CSV en local — sin subidas a un servidor.
Preprocesadores CSS
Compila SCSS o LESS a CSS estándar en el navegador — combínalo con embellecer o minificar para un flujo de hoja de estilos completo.
Herramientas JSON
Valida, formatea, compara y explora payloads JSON — complementarias a minificadores y convertidores.
Herramientas SVG
Previsualiza, optimiza con SVGO, exporta Data URI, redimensiona, embellece, convierte a JSX y valida SVG — todo en tu navegador.
DevOps e Infra
Formato, validación y minificación de Terraform HCL, formato y lint de Dockerfile, validación de Docker Compose y .env.
CI/CD
GitHub Actions y GitLab CI — formatear YAML y comprobar la estructura de workflows/jobs en el navegador.
Logs y observabilidad
JSON/NDJSON línea a línea y access logs de Nginx/Apache — formato, filtro, validación y CSV/TSV.
Kubernetes
Manifiestos multi-doc, validación estructural, starters Ingress/Deployment y formato de values de Helm.
Red / IP
CIDR, subredes y ayudas IPv4/IPv6 — en tu navegador.
Seguridad y tokens
JWKS, certificados X.509 y escaneo de secretos — en local en el navegador.
API y esquemas
Herramientas OpenAPI para formatear, validar y analizar tus specs.
Codificación
Codifica o decodifica Base64, componentes URL y entidades HTML — solo en el cliente.
Utilidades para desarrolladores
Timestamps, UUID, ULID, Nanoid, cron, contraseñas, regex, slugify, bases numéricas, mayúsculas, diff de texto y chmod — todo en el cliente.
Texto y Markdown
Cuenta palabras, genera TOC Markdown y limpia listas de líneas — todo en tu navegador.
Datos de prueba
Valores de campo sintéticos para fixtures y seed de BD — primero números de teléfono en rangos reservados.
Serialización
Serializa y deserializa estructuras PHP junto a los flujos JSON.