Calculadora de ventana de contexto — ajuste vs límite del modelo

Comprueba si tu prompt cabe en la ventana de contexto de cada modelo, con reserva configurable para la respuesta. Cuenta primero los tokens con el contador LLM, o consulta las estadísticas de texto antes de pegar.

Ajuste de contexto multi-modelo
Compara tu prompt con el límite de contexto de cada modelo del registro, con badges honestos Exact/Estimación y reserva de salida configurable.

Cómo se calcula el ajuste

Contamos tokens en local con el mismo pipeline que el contador de tokens LLM — js-tiktoken para modelos OpenAI, heurísticas para Claude y Gemini. Para cada modelo restamos tu reserva de salida (15 % por defecto) de la ventana de contexto publicada para obtener un presupuesto de entrada efectivo. Los tokens de tu prompt se comparan con ese presupuesto: • Safe — por debajo del 80 % del presupuesto efectivo • Near limit — 80 % o más pero aún cabe • Won't fit — los tokens del prompt superan el presupuesto efectivo

¿En qué se diferencia del medidor de contexto del contador de tokens?

El contador de tokens responde ¿cuántos tokens? y muestra una barra rápida de uso de un solo modelo. Esta herramienta responde ¿cabe? — compara todos los modelos con veredictos de ajuste y una reserva de salida configurable. Usa el contador para auditar totales y el desglose BPE; usa esta herramienta antes de elegir un modelo o recortar un prompt.

Privacidad

Todo el conteo se ejecuta en tu navegador. FastMinify nunca sube prompts a OpenAI, Anthropic, Google ni a ningún otro proveedor.

Limitaciones

Los conteos de nivel Estimación son orientativos (±5–15 % típico). Los límites de contexto salen de una tabla mantenida a mano: confirma los límites críticos en la documentación del proveedor. Para planificar costes en USD, usa la calculadora de precios LLM. Las reglas de tokens de imagen, audio y llamadas a herramientas quedan fuera del alcance de v1.

Opciones que cambian el ajuste

Reserva para la respuesta
Resta un porcentaje de la ventana de contexto de cada modelo antes de comparar tu prompt. Una reserva más alta endurece los veredictos de ajuste porque queda menos margen para tokens de entrada.
Formato de entrada
La detección automática trata un array válido [{role, content}] como mensajes Chat API con sobrecarga por mensaje. El texto bruto cuenta la cadena del editor de forma literal.
Forzar encoding
Solo para modelos OpenAI: fuerza o200k_base o cl100k_base al probar prompts antiguos contra encodings GPT anteriores.

FAQ

Ajuste de contexto, reserva y precisión

¿Qué significa la reserva de salida?

Retiene un porcentaje de la ventana de contexto para la respuesta del modelo. Si GPT-4o tiene 128k tokens y reservas un 15 %, tu presupuesto de entrada efectivo es 108,8k tokens: el resto es margen para el mensaje del asistente.

¿En qué se diferencia del medidor de contexto del contador de tokens?

El contador muestra una barra rápida de uso de un solo modelo mientras cuenta. Esta herramienta compara todos los modelos del registro con veredictos de ajuste y reserva configurable: úsala cuando la pregunta es si cabe, no cuántos tokens hay.

¿Por qué las filas de Claude aparecen como Estimación?

Anthropic no publica un tokenizer para el navegador. Usamos la misma heurística de caracteres por token que el contador y etiquetamos los resultados Estimación para no inducir a error.

¿Sale mi prompt del navegador?

No. Toda la tokenización y el cálculo de ajuste se ejecutan en local. FastMinify no llama a las API de los proveedores.

¿De dónde salen los límites de contexto?

De la misma tabla versionada llm-models.json que el contador y las herramientas de precios, revisada a mano.

IA y LLM

Conteo de tokens, estimación de costes y ajuste a la ventana de contexto — 100 % en el navegador.

Explorar otras categorías de herramientas

Minificar

Reduce código y assets para producción — minifica JavaScript, CSS, HTML, JSON y XML antes de gzip o un despliegue CDN.

Embellecer

Haz el código legible con una indentación coherente — embellece JavaScript, CSS, TypeScript, SCSS, LESS, Markdown, GraphQL, SQL, YAML y más en tu navegador.

Desminificar

Expande código minificado o comprimido — desminifica JavaScript, CSS, TypeScript, SCSS, LESS, SQL, YAML y otros formatos al depurar o revisar.

Conversión

Transforma datos entre JSON, YAML, XML y CSV en local — sin subidas a un servidor.

Preprocesadores CSS

Compila SCSS o LESS a CSS estándar en el navegador — combínalo con embellecer o minificar para un flujo de hoja de estilos completo.

Herramientas JSON

Valida, formatea, compara y explora payloads JSON — complementarias a minificadores y convertidores.

Herramientas SVG

Previsualiza, optimiza con SVGO, exporta Data URI, redimensiona, embellece, convierte a JSX y valida SVG — todo en tu navegador.

DevOps e Infra

Formato, validación y minificación de Terraform HCL, formato y lint de Dockerfile, validación de Docker Compose y .env.

CI/CD

GitHub Actions y GitLab CI — formatear YAML y comprobar la estructura de workflows/jobs en el navegador.

Logs y observabilidad

JSON/NDJSON línea a línea y access logs de Nginx/Apache — formato, filtro, validación y CSV/TSV.

Kubernetes

Manifiestos multi-doc, validación estructural, starters Ingress/Deployment y formato de values de Helm.

Red / IP

CIDR, subredes y ayudas IPv4/IPv6 — en tu navegador.

Seguridad y tokens

JWKS, certificados X.509 y escaneo de secretos — en local en el navegador.

API y esquemas

Herramientas OpenAPI para formatear, validar y analizar tus specs.

Codificación

Codifica o decodifica Base64, componentes URL y entidades HTML — solo en el cliente.

Utilidades para desarrolladores

Timestamps, UUID, ULID, Nanoid, cron, contraseñas, regex, slugify, bases numéricas, mayúsculas, diff de texto y chmod — todo en el cliente.

Texto y Markdown

Cuenta palabras, genera TOC Markdown y limpia listas de líneas — todo en tu navegador.

Datos de prueba

Valores de campo sintéticos para fixtures y seed de BD — primero números de teléfono en rangos reservados.

Serialización

Serializa y deserializa estructuras PHP junto a los flujos JSON.