Calculateur de prix LLM — estimation du coût des tokens
Estimez le coût USD par appel depuis les tokens d'entrée et de sortie. Collez un prompt pour dériver les tokens d'entrée en direct, ou saisissez des totaux issus des logs. Batch API, cache de prompt et projection mensuelle — entièrement dans le navigateur.
Comment fonctionne la tarification
Les tarifs proviennent d'une table maintenue manuellement dans llm-models.json, revue au moins chaque mois. La date vérifiée sur cette page reflète la dernière revue — pas votre facture.
Les taux par million d'entrée et de sortie sont appliqués localement : (tokens / 1 000 000) × $/1M. Cet outil est un planificateur indicatif, pas une autorité de facturation. Litiges → tableau de bord fournisseur.
Entrées tokens
Utilisez les champs numériques si vous avez déjà des totaux (logs ou compteur de tokens LLM). Vous pouvez aussi coller un prompt dans Monaco — les tokens d'entrée sont dérivés via le même chemin countTokensAsync que le compteur (Exact pour OpenAI, Estimate pour Claude/Gemini).
Les tokens de sortie ne sont pas auto-remplis en v1 — saisissez-les si vous attendez une complétion.
Batch API et cache de prompt
Batch API (−50 %) applique une remise plate de 50 % sur le sous-total — approximation v1 des grilles batch des fournisseurs. Entrée en cache : la portion cachée est facturée à 10 % du taux d'entrée (90 % d'économie sur cette tranche). Indiquez combien de tokens d'entrée vous attendez depuis le cache de prompt sur les appels répétés.
Confidentialité
Tous les calculs s'exécutent dans votre navigateur. FastMinify n'appelle pas les API de tarification fournisseur, ne scrape pas les tarifs en direct et ne transmet pas vos prompts. La dérivation de tokens utilise la même pile locale que le compteur.
Limites
USD uniquement en v1. Les tarifs changent sans préavis sur les sites fournisseurs — vérifiez avant un gros budget. Les dérivations sur modèles Estimate sont heuristiques (±5–15 %). Embeddings, images et règles tool-call hors scope.
Outils du cluster
Comptez avec le compteur de tokens LLM, vérifiez le contexte avec le calculateur de fenêtre de contexte, ou formatez le JSON avec le formateur JSON.
Options qui modifient l'estimation
FAQ
Estimations, précision et hypothèses
Correspondra-t-ce exactement à ma facture ?
Rarement au centime. Nous appliquons les tarifs liste de notre table ; votre compte peut avoir des remises, des nuances de cache ou des prix régionaux. Utilisez cet outil pour planifier — réconciliez sur le tableau de bord fournisseur.
Qui est éligible au Batch API ?
Les fournisseurs proposent des endpoints batch avec traitement différé et tarifs réduits. Le toggle −50 % modélise une remise plate sur le sous-total. Vérifiez l'éligibilité et les tarifs réels sur le site du fournisseur.
Comment le cache de prompt est modélisé ?
Saisissez les tokens d'entrée en cache séparément. Cette tranche est facturée à 10 % du taux d'entrée (90 % d'économie vs entrée non cachée). Les taux de hit réels dépendent de votre application.
Comment est calculée la projection mensuelle ?
Si appels/jour > 0 : USD/jour = total par appel × appels/jour ; USD/mois = journalier × 30. Extrapolation simple sur 30 jours, sans week-end ni saisonnalité.
Peut-on comparer les modèles par coût ?
Oui — activez Comparer tous les modèles pour voir le total USD de chaque entrée du registre avec les mêmes tokens et options. Cliquez une ligne pour revenir au mode modèle unique.
IA & LLM
Comptage de tokens, estimation des coûts et fenêtre de contexte — 100 % local.
Découvrez les autres catégories d'outils
Minifier
Réduisez code et assets pour la production — minifiez JS, CSS, HTML, JSON, XML et SVG avant gzip ou déploiement CDN.
Déminifier
Développez du code minifié ou compressé — déminifiez JavaScript, CSS, TypeScript, SCSS, LESS, SQL, YAML et d'autres formats pour déboguer ou relire.
Conversion
Transformez des données entre JSON, YAML, XML et CSV localement — sans envoi serveur.
Encodage
Encodez ou décodez Base64, composants URL et entités HTML — uniquement côté client.
Sérialisation
Sérialisez et désérialisez des structures PHP à côté de vos flux JSON.
Outils JSON
Validez, formatez, comparez et explorez des payloads JSON — complémentaires aux minificateurs et convertisseurs.
Outils SVG
Prévisualisez, optimisez avec SVGO, exportez en Data URI, redimensionnez, formatez, convertissez en JSX et validez vos SVG — tout dans le navigateur.
Beautifier
Rendez le code lisible avec une indentation cohérente — beautifiez JavaScript, CSS, TypeScript, SCSS, LESS, Markdown, GraphQL, SQL, YAML et plus encore dans votre navigateur.
Préprocesseurs CSS
Compilez SCSS ou LESS en CSS standard dans le navigateur — complétez avec beautify ou minify pour un workflow feuille de style complet.
Outils couleur & CSS
Vérification de contraste WCAG en collage local avec syntaxe couleur CSS moderne — vues paire et matrice, jamais envoyé.
DevOps & Infra
Format/validate/minify HCL, format & lint Dockerfile, validation Compose et .env.
CI/CD
GitHub Actions et GitLab CI — formater le YAML et vérifier la structure des workflows/jobs dans le navigateur.
Logs & observabilité
JSON/NDJSON ligne à ligne et access logs Nginx/Apache — format, filtre, validation et CSV/TSV.
Kubernetes
Manifestes multi-docs, validation structurelle, starters Ingress/Deployment et formatage values Helm.
Réseau / IP
CIDR, sous-réseaux et helpers IPv4/IPv6 — dans le navigateur.
Sécurité & tokens
JWKS, certificats X.509 et scan de secrets — locaux navigateur.
API & schémas
Outils OpenAPI pour formater, valider et analyser vos specs.
Outils HTTP
cURL, messages HTTP, URLs, HAR et Cookie / Set-Cookie collés dans le navigateur — formater et inspecter, jamais envoyé.
Utilitaires développeur
Timestamps, UUID, ULID, Nanoid, cron, mots de passe, regex, slugify, bases, casse, diff texte et chmod — tout côté client.
Texte & Markdown
Comptez, générez un sommaire Markdown et nettoyez des listes de lignes — dans le navigateur.
Données de test
Valeurs de champs synthétiques pour fixtures et seed DB — d'abord des numéros de téléphone en plages réservées.