Calculateur de prix LLM — estimation du coût des tokens

Estimez le coût USD par appel depuis les tokens d'entrée et de sortie. Collez un prompt pour dériver les tokens d'entrée en direct, ou saisissez des totaux issus des logs. Batch API, cache de prompt et projection mensuelle — entièrement dans le navigateur.

Estimation de coût LLM en local
Convertissez des nombres de tokens en USD par appel via notre table de tarifs maintenue manuellement — sans scraping ni API de facturation fournisseur.

Comment fonctionne la tarification

Les tarifs proviennent d'une table maintenue manuellement dans llm-models.json, revue au moins chaque mois. La date vérifiée sur cette page reflète la dernière revue — pas votre facture. Les taux par million d'entrée et de sortie sont appliqués localement : (tokens / 1 000 000) × $/1M. Cet outil est un planificateur indicatif, pas une autorité de facturation. Litiges → tableau de bord fournisseur.

Entrées tokens

Utilisez les champs numériques si vous avez déjà des totaux (logs ou compteur de tokens LLM). Vous pouvez aussi coller un prompt dans Monaco — les tokens d'entrée sont dérivés via le même chemin countTokensAsync que le compteur (Exact pour OpenAI, Estimate pour Claude/Gemini). Les tokens de sortie ne sont pas auto-remplis en v1 — saisissez-les si vous attendez une complétion.

Batch API et cache de prompt

Batch API (−50 %) applique une remise plate de 50 % sur le sous-total — approximation v1 des grilles batch des fournisseurs. Entrée en cache : la portion cachée est facturée à 10 % du taux d'entrée (90 % d'économie sur cette tranche). Indiquez combien de tokens d'entrée vous attendez depuis le cache de prompt sur les appels répétés.

Confidentialité

Tous les calculs s'exécutent dans votre navigateur. FastMinify n'appelle pas les API de tarification fournisseur, ne scrape pas les tarifs en direct et ne transmet pas vos prompts. La dérivation de tokens utilise la même pile locale que le compteur.

Limites

USD uniquement en v1. Les tarifs changent sans préavis sur les sites fournisseurs — vérifiez avant un gros budget. Les dérivations sur modèles Estimate sont heuristiques (±5–15 %). Embeddings, images et règles tool-call hors scope.

Outils du cluster

Comptez avec le compteur de tokens LLM, vérifiez le contexte avec le calculateur de fenêtre de contexte, ou formatez le JSON avec le formateur JSON.

Options qui modifient l'estimation

Modèle
Change les tarifs $/1M entrée et sortie depuis le registre. Les modèles sans prix d'entrée affichent indisponible en mode comparatif.
Format d'entrée
Pour dériver les tokens depuis le texte collé : l'auto-détection traite les tableaux [{role, content}] valides comme messages Chat API avec overhead par message.
Batch API (−50 %)
Applique une remise plate de 50 % sur le sous-total (USD entrée + sortie avant remise). Modèle simplifié v1 du pricing batch fournisseur.
Tarifs personnalisés
Ignore la table du modèle et utilise vos propres $/1M entrée et sortie — utile pour accords entreprise ou endpoints privés.
Comparer tous les modèles
Liste chaque modèle du registre avec colonnes Fresh, Cached, Output et Total USD pour les mêmes tokens. Copie du tableau avec champs tokens et coûts par modèle. Batch et tarifs perso s'appliquent uniformément. Cliquez une ligne pour sélectionner le modèle.

FAQ

Estimations, précision et hypothèses

Correspondra-t-ce exactement à ma facture ?

Rarement au centime. Nous appliquons les tarifs liste de notre table ; votre compte peut avoir des remises, des nuances de cache ou des prix régionaux. Utilisez cet outil pour planifier — réconciliez sur le tableau de bord fournisseur.

Qui est éligible au Batch API ?

Les fournisseurs proposent des endpoints batch avec traitement différé et tarifs réduits. Le toggle −50 % modélise une remise plate sur le sous-total. Vérifiez l'éligibilité et les tarifs réels sur le site du fournisseur.

Comment le cache de prompt est modélisé ?

Saisissez les tokens d'entrée en cache séparément. Cette tranche est facturée à 10 % du taux d'entrée (90 % d'économie vs entrée non cachée). Les taux de hit réels dépendent de votre application.

Comment est calculée la projection mensuelle ?

Si appels/jour > 0 : USD/jour = total par appel × appels/jour ; USD/mois = journalier × 30. Extrapolation simple sur 30 jours, sans week-end ni saisonnalité.

Peut-on comparer les modèles par coût ?

Oui — activez Comparer tous les modèles pour voir le total USD de chaque entrée du registre avec les mêmes tokens et options. Cliquez une ligne pour revenir au mode modèle unique.

IA & LLM

Comptage de tokens, estimation des coûts et fenêtre de contexte — 100 % local.

Découvrez les autres catégories d'outils

Minifier

Réduisez code et assets pour la production — minifiez JS, CSS, HTML, JSON, XML et SVG avant gzip ou déploiement CDN.

Déminifier

Développez du code minifié ou compressé — déminifiez JavaScript, CSS, TypeScript, SCSS, LESS, SQL, YAML et d'autres formats pour déboguer ou relire.

Conversion

Transformez des données entre JSON, YAML, XML et CSV localement — sans envoi serveur.

Encodage

Encodez ou décodez Base64, composants URL et entités HTML — uniquement côté client.

Sérialisation

Sérialisez et désérialisez des structures PHP à côté de vos flux JSON.

Outils JSON

Validez, formatez, comparez et explorez des payloads JSON — complémentaires aux minificateurs et convertisseurs.

Outils SVG

Prévisualisez, optimisez avec SVGO, exportez en Data URI, redimensionnez, formatez, convertissez en JSX et validez vos SVG — tout dans le navigateur.

Beautifier

Rendez le code lisible avec une indentation cohérente — beautifiez JavaScript, CSS, TypeScript, SCSS, LESS, Markdown, GraphQL, SQL, YAML et plus encore dans votre navigateur.

Préprocesseurs CSS

Compilez SCSS ou LESS en CSS standard dans le navigateur — complétez avec beautify ou minify pour un workflow feuille de style complet.

Outils couleur & CSS

Vérification de contraste WCAG en collage local avec syntaxe couleur CSS moderne — vues paire et matrice, jamais envoyé.

DevOps & Infra

Format/validate/minify HCL, format & lint Dockerfile, validation Compose et .env.

CI/CD

GitHub Actions et GitLab CI — formater le YAML et vérifier la structure des workflows/jobs dans le navigateur.

Logs & observabilité

JSON/NDJSON ligne à ligne et access logs Nginx/Apache — format, filtre, validation et CSV/TSV.

Kubernetes

Manifestes multi-docs, validation structurelle, starters Ingress/Deployment et formatage values Helm.

Réseau / IP

CIDR, sous-réseaux et helpers IPv4/IPv6 — dans le navigateur.

Sécurité & tokens

JWKS, certificats X.509 et scan de secrets — locaux navigateur.

API & schémas

Outils OpenAPI pour formater, valider et analyser vos specs.

Outils HTTP

cURL, messages HTTP, URLs, HAR et Cookie / Set-Cookie collés dans le navigateur — formater et inspecter, jamais envoyé.

Utilitaires développeur

Timestamps, UUID, ULID, Nanoid, cron, mots de passe, regex, slugify, bases, casse, diff texte et chmod — tout côté client.

Texte & Markdown

Comptez, générez un sommaire Markdown et nettoyez des listes de lignes — dans le navigateur.

Données de test

Valeurs de champs synthétiques pour fixtures et seed DB — d'abord des numéros de téléphone en plages réservées.