LLM-Preisrechner — Token-Kostenschätzung
Schätzen Sie USD-Kosten pro Aufruf aus Eingabe- und Ausgabe-Tokens. Prompt einfügen für Live-Eingabe-Tokens oder Zahlen aus Logs eingeben. Batch-API, Prompt-Cache und Monatsprognose — alles im Browser.
Wie die Preise funktionieren
Tarife stammen aus einer manuell gepflegten Tabelle in llm-models.json, mindestens monatlich geprüft. Das Verifizierungsdatum auf dieser Seite ist die letzte Prüfung — nicht Ihre Rechnung.
Pro-Million-Eingabe- und Ausgabetarife werden lokal angewendet: (Tokens / 1.000.000) × $/1M. Dieses Tool ist ein indikativer Planer, keine Abrechnungsinstanz. Streitfälle → Anbieter-Dashboard.
Token-Eingaben
Nutzen Sie die Zahlfelder, wenn Sie bereits Zähler aus Logs oder unserem LLM-Token-Zähler haben. Optional Prompt in Monaco einfügen — Eingabe-Tokens werden über denselben countTokensAsync-Pfad wie der Zähler abgeleitet (Exact für OpenAI, Estimate für Claude/Gemini).
Ausgabe-Tokens werden in v1 nicht automatisch gesetzt — manuell eingeben bei erwarteter Completion.
Batch-API & Prompt-Cache
Batch-API (−50 %) wendet einen pauschalen 50 %-Rabatt auf die Zwischensumme an — vereinfachtes v1-Modell der Anbieter-Batch-Preise. Gecachte Eingabe wird mit 10 % des Eingabetarifs berechnet (90 % Ersparnis auf diesem Anteil). Tragen Sie ein, wie viele Eingabe-Tokens Sie bei wiederholten Aufrufen aus dem Prompt-Cache erwarten.
Datenschutz
Alle Berechnungen laufen im Browser. FastMinify ruft keine Anbieter-Preis-APIs auf, scraped keine Live-Tarife und lädt Ihre Prompts nicht hoch. Token-Ableitung nutzt dieselbe lokale Tokenizer/Heuristik-Stack wie der Zähler.
Einschränkungen
Nur USD in v1. Tarife ändern sich ohne Vorwarnung auf Anbieterseiten — vor großen Budgets prüfen. Abgeleitete Eingabe auf Estimate-Modellen ist heuristisch (±5–15 %). Embeddings, Bilder und Tool-Call-Regeln außerhalb des Scope.
Verwandte Cluster-Tools
Tokens zählen mit dem LLM-Token-Zähler, Kontext prüfen mit dem Context-Window-Rechner, oder Message-JSON mit dem JSON-Formatter formatieren.
Optionen, die die Schätzung ändern
FAQ
Schätzungen, Genauigkeit und Annahmen
Stimmt das exakt mit meiner Rechnung?
Selten bis auf den Cent. Wir wenden Listenpreise aus unserer Tabelle an; Ihr Konto kann Rabatte, Cache-Abrechnungsdetails oder regionale Preise haben. Nutzen Sie dies für Planung — Abgleich im Anbieter-Dashboard.
Wer qualifiziert für Batch-API-Preise?
Anbieter bieten Batch-Endpunkte mit verzögerter Verarbeitung und niedrigeren Token-Preisen. Der −50 %-Schalter modelliert einen pauschalen Rabatt auf die Zwischensumme. Eligibility und echte Batch-Tarife auf der Anbieterseite prüfen.
Wie wird Prompt-Caching modelliert?
Gecachte Eingabe-Tokens separat eingeben. Dieser Anteil wird mit 10 % des Eingabetarifs berechnet (90 % Ersparnis vs. nicht gecacht). Echte Cache-Hit-Raten hängen von Ihrer App ab.
Wie wird die Monatsprognose berechnet?
Bei Aufrufen/Tag > 0: USD/Tag = Gesamt pro Aufruf × Aufrufe/Tag; USD/Monat = täglich × 30. Gerade 30-Tage-Extrapolation ohne Wochenend- oder Saisonalitätskorrektur.
Kann ich Modelle nach Kosten vergleichen?
Ja — „Alle Modelle vergleichen“ zeigt Gesamt-USD für jedes Registry-Modell mit gleichen Tokens und Optionen. Zeile klicken für Einzelmodell-Ansicht mit gewähltem Modell.
KI & LLM
Token-Zählung, Kostenschätzung und Kontextfenster — 100 % im Browser.
Weitere Werkzeugkategorien entdecken
Minimieren
Verkleinern Sie Code und Ressourcen für die Produktion – minimieren Sie JavaScript, CSS, HTML, JSON und XML vor der Bereitstellung von gzip oder CDN.
Aufheben
Erweitern Sie minimierten oder komprimierten Code – entminifizieren Sie JavaScript, CSS, TypeScript, SCSS, LESS, SQL, YAML und andere Formate beim Debuggen oder Überprüfen.
Konvertierung
Transformieren Sie Daten zwischen JSON, YAML, XML und CSV lokal – keine Server-Uploads.
Codierung
Kodieren oder dekodieren Sie Base64-, URL-Komponenten und HTML-Entitäten – nur clientseitig.
Serialisierung
Serialisieren und deserialisieren Sie PHP-Datenstrukturen neben JSON-Workflows.
JSON Werkzeuge
Validieren, formatieren, vergleichen und erkunden Sie JSON-Nutzlasten – ergänzend zu Minifiern und Konvertern.
SVG Werkzeuge
Vorschau anzeigen, mit SVGO optimieren, Daten exportieren URI, Größe ändern, verschönern, in JSX konvertieren und SVG validieren – alles in Ihrem Browser.
Verschönern
Machen Sie Code mit konsistenter Einrückung lesbar – verschönern Sie JavaScript, CSS, TypeScript, SCSS, LESS, Markdown, GraphQL, SQL, YAML und mehr in Ihrem Browser.
CSS-Präprozessoren
Kompilieren Sie SCSS oder LESS zu Standard-CSS im Browser — kombinieren Sie mit Beautify oder Minify für einen vollständigen Stylesheet-Workflow.
Farb- & CSS-Tools
Lokal eingefügte WCAG-Kontrastprüfung mit moderner CSS-Farbsyntax — Paar- und Matrixansicht, nie hochgeladen.
DevOps und Infrastruktur
Terraform HCL formatieren/validieren/minimieren, Dockerfile formatieren und lint, Docker Verfassen und .env-Validierung.
CI/CD
GitHub Aktionen und GitLab CI – formatieren Sie YAML und überprüfen Sie die Workflow-/Auftragsstruktur in Ihrem Browser.
Protokolle und Beobachtbarkeit
Zeilenorientierte JSON/NDJSON- und Nginx/Apache-Zugriffsprotokolle – formatieren, filtern, validieren und CSV/TSV.
Kubernetes
Multi-Doc-Manifeste, strukturelle Validierung, Ingress/Deployment-Starter und Helm-Werteformatierung.
Netzwerk / IP
CIDR, Subnetze und IPv4/IPv6-Helfer — im Browser.
Sicherheit und Token
JWKS, X.509-Zertifikate und Secrets-Scan – browserlokal.
API & Schemata
OpenAPI Tools zum Formatieren, Validieren und Flusen Ihrer Spezifikationen.
HTTP-Tools
cURL, HTTP-Nachrichten, URLs, HAR und Cookie/Set-Cookie lokal einfügen — formatieren und prüfen, nie gesendet.
Entwickler-Dienstprogramme
Zeitstempel, UUID, ULID, Nanoid, Cron, Passwörter, Regex, Slugify, Zahlenbasen, Groß-/Kleinschreibung, Textunterschied und chmod – alles clientseitig.
Text & Markdown
Wörter zählen, Markdown-TOC erzeugen und Zeilenlisten bereinigen — im Browser.
Testdaten
Synthetische Feldwerte für Fixtures und DB-Seed — zuerst reservierte Telefonnummern.