LLM-Preisrechner — Token-Kostenschätzung

Schätzen Sie USD-Kosten pro Aufruf aus Eingabe- und Ausgabe-Tokens. Prompt einfügen für Live-Eingabe-Tokens oder Zahlen aus Logs eingeben. Batch-API, Prompt-Cache und Monatsprognose — alles im Browser.

LLM-Kostenschätzung lokal im Browser
Wandeln Sie Token-Zahlen in USD pro Aufruf mit unserer manuell gepflegten Modell-Tabelle — ohne Live-Scraping oder Anbieter-Abrechnungs-APIs.

Wie die Preise funktionieren

Tarife stammen aus einer manuell gepflegten Tabelle in llm-models.json, mindestens monatlich geprüft. Das Verifizierungsdatum auf dieser Seite ist die letzte Prüfung — nicht Ihre Rechnung. Pro-Million-Eingabe- und Ausgabetarife werden lokal angewendet: (Tokens / 1.000.000) × $/1M. Dieses Tool ist ein indikativer Planer, keine Abrechnungsinstanz. Streitfälle → Anbieter-Dashboard.

Token-Eingaben

Nutzen Sie die Zahlfelder, wenn Sie bereits Zähler aus Logs oder unserem LLM-Token-Zähler haben. Optional Prompt in Monaco einfügen — Eingabe-Tokens werden über denselben countTokensAsync-Pfad wie der Zähler abgeleitet (Exact für OpenAI, Estimate für Claude/Gemini). Ausgabe-Tokens werden in v1 nicht automatisch gesetzt — manuell eingeben bei erwarteter Completion.

Batch-API & Prompt-Cache

Batch-API (−50 %) wendet einen pauschalen 50 %-Rabatt auf die Zwischensumme an — vereinfachtes v1-Modell der Anbieter-Batch-Preise. Gecachte Eingabe wird mit 10 % des Eingabetarifs berechnet (90 % Ersparnis auf diesem Anteil). Tragen Sie ein, wie viele Eingabe-Tokens Sie bei wiederholten Aufrufen aus dem Prompt-Cache erwarten.

Datenschutz

Alle Berechnungen laufen im Browser. FastMinify ruft keine Anbieter-Preis-APIs auf, scraped keine Live-Tarife und lädt Ihre Prompts nicht hoch. Token-Ableitung nutzt dieselbe lokale Tokenizer/Heuristik-Stack wie der Zähler.

Einschränkungen

Nur USD in v1. Tarife ändern sich ohne Vorwarnung auf Anbieterseiten — vor großen Budgets prüfen. Abgeleitete Eingabe auf Estimate-Modellen ist heuristisch (±5–15 %). Embeddings, Bilder und Tool-Call-Regeln außerhalb des Scope.

Verwandte Cluster-Tools

Tokens zählen mit dem LLM-Token-Zähler, Kontext prüfen mit dem Context-Window-Rechner, oder Message-JSON mit dem JSON-Formatter formatieren.

Optionen, die die Schätzung ändern

Modell
Wechselt $/1M-Eingabe- und Ausgabetarife aus der Registry. Modelle ohne Eingabepreis zeigen in der Vergleichsansicht „nicht verfügbar“.
Eingabeformat
Bei Ableitung aus eingefügtem Text: Auto-Erkennung behandelt gültige [{role, content}]-Arrays als Chat-API-Messages mit Overhead pro Message.
Batch-API (−50 %)
Wendet einen pauschalen 50 %-Rabatt auf die Zwischensumme an (USD Eingabe + Ausgabe vor Rabatt). Vereinfachtes v1-Modell der Anbieter-Batch-Preise.
Eigene Tarife
Ignoriert die Modell-Tabelle und nutzt eigene $/1M für Eingabe und Ausgabe — nützlich für Enterprise-Deals oder private Endpoints.
Alle Modelle vergleichen
Listet jedes Registry-Modell mit Spalten Fresh, Cached, Output und Total USD für gleiche Token-Zahlen. Tabelle mit Token-Feldern und Modellkosten kopierbar. Batch und eigene Tarife gelten uniform. Zeile klicken zum Auswählen des Modells.

FAQ

Schätzungen, Genauigkeit und Annahmen

Stimmt das exakt mit meiner Rechnung?

Selten bis auf den Cent. Wir wenden Listenpreise aus unserer Tabelle an; Ihr Konto kann Rabatte, Cache-Abrechnungsdetails oder regionale Preise haben. Nutzen Sie dies für Planung — Abgleich im Anbieter-Dashboard.

Wer qualifiziert für Batch-API-Preise?

Anbieter bieten Batch-Endpunkte mit verzögerter Verarbeitung und niedrigeren Token-Preisen. Der −50 %-Schalter modelliert einen pauschalen Rabatt auf die Zwischensumme. Eligibility und echte Batch-Tarife auf der Anbieterseite prüfen.

Wie wird Prompt-Caching modelliert?

Gecachte Eingabe-Tokens separat eingeben. Dieser Anteil wird mit 10 % des Eingabetarifs berechnet (90 % Ersparnis vs. nicht gecacht). Echte Cache-Hit-Raten hängen von Ihrer App ab.

Wie wird die Monatsprognose berechnet?

Bei Aufrufen/Tag > 0: USD/Tag = Gesamt pro Aufruf × Aufrufe/Tag; USD/Monat = täglich × 30. Gerade 30-Tage-Extrapolation ohne Wochenend- oder Saisonalitätskorrektur.

Kann ich Modelle nach Kosten vergleichen?

Ja — „Alle Modelle vergleichen“ zeigt Gesamt-USD für jedes Registry-Modell mit gleichen Tokens und Optionen. Zeile klicken für Einzelmodell-Ansicht mit gewähltem Modell.

KI & LLM

Token-Zählung, Kostenschätzung und Kontextfenster — 100 % im Browser.

Weitere Werkzeugkategorien entdecken

Minimieren

Verkleinern Sie Code und Ressourcen für die Produktion – minimieren Sie JavaScript, CSS, HTML, JSON und XML vor der Bereitstellung von gzip oder CDN.

Aufheben

Erweitern Sie minimierten oder komprimierten Code – entminifizieren Sie JavaScript, CSS, TypeScript, SCSS, LESS, SQL, YAML und andere Formate beim Debuggen oder Überprüfen.

Konvertierung

Transformieren Sie Daten zwischen JSON, YAML, XML und CSV lokal – keine Server-Uploads.

Codierung

Kodieren oder dekodieren Sie Base64-, URL-Komponenten und HTML-Entitäten – nur clientseitig.

Serialisierung

Serialisieren und deserialisieren Sie PHP-Datenstrukturen neben JSON-Workflows.

JSON Werkzeuge

Validieren, formatieren, vergleichen und erkunden Sie JSON-Nutzlasten – ergänzend zu Minifiern und Konvertern.

SVG Werkzeuge

Vorschau anzeigen, mit SVGO optimieren, Daten exportieren URI, Größe ändern, verschönern, in JSX konvertieren und SVG validieren – alles in Ihrem Browser.

Verschönern

Machen Sie Code mit konsistenter Einrückung lesbar – verschönern Sie JavaScript, CSS, TypeScript, SCSS, LESS, Markdown, GraphQL, SQL, YAML und mehr in Ihrem Browser.

CSS-Präprozessoren

Kompilieren Sie SCSS oder LESS zu Standard-CSS im Browser — kombinieren Sie mit Beautify oder Minify für einen vollständigen Stylesheet-Workflow.

Farb- & CSS-Tools

Lokal eingefügte WCAG-Kontrastprüfung mit moderner CSS-Farbsyntax — Paar- und Matrixansicht, nie hochgeladen.

DevOps und Infrastruktur

Terraform HCL formatieren/validieren/minimieren, Dockerfile formatieren und lint, Docker Verfassen und .env-Validierung.

CI/CD

GitHub Aktionen und GitLab CI – formatieren Sie YAML und überprüfen Sie die Workflow-/Auftragsstruktur in Ihrem Browser.

Protokolle und Beobachtbarkeit

Zeilenorientierte JSON/NDJSON- und Nginx/Apache-Zugriffsprotokolle – formatieren, filtern, validieren und CSV/TSV.

Kubernetes

Multi-Doc-Manifeste, strukturelle Validierung, Ingress/Deployment-Starter und Helm-Werteformatierung.

Netzwerk / IP

CIDR, Subnetze und IPv4/IPv6-Helfer — im Browser.

Sicherheit und Token

JWKS, X.509-Zertifikate und Secrets-Scan – browserlokal.

API & Schemata

OpenAPI Tools zum Formatieren, Validieren und Flusen Ihrer Spezifikationen.

HTTP-Tools

cURL, HTTP-Nachrichten, URLs, HAR und Cookie/Set-Cookie lokal einfügen — formatieren und prüfen, nie gesendet.

Entwickler-Dienstprogramme

Zeitstempel, UUID, ULID, Nanoid, Cron, Passwörter, Regex, Slugify, Zahlenbasen, Groß-/Kleinschreibung, Textunterschied und chmod – alles clientseitig.

Text & Markdown

Wörter zählen, Markdown-TOC erzeugen und Zeilenlisten bereinigen — im Browser.

Testdaten

Synthetische Feldwerte für Fixtures und DB-Seed — zuerst reservierte Telefonnummern.