Entwicklerwerkzeuge

LLM-Kostenrechner: API-Preise für Claude, GPT-4o & mehr

🔒 Läuft in deinem Browser

Berechne und vergleiche die API-Kosten großer Sprachmodelle, indem du Eingabe- und Ausgabe-Tokens eingibst. Du siehst die genauen Kosten je Aufruf für acht Modelle. Alles läuft vollständig in deinem Browser, und deine Token-Zahlen verlassen dein Gerät nie.

So verwendest du dieses Werkzeug

  1. Wähle dein Modell und den Preistier aus dem Dropdown-Menü aus.
  2. Gib deine geschätzte Anzahl an Eingabe- und Ausgabe-Tokens ein.
  3. Sieh die berechnete Kostenaufschlüsselung für deinen API-Aufruf.
Input cost
$0.03
Output cost
$0.02
Total cost
$0.04

Model comparison (same token counts, sorted by cost)

ModelProviderInput costOutput costTotal
GPT-4o miniOpenAI$0.0015$0.0012$0.0027
Gemini 2.5 FlashGoogle$0.0015$0.0012$0.0027
Llama 3.3 70B (Groq)Groq$0.0059$0.0016$0.0075
Claude Haiku 4.5Anthropic$0.0080$0.0080$0.02
Gemini 2.5 ProGoogle$0.01$0.02$0.03
GPT-4oOpenAI$0.03$0.02$0.04
Claude Sonnet 4.6Anthropic$0.03$0.03$0.06
Claude Opus 4.8Anthropic$0.15$0.15$0.30

Pricing per 1M tokens as of June 2026. All calculations run in your browser — no API calls.

Über LLM Kostenrechner

Der LLM-Kostenrechner schätzt, was ein API-Aufruf an ein großes Sprachmodell kosten wird, basierend darauf, wie viele Eingabe- und Ausgabe-Tokens er verbraucht, und reiht dann die großen Modelle für dieselbe Arbeitslast vom günstigsten zum teuersten. Du wählst ein Modell, gibst die Anzahl der Eingabe-Tokens (den Prompt und Kontext, den du sendest) und der Ausgabe-Tokens (den Text, den das Modell erzeugt) ein, und es berechnet die Eingabekosten, die Ausgabekosten und die Summe. Weil Anbieter diese beiden Richtungen getrennt bepreisen, macht ihre Aufschlüsselung deutlich, wohin deine Ausgaben tatsächlich fließen.

Die Berechnung ist unkompliziert: Die Eingabekosten ergeben sich aus den Eingabe-Tokens geteilt durch eine Million, multipliziert mit dem Preis je Million Eingabe-Tokens dieses Modells, und die Ausgabekosten werden genauso mit dem Ausgabepreis berechnet. Kleine Summen werden mit zusätzlichen Nachkommastellen angezeigt, damit Bruchteile eines Cents sichtbar bleiben. Das Werkzeug liefert aktuelle veröffentlichte Preise für acht Modelle: Claude Opus 4.8 zu 15 $ Eingabe und 75 $ Ausgabe je Million Tokens, Claude Sonnet 4.6 zu 3 $ und 15 $, Claude Haiku 4.5 zu 0,80 $ und 4 $, GPT-4o zu 2,50 $ und 10 $, GPT-4o mini zu 0,15 $ und 0,60 $, Gemini 2.5 Pro zu 1,25 $ und 10 $, Gemini 2.5 Flash zu 0,15 $ und 0,60 $ sowie Llama 3.3 70B auf Groq zu 0,59 $ und 0,79 $.

Neben der Aufschlüsselung deines ausgewählten Modells erstellt das Werkzeug eine Vergleichstabelle, die genau dieselben Token-Zahlen durch alle acht Modelle laufen lässt und nach Gesamtkosten sortiert, sodass du sofort siehst, wie viel du sparen würdest, wenn du für eine gegebene Arbeitslast die Klasse oder den Anbieter wechselst. Das ist in der Praxis der nützlichste Teil: Es verwandelt einen abstrakten Preis je Million in eine konkrete Zahl je Aufruf und zeigt zum Beispiel, wie stark ausgabelastige Arbeitslasten günstigere Ausgabepreise begünstigen. Alles wird lokal berechnet, sodass deine Token-Zahlen und die Prompts, die sie darstellen, nie irgendwohin gesendet werden.

Behalte zwei Dinge im Hinterkopf. Die Preise sind veröffentlichte Tarife mit Stand Mitte 2026, im Werkzeug gespeichert statt live abgerufen, überprüfe also den aktuellen Tarif auf der Preisseite des Anbieters, bevor du dich für die Budgetierung auf eine Zahl verlässt. Und die Schätzung ist rein eine Funktion der Token-Zahlen; sie berücksichtigt keine Rabatte durch Prompt-Caching, keine Batch-API-Preise, keine Feinabstimmungs-Aufschläge und kein kostenloses Kontingent, die alle deine tatsächliche Rechnung nach oben oder unten verschieben können. Um eine monatliche Zahl zu schätzen, multipliziere die Summe je Aufruf mit deinem erwarteten Anfragevolumen.

Häufig gestellte Fragen

Wie ermittelt der Rechner die Kosten?
Er wendet die veröffentlichten Tarife je Million Tokens jedes Modells auf deine Token-Zahlen an. Die Eingabekosten sind die Anzahl der Eingabe-Tokens geteilt durch eine Million, multipliziert mit dem Eingabepreis je Million; die Ausgabekosten nutzen dieselbe Formel mit dem Ausgabepreis. Die Summe addiert beide. Da jeder Anbieter Eingabe und Ausgabe getrennt bepreist, zeigt das Werkzeug jeden Teil, damit du siehst, welche Seite des Aufrufs deine Ausgaben treibt.
Warum werden Eingabe- und Ausgabe-Tokens unterschiedlich bepreist?
Neuen Text zu erzeugen ist für ein Modell rechenintensiver, als bestehenden Text zu lesen, daher verlangen Anbieter fast immer mehr je Ausgabe-Token als je Eingabe-Token, oft ein Mehrfaches. Das bedeutet, dass Arbeitslasten, die lange Antworten erzeugen, unverhältnismäßig mehr kosten als Arbeitslasten mit langen Prompts, aber kurzen Antworten. Die Trennung beider im Rechner hilft dir, diesen Effekt zu erkennen und ein Modell zu wählen, dessen Preisform zu deinem Nutzungsmuster passt.
Welche Modelle und Preise sind enthalten?
Acht Modelle mit ihren veröffentlichten Tarifen je Million Tokens: Claude Opus 4.8 (15 $ Eingabe / 75 $ Ausgabe), Claude Sonnet 4.6 (3 $ / 15 $), Claude Haiku 4.5 (0,80 $ / 4 $), GPT-4o (2,50 $ / 10 $), GPT-4o mini (0,15 $ / 0,60 $), Gemini 2.5 Pro (1,25 $ / 10 $), Gemini 2.5 Flash (0,15 $ / 0,60 $) und Llama 3.3 70B auf Groq (0,59 $ / 0,79 $). Die Vergleichstabelle lässt deine Token-Zahlen durch alle gleichzeitig laufen.
Wie aktuell sind die Preise?
Die Tarife spiegeln veröffentlichte Preise mit Stand Mitte 2026 wider und sind im Werkzeug gespeichert, statt live aus Anbieter-APIs abgerufen zu werden. Das hält den Rechner schnell und vollständig clientseitig, aber LLM-Preise ändern sich häufig, während die Anbieter konkurrieren, nutze das Ergebnis also als nahe Schätzung und bestätige den genauen aktuellen Tarif auf der offiziellen Preisseite des Anbieters, bevor du ihn in ein Budget übernimmst.
Kann ich die Kosten über alle Modelle auf einmal vergleichen?
Ja. Das Werkzeug nimmt die von dir eingegebenen Eingabe- und Ausgabe-Token-Zahlen und lässt sie durch jedes enthaltene Modell laufen, dann zeigt es eine Tabelle, sortiert vom günstigsten zum teuersten Gesamtbetrag. Das macht es leicht zu sehen, was eine gegebene Arbeitslast bei jeder Option kosten würde, und zu erkennen, wo ein Wechsel zu einer günstigeren Klasse oder einem günstigeren Anbieter für deinen konkreten Mix aus Eingabe und Ausgabe am meisten sparen würde.
Schließt die Schätzung Rabatte wie Prompt-Caching oder Batch-Preise ein?
Nein. Die Berechnung beruht ausschließlich auf den Standardtarifen je Token und den von dir eingegebenen Token-Zahlen. Sie berücksichtigt keine Rabatte durch Prompt-Caching, keine Batch-API-Preise, keine Feinabstimmungs-Aufschläge, keine Mengenvereinbarungen und kein kostenloses Kontingent, die alle deine tatsächliche Rechnung verändern können. Behandle die Zahl als saubere Ausgangsbasis für einen einzelnen Aufruf zu Standardtarifen und wende dann etwaige programmspezifische Rabatte an, für die dein Konto berechtigt ist.
Wie schätze ich meine monatliche Rechnung?
Schätze die Eingabe- und Ausgabe-Tokens für eine typische Anfrage, hol dir die Summe je Aufruf aus dem Rechner und multipliziere sie mit der Anzahl der Anfragen, die du pro Monat erwartest. Für gemischten Verkehr führe die Berechnung für jeden wichtigen Anfragetyp durch und addiere die Ergebnisse. Denk daran, dass dies eine Schätzung zu Standardtarifen ergibt; Caching, Batching oder Rabatte bei zugesicherter Nutzung können die tatsächliche Summe senken.
Werden meine Token-Zahlen oder Prompts irgendwohin gesendet?
Nein. Alle Berechnungen laufen in deinem Browser, und du gibst ohnehin nur Token-Zahlen ein, nicht die Prompts selbst. Nichts über deine Nutzung wird an einen Server übertragen, sodass du Kosten für vertrauliche oder unveröffentlichte Anwendungen frei modellieren kannst.
guide

LLM API Cost Calculator: How to Estimate Your Bill Before You Build

How LLM API pricing works (input vs output tokens), real cost examples for Claude, GPT-4o, and Gemini, and strategies to reduce your bill.

Weitere kostenlose ToolsAlle 492 ansehen →
Merge PDFsCompress ImageJSON FormatterPassword GeneratorVAT CalculatorQR Code Generator
LLM-Kostenrechner: API-Preise für Claude, GPT-4o & mehr | brevio