Der Rechner multipliziert Ihre Input- und Output-Tokens mit den hinterlegten Listenpreisen von elf Modellen (Claude, GPT, Gemini, Mistral) und zeigt die Kosten je Anfrage und für die gesamte Menge in US-Dollar und Euro. Die Anthropic-Preise sind am 21.09.2026 gegen die offizielle Preisliste geprüft, die übrigen Anbieter prüfen Sie bitte selbst. Das Textfeld schätzt die Token-Zahl grob mit vier Zeichen je Token.
Live-Berechnung. Preise in USD je 1 Mio. Tokens; Anthropic-Preise am 21.09.2026 geprüft, die übrigen Anbieter bitte selbst prüfen.
–
Kosten / Anfragen (EUR)
USD pro Anfrage
–
USD gesamt
–
Input-Anteil
–
Tokens gesamt
–
Hinweis: EUR-Umrechnung mit Wechselkurs 1 USD ≈ 0,93 €. Preise ändern sich häufig – bei größeren Mengen direkt beim Anbieter prüfen.
Was sind Tokens?
Tokens sind die Recheneinheit, in der Large-Language-Models Texte messen. Faustregel: 1 Token ≈ 4 Zeichen oder ¾ Wort. Ein deutscher Roman von 100.000 Wörtern entspricht ca. 130.000 Tokens.
Input vs. Output
API-Anbieter rechnen Input und Output unterschiedlich ab. Output ist üblicherweise teurer als Input: Claude Sonnet 4.6 kostet 3 $ je 1 Mio. Input-Tokens und 15 $ je 1 Mio. Output-Tokens.
So sparen Sie Kosten
Wählen Sie das kleinste Modell, das die Aufgabe noch zuverlässig löst. Mini-Modelle kosten je Token einen Bruchteil der Topmodelle – GPT-4o mini rund ein Dreißigstel von GPT-4o – und reichen für viele Anwendungen aus.
Häufige Fragen
Sind die Preise im Rechner aktuell?
Die Anthropic-Preise wurden am 21.09.2026 gegen die offizielle Preisliste geprüft. Die Preise der übrigen Anbieter sind ungeprüft übernommen. API-Anbieter ändern Preise häufig – rechnen Sie bei größeren Mengen vor der Abrechnung beim Anbieter nach.
Wieviel kostet ein typischer Chat?
Eine 10-Nachrichten-Konversation mit Claude Sonnet kostet je nach Länge etwa $0,01–$0,10 (1–10 Cent).
Was sind 'Cached'-Tokens?
Manche Anbieter (Anthropic, OpenAI) bieten Caching: wiederholte Inputs werden günstiger berechnet. Dieser Rechner zeigt den Standard-Preis.
Dieser Rechner liefert eine unverbindliche Orientierung und ersetzt keine individuelle Beratung.
Warum Token-Kosten verstehen?
Wer mit GPT, Claude oder Gemini APIs arbeitet, zahlt nicht pro Anfrage sondern pro Token. Ein Token ist grob ¾ Wort. Ein typisches User-Prompt (~50 Wörter) sind ~65 Tokens, eine Output-Antwort (~200 Wörter) sind ~270 Tokens. Bei Claude Opus 5 kosten 1.000 Output-Tokens 0,025 $ – eine 200-Wort-Antwort also weniger als einen Cent. Mehrere Tausend solcher Anfragen pro Tag summieren sich schnell.
Kosten-Strategien
Kleinere Modelle für einfache Aufgaben: GPT-4o mini kostet je Token rund ein Dreißigstel von GPT-4o und reicht für Zusammenfassungen und Übersetzungen meist aus. Claude Haiku 4.5 ist gegenüber Opus 5 fünfmal günstiger und bei vielen Aufgaben fast gleichwertig. Caching nutzen: Anthropic bietet Prompt-Caching mit 90 % Rabatt auf gecachten Anteilen. Streaming abbrechen: wenn die Antwort nicht mehr relevant ist, Stream beenden – spart Output-Tokens. Kürzere System-Prompts: viele Tutorials zeigen 1.000-Wort-Prompts – meist reichen 200 mit klarem Auftrag.
Versteckte Kostentreiber
Konversations-History: jede neue Anfrage in einem Chat schickt die gesamte bisherige History mit. Nach 10 Nachrichten kann jede neue Anfrage 3.000+ Tokens Input kosten. Eingebettete Dokumente: Auch wenn der User nur kurz fragt, wird das gesamte 30-Seiten-PDF mitgeschickt. Embeddings ≠ Generation: für Suche reichen oft Embeddings (sehr günstig, 0,02 $/1M Tokens) statt LLM-Generierung.