Rechner
Unterstützt werden der Nutzungsexport von platform.openai.com (Usage, Export CSV, gruppiert nach Modell und Batch), der Kostenexport von OpenAI und die Usage-Exporte der Anthropic Console und der Anthropic Admin API. Kostenexporte ohne Tokenzahlen werden als Schätzung ausgewertet.
CSV hier ablegen oder klicken. Mehrere Dateien möglich, etwa OpenAI und Anthropic zusammen.
Alles läuft lokal in Ihrem Browser. Es wird nichts hochgeladen.
Zum Ausprobieren: Beispiel OpenAI-Export · Beispiel Anthropic-Export
Spalten zuordnen
Die Spalten wurden nicht sicher erkannt. Bitte zuordnen.
Zahlen manuell eingeben (ohne Datei)
Tragen Sie je Modell die Tokens eines typischen Monats ein. Die Werte stehen im Usage-Dashboard des Anbieters.
| Modell | Input-Tokens | Output-Tokens | davon gecacht | Batch | Aktion |
|---|
Annahmen
Startwerte aus unserer Erfahrung. Schieben Sie die Regler auf Ihre Situation, das Ergebnis rechnet sofort neu.
Ergebnis: Szenario zu heutigen Listenpreisen
Mögliche Ersparnis nach Hebel
Je Modell
| Modell | Kosten/Monat | Anteil | Cache heute | Modellupdate | Batch | Caching | Routing |
|---|
Was die Prüfung kostet
Erfolgsbeteiligung: 30 Prozent der nachgewiesenen Ersparnis über zwölf Monate, abgerechnet monatlich gegen die tatsächliche Anbieterrechnung. Bei Ihren Zahlen wären das rechnerisch –. Sie behielten rechnerisch –. Alternativ Festpreis, siehe unten.
Unter etwa US-Dollar je Monat lohnt eine begleitete Prüfung meist nicht. Die Maßnahmen aus dem Ergebnis oben können Sie selbst umsetzen; wenn Sie trotzdem Unterstützung möchten, bieten wir einen Bericht ohne Begleitung zum Festpreis an.
Grundlage: Listenpreise der Anbieter mit Stand . Die Zahlen oben sind eine Schätzung aus Ihren Daten und den gewählten Annahmen. Abgerechnet wird nur die Ersparnis, die auf Ihrer Anbieterrechnung nachweisbar ist. Honorar in Euro, Umrechnung zum Kurs am Rechnungstag. Rechenweg unter Methodik.
Prüfung anfragenAblauf
- Export senden. Sie schicken uns den Nutzungsexport der letzten drei Monate (nur Tokenzahlen je Modell, keine Inhalte) und beantworten fünf Fragen zu Ihren Workloads. Dauer auf Ihrer Seite: 20 Minuten.
- Bericht in 48 Stunden. Je Endpunkt: was heute kostet, was Batch, Caching, Modellupdate und Routing sparen, in welcher Reihenfolge umgestellt wird und was das Risiko je Schritt ist.
- Umsetzung mit Ihrem Team oder durch uns. Die meisten Umstellungen sind Konfiguration und wenige Zeilen Code. Wir liefern Diffs, Ihr Team gibt frei. Vor jeder Umstellung läuft ein Regressionsset aus 200 echten Fällen aus Ihrem System.
- Nachweis auf der Rechnung. Wir vergleichen die Anbieterrechnung vor und nach der Umstellung, normiert auf das Anfragevolumen. Nur was dort steht, wird abgerechnet.
Was wir prüfen
Modellupdate
Ältere Modelle kosten oft mehr als ihre Nachfolger bei gleicher Stufe. Beispiel Listenpreis je Million Tokens: Sonnet 4.6 (3/15 USD), Sonnet 5 (2/10 USD). Bei gleicher Tokenmenge wäre das ein Drittel weniger; weil Claude ab Version 4.7 einen neuen Tokenizer mit laut Anthropic bis zu 35 % mehr Tokens für denselben Text nutzt, rechnet der Rechner mit 20 % mehr Tokens und zeigt rund ein Fünftel Ersparnis. Den echten Wert messen wir vor der Umstellung an Ihren Prompts, die Qualität mit einem Regressionslauf. Dazu Pflichtmigrationen vor Abschaltterminen.
Batch
Alles, was nicht in Sekunden antworten muss, kostet über die Batch-Schnittstelle bei fast allen Modellen die Hälfte (Ausnahme sind Pro-Modelle wie GPT-5.5 Pro und o3-pro). Nachtläufe, Klassifikation, Berichte, Embeddings.
Prompt-Caching
System-Prompt, Tool-Definitionen und Dokumente wiederholen sich bei jeder Anfrage. Gecachte Tokens kosten bei den aktuellen GPT- und Claude-Modellen ein Zehntel des Eingabepreises, bei GPT-4.1, o3 und o4-mini ein Viertel, bei GPT-4o die Hälfte. Die meisten Integrationen nutzen das nicht oder brechen den Cache unbemerkt.
Routing
Ein Teil der Anfragen braucht das größte Modell nicht. Ein Router mit Evaluierungsset schickt sie eine Stufe kleiner, mit Nachweis, dass die Qualität hält.
Zusätzlich im Bericht: Preisrisiken (Aktionspreise mit Mindestdauer, Abschaltungen), Long-Context-Aufschläge, verfallende Guthaben, Doppelabos. Termine und Beträge dazu stehen in der Methodik, deren Preistabelle denselben Stand trägt wie der Rechner.
Nachprüfbar
Fünf Dinge, die Sie ohne uns prüfen können.
Rechner läuft lokal
Die CSV-Datei wird nur in Ihrem Browser gelesen. Es gibt keinen Upload; im Netzwerkprotokoll des Browsers sehen Sie keine Anfrage mit Ihren Daten. Details in den Datenschutzhinweisen.
Methodik offen
Preistabelle, Annahmen und Rechenweg liegen als lesbare Dateien auf dieser Seite: prices.js und calc.js. Erklärung mit Formeln unter Methodik.
Änderungsprotokoll
Preisstände, neue Modelle und Änderungen am Rechner werden mit Datum festgehalten, auch die 45 behobenen Befunde des Reviews vom 17.09.2026. Einsehbar unter Änderungen.
Impressum vollständig
Inhaber, Anschrift, E-Mail und Umsatzsteuer-Identifikationsnummer stehen im Impressum. Wer wir sind und wie wir arbeiten, unter Über uns.
Nachweis auf der Rechnung
Abgerechnet wird nur die Ersparnis, die auf Ihrer Anbieterrechnung nachweisbar ist, normiert auf das Anfragevolumen. Keine Ersparnis, keine Rechnung.
Preis
Erfolgsbeteiligung
30 %
der nachgewiesenen Ersparnis über zwölf Monate ab Umstellung. Keine Ersparnis, keine Rechnung. Abrechnung monatlich gegen die Anbieterrechnung, Laufzeit zwölf Monate.
Festpreis
| bis 30.000 USD API-Kosten je Monat | 8.000 EUR |
| bis 100.000 USD | 15.000 EUR |
| bis 300.000 USD | 25.000 EUR |
| darüber | 40.000 EUR |
Bericht plus Umsetzungsbegleitung, netto. Umsetzung durch uns optional zum Tagessatz. Unter 3.000 USD je Monat: Bericht ohne Begleitung für 2.500 EUR.
Kostenlos sind der Rechner auf dieser Seite und ein Gespräch von 30 Minuten, in dem wir Ihren Export gemeinsam ansehen.