Werkzeug
KI-Kostenrechner
Über vier Hebel: Kontext, Cache, Aufrufe und Anläufe. Dazu Modellwahl, Abrechnungsweg und menschliche Nacharbeit. Ergebnis ist die einzig relevante Größe, nämlich die Kosten je erledigter Aufgabe.
Der Artikel dazu: Wie Sie KI-Kosten senken, ohne Qualität zu verlierenLauf einstellen
Womit fangen wir an?
3.700 Token je Konversation, belegt aus der Anthropic-Dokumentation.
Abrechnung und Weg (Standard: keiner)
Ergebnis
Kosten je erledigter Aufgabe: 2,50 €. Monatssumme: 25.049,48 €.
- Eingabe (Maschine)0%0,003212 €
- Ausgabe (Maschine)0%0,001736 €
- Nacharbeit (Mensch)100%2,50 €
Claude Haiku 4.5 liegt auf Rang 13 von 27. Günstigstes Modell: Ministral 3 3B mit 2,50 € je Aufgabe, ein Abstand von 0,18 Prozent.
Alle Modelle in diesem Szenario
Gerechnet mit 3.700 Eingabe- und 400 Ausgabe-Token, 1 Aufrufen, 1,0 Anläufen und 2 Minuten Nacharbeit.
Beim reinen Maschinenpreis trennt das günstigste vom teuersten Modell das 139-Fache. Je erledigter Aufgabe sind es 2,0 Prozent, denn die Nacharbeit trägt 99,8 Prozent der Kosten. Die Modellwahl ist hier die kleinere Stellschraube; die Minuten sind die größere.
Umschlagpunkt: Ministral 3 3B verliert seinen Vorsprung gegenüber Claude Fable 5 erst, wenn es 139,0 Anläufe braucht, wo Claude Fable 5 mit 1,0 auskommt. Prüfen Sie diese Zahl an Ihren eigenen Fehlerquoten, bevor Sie nach Listenpreis entscheiden.
| Rang | Modell | Maschine | Mensch | Je Aufgabe | Je Monat | Abstand |
|---|---|---|---|---|---|---|
| 1 | Ministral 3 3B | 0,000356 € | 2,50 € | 2,50 € | 25.003,56 € | günstigster |
| 2 | DeepSeek V4 Flash | 0,000547 € | 2,50 € | 2,50 € | 25.005,47 € | +0,008% |
| 3 | Mistral Small 4 | 0,000690 € | 2,50 € | 2,50 € | 25.006,90 € | +0,013% |
| 4 | gpt-5.6-luna | 0,001059 € | 2,50 € | 2,50 € | 25.010,59 € | +0,028% |
| 5 | gpt-5.4-nano | 0,001076 € | 2,50 € | 2,50 € | 25.010,76 € | +0,029% |
| 6 | Gemini 3.1 Flash-Lite | 0,001324 € | 2,50 € | 2,50 € | 25.013,24 € | +0,039% |
| 7 | Qwen3.7-Plus (Together) | 0,001472 € | 2,50 € | 2,50 € | 25.014,72 € | +0,045% |
| 8 | DeepSeek V4 Pro | 0,001699 € | 2,50 € | 2,50 € | 25.016,99 € | +0,054% |
| 9 | Gemini 3.5 Flash-Lite | 0,001832 € | 2,50 € | 2,50 € | 25.018,32 € | +0,059% |
| 10 | Mistral Large 3 | 0,002127 € | 2,50 € | 2,50 € | 25.021,27 € | +0,071% |
| 11 | Llama 3.3 70B (Together) | 0,003701 € | 2,50 € | 2,50 € | 25.037,01 € | +0,13% |
| 12 | gpt-5.4-mini | 0,003971 € | 2,50 € | 2,50 € | 25.039,71 € | +0,14% |
| 13 | Claude Haiku 4.5· gewählt | 0,004948 € | 2,50 € | 2,50 € | 25.049,48 € | +0,18% |
| 14 | DeepSeek V4 Pro (Together) | 0,006797 € | 2,50 € | 2,51 € | 25.067,97 € | +0,26% |
| 15 | Gemini 3.6 Flash | 0,007422 € | 2,50 € | 2,51 € | 25.074,22 € | +0,28% |
| 16 | Mistral Medium 3.5 | 0,007422 € | 2,50 € | 2,51 € | 25.074,22 € | +0,28% |
| 17 | Gemini 3.5 Flash | 0,007943 € | 2,50 € | 2,51 € | 25.079,43 € | +0,30% |
| 18 | Claude Sonnet 5 (Einführungspreis bis 31.08.2026) | 0,009896 € | 2,50 € | 2,51 € | 25.098,96 € | +0,38% |
| 19 | gpt-5.6-terra | 0,0106 € | 2,50 € | 2,51 € | 25.105,90 € | +0,41% |
| 20 | Gemini 3.1 Pro Preview | 0,0106 € | 2,50 € | 2,51 € | 25.105,90 € | +0,41% |
| 21 | gpt-5.4 | 0,0132 € | 2,50 € | 2,51 € | 25.132,38 € | +0,52% |
| 22 | Claude Sonnet 5 (ab 01.09.2026) | 0,0148 € | 2,50 € | 2,51 € | 25.148,44 € | +0,58% |
| 23 | Claude Sonnet 4.6 | 0,0148 € | 2,50 € | 2,51 € | 25.148,44 € | +0,58% |
| 24 | Claude Opus 5 | 0,0247 € | 2,50 € | 2,52 € | 25.247,40 € | +0,98% |
| 25 | Claude Opus 4.8 | 0,0247 € | 2,50 € | 2,52 € | 25.247,40 € | +0,98% |
| 26 | gpt-5.6-sol | 0,0265 € | 2,50 € | 2,53 € | 25.264,76 € | +1,0% |
| 27 | Claude Fable 5 | 0,0495 € | 2,50 € | 2,55 € | 25.494,79 € | +2,0% |
Vergleich der Läufe
Speichern Sie Läufe, um Einstellungen nebeneinander zu sehen, etwa dieselbe Aufgabe mit und ohne Cache oder mit doppelter Nacharbeit.
Rechenweg, Annahmen und Quellen
Kosten je Aufgabe = Maschine × Modifikatoren + Nacharbeit. Die Maschine besteht aus vier Posten: frische Eingabe (× Aufrufe × Anläufe), einmaliges Füllen des Cache, Lesen aus dem Cache (× alle weiteren Aufrufe) und Ausgabe (× Aufrufe × Anläufe). Die Nacharbeit rechnet Minuten/60 × €/h.
Der Cache wird gerechnet, wie er abgerechnet wird: einmal je Aufgabe gefüllt, danach gelesen. Deshalb kostet er bei einem einzigen Aufruf mehr, als er spart. Verwendet werden die veröffentlichten Cache-Preise je Modell, nicht ein Pauschalfaktor. Anthropic verlangt fürs Füllen das 1,25-Fache und fürs Lesen ein Zehntel, DeepSeek liest für rund ein Prozent, Mistral veröffentlicht keinen Cache-Preis und bekommt deshalb keinen Nachlass. Googles Speicherentgelt je Stunde hängt an der Laufzeit und ist NICHT eingerechnet.
Modifikatoren: Stapelverarbeitung × 0,5 (nur bei Anbietern, die sie anbieten), US-Residenz × 1,1, Router × 1,055. Anläufe vervielfachen die Aufrufe, nicht das Füllen des Cache und nicht die Nacharbeit, denn geprüft wird das Ergebnis, nicht jeder Versuch.
Preise sind Listenpreise der Anbieter, geprüft am 31. Juli 2026 an den unten verlinkten Preisseiten, ohne Rabatte. Umgerechnet wird mit 1,152 USD/EUR (Referenzkurs 31. Juli 2026); der Kurs ist eine Annahme, keine Tageszahl. Der einzige empirisch belegte Wert unter den Voreinstellungen sind 3.700 Token für eine Support-Konversation (Quelle: Anthropic-Dokumentation). Alle übrigen Voreinstellungen sind plausible Beispielwerte, keine Messwerte.
Gegenprobe: Die Anthropic-Dokumentation beziffert 10.000 Support-Konversationen à 3.700 Token mit Claude Haiku 4.5 auf rund 37 US-Dollar. Genau diese Zahl gibt der Rechner aus, wenn man Ausgabe, Cache und Nacharbeit auf null stellt.