Die genauen Preise für die Nutzung werden im Folgenden aufgeführt. Alle Preise sind in Euro angegeben.
Preise pro 1 Mio. Tokens in Euro, gruppiert nach Anbieter.
Bei Modellen mit Preisstufen liegt der Standard-Schwellenwert für die automatische Chat-Zusammenfassung höchstens bei 90 % der ersten Preisgrenze, sofern die Funktion im Workspace aktiviert ist. Die Zusammenfassung startet nach einer Antwort; lange neue Eingaben oder ein manuell höher gesetzter Schwellenwert können weiterhin den höheren Tarif auslösen. Details zur Einstellung findest Du unter Workspace-Konfiguration.
| Modell | € pro 1M Eingabe-Tokens | € pro 1M Ausgabe-Tokens |
|---|
| GPT-4o Mini | 0,18 | 0,72 |
| GPT-4o | 2,96 | 11,82 |
| GPT-4.1 | 2,40 | 9,60 |
| o4-mini | 1,32 | 5,28 |
| o3 | 2,40 | 9,60 |
| o3-pro | 24,00 | 96,00 |
| GPT-5 | 1,50 | 12,00 |
| GPT-5 Thinking | 1,50 | 12,00 |
| GPT-5 mini | 0,30 | 2,40 |
| GPT-5 nano | 0,12 | 0,48 |
| GPT-5.1 | 1,50 | 12,00 |
| GPT-5.2 | 2,10 | 16,80 |
| GPT-5.3 Chat | 2,10 | 16,80 |
| GPT-5.4 | 3,30 | 19,80 |
| GPT-5.4 pro | 36,00 | 216,00 |
| GPT-5.5 | 6,60 | 39,60 |
| GPT-5.6 Sol | 6,60 | 39,60 |
| GPT-5.6 Terra | 2,64 | 15,84 |
| GPT-5.6 Luna | 0,264 | 1,584 |
| GPT-6 Sol | 2,64 | 13,20 |
| GPT-6 Luna | 0,132 | 0,66 |
| GPT-6 Astra | 11,37 | 56,83 |
| GPT-6.1 Sol | 2,64 | 13,20 |
GPT-6 Astra läuft bei OpenAI mit EU-Datenresidenz. Auswählbar wird es erst, wenn Deine Organisation den AVV in Version 2.0 unterschrieben hat, der OpenAI Ireland Ltd. als Unterauftragsverarbeiter führt — bis dahin bleibt es unter Einstellungen → Modelle gesperrt.
Ab 272.000 Tokens Kontext gilt der Langkontext-Tarif: 22,73 € pro 1 Mio. Eingabe-Tokens und 85,24 € pro 1 Mio. Ausgabe-Tokens für GPT-6 Astra, 5,28 € und 19,80 € für GPT-6.1 Sol.
| Modell | € pro 1M Eingabe-Tokens | € pro 1M Ausgabe-Tokens |
|---|
| Claude Opus 4.5 | 6,60 | 33,00 |
| Claude Opus 4.6 | 6,60 | 33,00 |
| Claude Opus 4.7 | 6,60 | 33,00 |
| Claude Opus 4.8 | 6,60 | 33,00 |
| Claude Opus 5 | 6,60 | 33,00 |
| Claude Opus 5.5 | 5,28 | 26,40 |
| Claude Sonnet 4.5 | 3,96 | 19,80 |
| Claude Sonnet 4.6 | 3,96 | 19,80 |
| Claude Sonnet 5 | 2,64 | 13,20 |
| Claude Sonnet 5.5 | 2,64 | 13,20 |
| Claude Haiku 4.5 | 1,32 | 6,60 |
| Modell | € pro 1M Eingabe-Tokens | € pro 1M Ausgabe-Tokens |
|---|
| Gemini 2.5 Flash | 0,36 | 3,00 |
| Gemini 3 Flash | 0,60 | 3,60 |
| Gemini 3.5 Flash | 1,80 | 10,80 |
| Gemini 3.6 Flash | 0,99 | 4,95 |
| Gemini 3.7 Flash | 0,99 | 4,95 |
| Gemini 3.8 Flash | 0,99 | 4,95 |
| Gemini 3.5 Flash-Lite | 0,36 | 3,00 |
| Gemini 2.5 Pro (≤200K) | 1,30 | 10,41 |
| Gemini 2.5 Pro (>200K) | 2,60 | 15,61 |
| Gemini 3 Pro | 3,00 | 15,00 |
| Gemini 3.1 Pro (≤200K) | 2,40 | 14,40 |
| Gemini 3.1 Pro (>200K) | 4,80 | 21,60 |
| Modell | € pro 1M Eingabe-Tokens | € pro 1M Ausgabe-Tokens |
|---|
| Mistral Medium 3.5 | 1,98 | 9,90 |
| CodeStral | 0,40 | 1,19 |
| Modell | € pro 1M Eingabe-Tokens | € pro 1M Ausgabe-Tokens |
|---|
| GPT-OSS 120B | 0,18 | 0,72 |
| Llama 3.3 | 0,16 | 0,48 |
| DeepSeek-V3.2 | 0,70 | 2,02 |
| DeepSeek-V4-Flash | 0,20 | 0,54 |
| DeepSeek-V4-Flash (EU) | 0,26 | 0,31 |
| DeepSeek-V4-Pro | 1,83 | 3,67 |
| DeepSeek-V4-Pro (EU) | 2,07 | 4,13 |
| Kimi K2.5 | 0,72 | 3,60 |
| Kimi K2.6 | 1,14 | 4,80 |
| Kimi K3 | 3,60 | 18,00 |
| Kimi K3 (EU) | 3,10 | 15,50 |
Mehrere unserer Modelle unterstützen Prompt Caching: Wird wiederholt derselbe (oder sehr ähnlicher) Kontext gesendet, wird der bereits verarbeitete Teil nicht erneut zum vollen Preis berechnet. Wie das genau abgerechnet wird, unterscheidet sich zwischen zwei Mechanismen:
Modelle mit explizitem Cache-Write (Claude-Modelle, GPT-5.6-Reihe, GPT-6 Astra, GPT-6.1 Sol): Diese Modelle berechnen zwei separate Sätze - einen stark vergünstigten Satz fürs Wiederverwenden von gecachtem Kontext (Cache-Read, aktuell 10 % des Standard-Input-Preises, also 90 % Rabatt; bei GPT-6.1 Sol 5 %) und einen einmaligen Aufschlag fürs erstmalige Anlegen des Caches (Cache-Write, aktuell 125 % des Standard-Input-Preises). Der Aufschlag amortisiert sich, sobald der gecachte Block mehr als einmal wieder gelesen wird. Betroffen sind alle aktuellen Claude-Modelle (Opus-, Sonnet- und Haiku-Reihe) sowie GPT-5.6 (Sol/Terra/Luna), GPT-6 Astra und GPT-6.1 Sol.
Modelle mit reinem Cache-Read-Rabatt, ohne separaten Cache-Write (die meisten übrigen OpenAI-Modelle, Gemini): Bei diesen Modellen läuft das Caching automatisch im Hintergrund - es gibt keinen separaten Aufschlag fürs Anlegen des Caches, nur einen vergünstigten Satz beim Wiederverwenden. Die Höhe des Rabatts unterscheidet sich je nach Modell:
- Google Gemini (alle aktuellen Flash- und Pro-Varianten): 90 % Rabatt auf gecachte Input-Token.
- GPT-5, GPT-5.1, GPT-5.2, GPT-5.3, GPT-5.4, GPT-5.5 und ihre Chat-/Thinking-Varianten (ohne GPT-5.4 Pro, siehe unten): rund 80-90 % Rabatt, je nach Modellversion.
- GPT-4.1, o3, o4-mini: 75 % Rabatt.
- GPT-4o, GPT-4o Mini: 50 % Rabatt.
- DeepSeek-V4 (Flash/Pro): eigener, vom Anbieter vorgegebener Cache-Satz.
Modelle ohne Cache-Rabatt: Bei einigen Modellen (u. a. Mistral, selbst gehostete Modelle wie Qwen, GPT-OSS, sowie GPT-5.4 Pro und Kimi K3) ist aktuell kein Cache-Rabatt hinterlegt - gecachte Token werden dort zum vollen Input-Preis abgerechnet.
Die genauen Sätze gelten global pro Modell, unabhängig von der Organisation, und können sich mit neuen Modellversionen ändern - die oben genannten Standard-Input-/Output-Preise sind die verlässliche Referenz, von der sich der Cache-Rabatt jeweils prozentual ableitet.
Preise gelten für ein Bild bei Standardauflösung (1024×1024). Bei FLUX.2-Modellen kann der Preis je nach Auflösung und Anzahl der Referenzbilder variieren.
| Modell | € pro Bild (ca.) |
|---|
| FLUX.2 Klein | 0,018 |
| FLUX.2 Pro | 0,036 |
| FLUX.2 Flex | 0,060 |
| FLUX.2 Max | 0,084 |
| FLUX 1.1 Pro | 0,048 |
| FLUX.1 Kontext Max | 0,096 |
| GPT Image 1 | ab 0,300 |
| GPT Image 1.5 | ab 0,160 |
| GPT Image 1 Mini | ab 0,043 |
| GPT Image 2 | ab 0,200 |
| Gemini 2.5 Flash | 0,047 |
| Gemini 3 Pro | 0,240 |
| Art | Preis |
|---|
| Dokumentenübersetzung | 0,024 € pro 1000 Zeichen Mindestgebühr: 0,50 € |
| Textübersetzung | 0,024 € pro 1000 Zeichen |
| Glossary | Gratis |
- Webseiten lesen: verbrauchsbasiert nach Token
- Workflow Wizard: 0,10 € pro Workflow
- Audiotranskription: 1,00 € pro Stunde