Alle Modelle

Detaillierte Preisübersicht für alle KI-Services

Die genauen Preise für die Nutzung werden im Folgenden aufgeführt. Alle Preise sind in Euro angegeben.

Textgenerierung

Preise pro 1 Mio. Tokens in Euro, gruppiert nach Anbieter.

Bei Modellen mit Preisstufen liegt der Standard-Schwellenwert für die automatische Chat-Zusammenfassung höchstens bei 90 % der ersten Preisgrenze, sofern die Funktion im Workspace aktiviert ist. Die Zusammenfassung startet nach einer Antwort; lange neue Eingaben oder ein manuell höher gesetzter Schwellenwert können weiterhin den höheren Tarif auslösen. Details zur Einstellung findest Du unter Workspace-Konfiguration.

OpenAI

Modell€ pro 1M Eingabe-Tokens€ pro 1M Ausgabe-Tokens
GPT-4o Mini0,180,72
GPT-4o2,9611,82
GPT-4.12,409,60
o4-mini1,325,28
o32,409,60
o3-pro24,0096,00
GPT-51,5012,00
GPT-5 Thinking1,5012,00
GPT-5 mini0,302,40
GPT-5 nano0,120,48
GPT-5.11,5012,00
GPT-5.22,1016,80
GPT-5.3 Chat2,1016,80
GPT-5.43,3019,80
GPT-5.4 pro36,00216,00
GPT-5.56,6039,60
GPT-5.6 Sol6,6039,60
GPT-5.6 Terra2,6415,84
GPT-5.6 Luna0,2641,584
GPT-6 Sol2,6413,20
GPT-6 Luna0,1320,66
GPT-6 Astra11,3756,83
GPT-6.1 Sol2,6413,20

GPT-6 Astra läuft bei OpenAI mit EU-Datenresidenz. Auswählbar wird es erst, wenn Deine Organisation den AVV in Version 2.0 unterschrieben hat, der OpenAI Ireland Ltd. als Unterauftragsverarbeiter führt — bis dahin bleibt es unter Einstellungen → Modelle gesperrt.

Ab 272.000 Tokens Kontext gilt der Langkontext-Tarif: 22,73 € pro 1 Mio. Eingabe-Tokens und 85,24 € pro 1 Mio. Ausgabe-Tokens für GPT-6 Astra, 5,28 € und 19,80 € für GPT-6.1 Sol.

Anthropic

Modell€ pro 1M Eingabe-Tokens€ pro 1M Ausgabe-Tokens
Claude Opus 4.56,6033,00
Claude Opus 4.66,6033,00
Claude Opus 4.76,6033,00
Claude Opus 4.86,6033,00
Claude Opus 56,6033,00
Claude Opus 5.55,2826,40
Claude Sonnet 4.53,9619,80
Claude Sonnet 4.63,9619,80
Claude Sonnet 52,6413,20
Claude Sonnet 5.52,6413,20
Claude Haiku 4.51,326,60

Google

Modell€ pro 1M Eingabe-Tokens€ pro 1M Ausgabe-Tokens
Gemini 2.5 Flash0,363,00
Gemini 3 Flash0,603,60
Gemini 3.5 Flash1,8010,80
Gemini 3.6 Flash0,994,95
Gemini 3.7 Flash0,994,95
Gemini 3.8 Flash0,994,95
Gemini 3.5 Flash-Lite0,363,00
Gemini 2.5 Pro (≤200K)1,3010,41
Gemini 2.5 Pro (>200K)2,6015,61
Gemini 3 Pro3,0015,00
Gemini 3.1 Pro (≤200K)2,4014,40
Gemini 3.1 Pro (>200K)4,8021,60

Mistral

Modell€ pro 1M Eingabe-Tokens€ pro 1M Ausgabe-Tokens
Mistral Medium 3.51,989,90
CodeStral0,401,19

Open-Source-Modelle

Modell€ pro 1M Eingabe-Tokens€ pro 1M Ausgabe-Tokens
GPT-OSS 120B0,180,72
Llama 3.30,160,48
DeepSeek-V3.20,702,02
DeepSeek-V4-Flash0,200,54
DeepSeek-V4-Flash (EU)0,260,31
DeepSeek-V4-Pro1,833,67
DeepSeek-V4-Pro (EU)2,074,13
Kimi K2.50,723,60
Kimi K2.61,144,80
Kimi K33,6018,00
Kimi K3 (EU)3,1015,50

Gecachte Input-Token

Mehrere unserer Modelle unterstützen Prompt Caching: Wird wiederholt derselbe (oder sehr ähnlicher) Kontext gesendet, wird der bereits verarbeitete Teil nicht erneut zum vollen Preis berechnet. Wie das genau abgerechnet wird, unterscheidet sich zwischen zwei Mechanismen:

Modelle mit explizitem Cache-Write (Claude-Modelle, GPT-5.6-Reihe, GPT-6 Astra, GPT-6.1 Sol): Diese Modelle berechnen zwei separate Sätze - einen stark vergünstigten Satz fürs Wiederverwenden von gecachtem Kontext (Cache-Read, aktuell 10 % des Standard-Input-Preises, also 90 % Rabatt; bei GPT-6.1 Sol 5 %) und einen einmaligen Aufschlag fürs erstmalige Anlegen des Caches (Cache-Write, aktuell 125 % des Standard-Input-Preises). Der Aufschlag amortisiert sich, sobald der gecachte Block mehr als einmal wieder gelesen wird. Betroffen sind alle aktuellen Claude-Modelle (Opus-, Sonnet- und Haiku-Reihe) sowie GPT-5.6 (Sol/Terra/Luna), GPT-6 Astra und GPT-6.1 Sol.

Modelle mit reinem Cache-Read-Rabatt, ohne separaten Cache-Write (die meisten übrigen OpenAI-Modelle, Gemini): Bei diesen Modellen läuft das Caching automatisch im Hintergrund - es gibt keinen separaten Aufschlag fürs Anlegen des Caches, nur einen vergünstigten Satz beim Wiederverwenden. Die Höhe des Rabatts unterscheidet sich je nach Modell:

  • Google Gemini (alle aktuellen Flash- und Pro-Varianten): 90 % Rabatt auf gecachte Input-Token.
  • GPT-5, GPT-5.1, GPT-5.2, GPT-5.3, GPT-5.4, GPT-5.5 und ihre Chat-/Thinking-Varianten (ohne GPT-5.4 Pro, siehe unten): rund 80-90 % Rabatt, je nach Modellversion.
  • GPT-4.1, o3, o4-mini: 75 % Rabatt.
  • GPT-4o, GPT-4o Mini: 50 % Rabatt.
  • DeepSeek-V4 (Flash/Pro): eigener, vom Anbieter vorgegebener Cache-Satz.

Modelle ohne Cache-Rabatt: Bei einigen Modellen (u. a. Mistral, selbst gehostete Modelle wie Qwen, GPT-OSS, sowie GPT-5.4 Pro und Kimi K3) ist aktuell kein Cache-Rabatt hinterlegt - gecachte Token werden dort zum vollen Input-Preis abgerechnet.

Die genauen Sätze gelten global pro Modell, unabhängig von der Organisation, und können sich mit neuen Modellversionen ändern - die oben genannten Standard-Input-/Output-Preise sind die verlässliche Referenz, von der sich der Cache-Rabatt jeweils prozentual ableitet.

Bildgenerierung

Preise gelten für ein Bild bei Standardauflösung (1024×1024). Bei FLUX.2-Modellen kann der Preis je nach Auflösung und Anzahl der Referenzbilder variieren.

Modell€ pro Bild (ca.)
FLUX.2 Klein0,018
FLUX.2 Pro0,036
FLUX.2 Flex0,060
FLUX.2 Max0,084
FLUX 1.1 Pro0,048
FLUX.1 Kontext Max0,096
GPT Image 1ab 0,300
GPT Image 1.5ab 0,160
GPT Image 1 Miniab 0,043
GPT Image 2ab 0,200
Gemini 2.5 Flash0,047
Gemini 3 Pro0,240

Übersetzung

ArtPreis
Dokumentenübersetzung0,024 € pro 1000 Zeichen
Mindestgebühr: 0,50 €
Textübersetzung0,024 € pro 1000 Zeichen
GlossaryGratis

Weitere Funktionen

  • Webseiten lesen: verbrauchsbasiert nach Token
  • Workflow Wizard: 0,10 € pro Workflow
  • Audiotranskription: 1,00 € pro Stunde

Verwandte Seiten

War diese Seite hilfreich?