Billing · 2 Min. Lesezeit
KI-Kapazität und Preise
Wie der Token-Verbrauch bepreist wird, welche Kapazitätsstufen es gibt und die Preistabelle je Modell.
Läuft ein Modell, verbraucht es Tokens. Wie viele, hängt davon ab, wie umfangreich die Anfrage war und wie lang die Antwort ausfällt — das lässt sich vorab nicht exakt vorhersagen. Etwa 95 % des gesamten Token-Verbrauchs entfallen auf Input-Tokens, die restlichen 5 % auf Output.
Wie Tokens gezählt werden
Abschnitt betitelt „Wie Tokens gezählt werden“Modelle bepreisen Input- und Output-Tokens unterschiedlich, sodass dieselbe Aufgabe je nach eingesetztem Modell unterschiedlich viel kosten kann.
Kapazitätsstufen
Abschnitt betitelt „Kapazitätsstufen“| Option | Beschreibung | Monatliche Kosten |
|---|---|---|
| Basisstufe | Grundstufe, entspricht etwa 8.000 Anfragen | 92 € |
| Erweitert | Zusätzliche Kapazität in Schritten von 92 € | 184 € |
Preise pro Million Tokens
Abschnitt betitelt „Preise pro Million Tokens“Die Preise verstehen sich zzgl. USt. und in Euro.
| Modelltyp | Anbieter | Modell | EUR / Input Mio. | EUR / Output Mio. |
|---|---|---|---|---|
| Closed Source | OpenAI | GPT-5.2 | 1,6 | 12,9 |
| Closed Source | OpenAI | GPT-5 | 1,2 | 9,2 |
| Closed Source | OpenAI | GPT-5 mini | 0,2 | 1,9 |
| Closed Source | OpenAI | GPT-4 | 27,7 | 55,4 |
| Closed Source | OpenAI | GPT-4o | 2,3 | 9,2 |
| Closed Source | OpenAI | GPT-4o mini | 0,1 | 0,6 |
| Closed Source | OpenAI | o3-mini | 1,0 | 4,1 |
| Closed Source | OpenAI | GPT-4.1 | 1,9 | 7,4 |
| Closed Source | OpenAI | GPT-4.1 mini | 0,4 | 1,5 |
| Closed Source | OpenAI | GPT-4.1 nano | 0,1 | 0,4 |
| Open Source | OpenAI | GPT-OSS-120B | 0,3 | 0,9 |
| Closed Source | Mistral | Mistral Large | 1,9 | 5,5 |
| Closed Source | Anthropic | Claude 4.5 Haiku | 0,9 | 4,6 |
| Closed Source | Anthropic | Claude Opus 4 | 13,8 | 69,2 |
| Closed Source | Anthropic | Claude 4 Sonnet | 2,8 | 13,8 |
| Closed Source | Anthropic | Claude 4.5 Sonnet | 2,8 | 13,8 |
| Closed Source | Anthropic | Claude Opus 4.1 | 13,8 | 69,2 |
| Open Source | Meta | Llama 3.3 70B | 0,8 | 0,8 |
| Closed Source | OpenAI | GPT-5.3 Instant | 1,6 | 12,9 |
| Closed Source | OpenAI | GPT-5.4 | 2,3 | 13,8 |
| Closed Source | OpenAI | GPT-5.5 | 4,6 | 27,7 |
| Closed Source | OpenAI | GPT-5.1 (Azure) | 1,2 | 9,2 |
| Closed Source | OpenAI | GPT-5 mini (Azure) | 0,2 | 1,9 |
| Closed Source | OpenAI | GPT-5 nano (Azure) | 0,1 | 0,4 |
| Closed Source | OpenAI | GPT-4.1 mini (Azure) | 0,4 | 1,5 |
| Closed Source | OpenAI | GPT-4.1 nano (Azure) | 0,1 | 0,4 |
| Closed Source | Anthropic | Claude 4.6 Sonnet | 2,8 | 13,8 |
| Closed Source | Anthropic | Claude 4.6 Opus | 4,6 | 23,1 |
| Closed Source | Anthropic | Claude 4.7 Opus | 4,6 | 23,1 |
| Closed Source | Mistral | Mistral 4 Small | 0,1 | 0,6 |
| Closed Source | Mistral | Mistral 3.5 Medium | 1,4 | 6,9 |
| Closed Source | Gemini 2.5 Flash | 0,3 | 2,3 | |
| Closed Source | Gemini 2.5 Pro | 1,2 | 9,2 | |
| Closed Source | Gemini 3.1 Pro Preview | 1,8 | 11,1 | |
| Closed Source | Gemini 3.1 Flash-Lite Preview | 0,2 | 1,4 | |
| Open Source | In Schweden gehostet – von Intric verwaltet | 0,0 | 0,0 | |
| Closed Source | OpenAI | Whisper | 0,3 | — |
| Open Source | Königliche Bibliothek Schwedens | KB - Whisper * | 0,1 | — |
| Closed Source | OpenAI | GPT - Image-1 | — | ca. 0,3 € pro Bild |
Bei Transkription entspricht der Preis pro Anfrage 60 Minuten Aufnahmezeit.
Individuelle und selbst gehostete Modelle
Abschnitt betitelt „Individuelle und selbst gehostete Modelle“Bei einem individuellen oder selbst gehosteten Modell kennt Intric den Preis nicht automatisch — ein Administrator legt die Token-Kosten direkt in der Modellkonfiguration fest. Wo das konfiguriert wird, steht unter Modelle; halte den Wert aktuell, denn ein veralteter oder fehlender Preis führt bei diesem Modell zu zu niedrig oder zu hoch ausgewiesenen Zahlen.
Wie die Modellwahl die Kosten beeinflusst
Abschnitt betitelt „Wie die Modellwahl die Kosten beeinflusst“Ein leistungsfähigeres, teureres Modell für eine einfache Aufgabe zu wählen, kostet mehr, ohne das Ergebnis zwangsläufig zu verbessern. Reserviere die teuersten Modelle für Aufgaben, die ihre Denkfähigkeit wirklich brauchen, und setze für die alltägliche Arbeit auf ein sparsames oder schnelles Modell — wie diese Wahl je Assistent getroffen wird, steht unter Sprachmodell.