Zum Inhalt springen
Service status

Tippen, um zu suchen

Billing · 2 Min. Lesezeit

KI-Kapazität und Preise

Wie der Token-Verbrauch bepreist wird, welche Kapazitätsstufen es gibt und die Preistabelle je Modell.

Läuft ein Modell, verbraucht es Tokens. Wie viele, hängt davon ab, wie umfangreich die Anfrage war und wie lang die Antwort ausfällt — das lässt sich vorab nicht exakt vorhersagen. Etwa 95 % des gesamten Token-Verbrauchs entfallen auf Input-Tokens, die restlichen 5 % auf Output.

Modelle bepreisen Input- und Output-Tokens unterschiedlich, sodass dieselbe Aufgabe je nach eingesetztem Modell unterschiedlich viel kosten kann.

Option Beschreibung Monatliche Kosten
Basisstufe Grundstufe, entspricht etwa 8.000 Anfragen 92 €
Erweitert Zusätzliche Kapazität in Schritten von 92 € 184 €

Die Preise verstehen sich zzgl. USt. und in Euro.

Modelltyp Anbieter Modell EUR / Input Mio. EUR / Output Mio.
Closed Source OpenAI GPT-5.2 1,6 12,9
Closed Source OpenAI GPT-5 1,2 9,2
Closed Source OpenAI GPT-5 mini 0,2 1,9
Closed Source OpenAI GPT-4 27,7 55,4
Closed Source OpenAI GPT-4o 2,3 9,2
Closed Source OpenAI GPT-4o mini 0,1 0,6
Closed Source OpenAI o3-mini 1,0 4,1
Closed Source OpenAI GPT-4.1 1,9 7,4
Closed Source OpenAI GPT-4.1 mini 0,4 1,5
Closed Source OpenAI GPT-4.1 nano 0,1 0,4
Open Source OpenAI GPT-OSS-120B 0,3 0,9
Closed Source Mistral Mistral Large 1,9 5,5
Closed Source Anthropic Claude 4.5 Haiku 0,9 4,6
Closed Source Anthropic Claude Opus 4 13,8 69,2
Closed Source Anthropic Claude 4 Sonnet 2,8 13,8
Closed Source Anthropic Claude 4.5 Sonnet 2,8 13,8
Closed Source Anthropic Claude Opus 4.1 13,8 69,2
Open Source Meta Llama 3.3 70B 0,8 0,8
Closed Source OpenAI GPT-5.3 Instant 1,6 12,9
Closed Source OpenAI GPT-5.4 2,3 13,8
Closed Source OpenAI GPT-5.5 4,6 27,7
Closed Source OpenAI GPT-5.1 (Azure) 1,2 9,2
Closed Source OpenAI GPT-5 mini (Azure) 0,2 1,9
Closed Source OpenAI GPT-5 nano (Azure) 0,1 0,4
Closed Source OpenAI GPT-4.1 mini (Azure) 0,4 1,5
Closed Source OpenAI GPT-4.1 nano (Azure) 0,1 0,4
Closed Source Anthropic Claude 4.6 Sonnet 2,8 13,8
Closed Source Anthropic Claude 4.6 Opus 4,6 23,1
Closed Source Anthropic Claude 4.7 Opus 4,6 23,1
Closed Source Mistral Mistral 4 Small 0,1 0,6
Closed Source Mistral Mistral 3.5 Medium 1,4 6,9
Closed Source Google Gemini 2.5 Flash 0,3 2,3
Closed Source Google Gemini 2.5 Pro 1,2 9,2
Closed Source Google Gemini 3.1 Pro Preview 1,8 11,1
Closed Source Google Gemini 3.1 Flash-Lite Preview 0,2 1,4
Open Source Google In Schweden gehostet – von Intric verwaltet 0,0 0,0
Closed Source OpenAI Whisper 0,3
Open Source Königliche Bibliothek Schwedens KB - Whisper * 0,1
Closed Source OpenAI GPT - Image-1 ca. 0,3 € pro Bild

Bei Transkription entspricht der Preis pro Anfrage 60 Minuten Aufnahmezeit.

Bei einem individuellen oder selbst gehosteten Modell kennt Intric den Preis nicht automatisch — ein Administrator legt die Token-Kosten direkt in der Modellkonfiguration fest. Wo das konfiguriert wird, steht unter Modelle; halte den Wert aktuell, denn ein veralteter oder fehlender Preis führt bei diesem Modell zu zu niedrig oder zu hoch ausgewiesenen Zahlen.

Ein leistungsfähigeres, teureres Modell für eine einfache Aufgabe zu wählen, kostet mehr, ohne das Ergebnis zwangsläufig zu verbessern. Reserviere die teuersten Modelle für Aufgaben, die ihre Denkfähigkeit wirklich brauchen, und setze für die alltägliche Arbeit auf ein sparsames oder schnelles Modell — wie diese Wahl je Assistent getroffen wird, steht unter Sprachmodell.