Fakturering · 2 min lesing
KI-kapasitet og priser
Hvordan tokenforbruk prises, kapasitetsnivåer, og pristabellen per modell.
Når en modell kjører, forbruker den tokens. Hvor mange avhenger av hvor mye materiale som gikk inn i forespørselen og hvor langt svaret er — dette lar seg ikke forutsi nøyaktig på forhånd. Om lag 95 % av det totale tokenforbruket er input-tokens, med de resterende 5 % som output.
Hvordan tokens telles
Section titled “Hvordan tokens telles”Ulike modeller priser input- og output-tokens forskjellig, så samme oppgave kan koste ulikt avhengig av hvilken modell som håndterer den.
Kapasitetsnivåer
Section titled “Kapasitetsnivåer”| Alternativ | Beskrivelse | Månedlig kostnad |
|---|---|---|
| Grunnivå | Grunnleggende nivå, tilsvarer om lag 8 000 spørringer | 92 € |
| Utvidet | Ekstra kapasitet i trinn på 92 € | 184 € |
Priser per million tokens
Section titled “Priser per million tokens”Prisene er eksklusive MVA og oppgitt i euro.
| Modelltype | Leverandør | Modell | EUR / input M | EUR / output M |
|---|---|---|---|---|
| Lukket kildekode | OpenAI | GPT-5.2 | 1,6 | 12,9 |
| Lukket kildekode | OpenAI | GPT-5 | 1,2 | 9,2 |
| Lukket kildekode | OpenAI | GPT-5 mini | 0,2 | 1,9 |
| Lukket kildekode | OpenAI | GPT-4 | 27,7 | 55,4 |
| Lukket kildekode | OpenAI | GPT-4o | 2,3 | 9,2 |
| Lukket kildekode | OpenAI | GPT-4o mini | 0,1 | 0,6 |
| Lukket kildekode | OpenAI | o3-mini | 1,0 | 4,1 |
| Lukket kildekode | OpenAI | GPT-4.1 | 1,9 | 7,4 |
| Lukket kildekode | OpenAI | GPT-4.1 mini | 0,4 | 1,5 |
| Lukket kildekode | OpenAI | GPT-4.1 nano | 0,1 | 0,4 |
| Åpen kildekode | OpenAI | GPT-OSS-120B | 0,3 | 0,9 |
| Lukket kildekode | Mistral | Mistral Large | 1,9 | 5,5 |
| Lukket kildekode | Anthropic | Claude 4.5 Haiku | 0,9 | 4,6 |
| Lukket kildekode | Anthropic | Claude Opus 4 | 13,8 | 69,2 |
| Lukket kildekode | Anthropic | Claude 4 Sonnet | 2,8 | 13,8 |
| Lukket kildekode | Anthropic | Claude 4.5 Sonnet | 2,8 | 13,8 |
| Lukket kildekode | Anthropic | Claude Opus 4.1 | 13,8 | 69,2 |
| Åpen kildekode | Meta | Llama 3.3 70B | 0,8 | 0,8 |
| Lukket kildekode | OpenAI | GPT-5.3 Instant | 1,6 | 12,9 |
| Lukket kildekode | OpenAI | GPT-5.4 | 2,3 | 13,8 |
| Lukket kildekode | OpenAI | GPT-5.5 | 4,6 | 27,7 |
| Lukket kildekode | OpenAI | GPT-5.1 (Azure) | 1,2 | 9,2 |
| Lukket kildekode | OpenAI | GPT-5 mini (Azure) | 0,2 | 1,9 |
| Lukket kildekode | OpenAI | GPT-5 nano (Azure) | 0,1 | 0,4 |
| Lukket kildekode | OpenAI | GPT-4.1 mini (Azure) | 0,4 | 1,5 |
| Lukket kildekode | OpenAI | GPT-4.1 nano (Azure) | 0,1 | 0,4 |
| Lukket kildekode | Anthropic | Claude 4.6 Sonnet | 2,8 | 13,8 |
| Lukket kildekode | Anthropic | Claude 4.6 Opus | 4,6 | 23,1 |
| Lukket kildekode | Anthropic | Claude 4.7 Opus | 4,6 | 23,1 |
| Lukket kildekode | Mistral | Mistral 4 Small | 0,1 | 0,6 |
| Lukket kildekode | Mistral | Mistral 3.5 Medium | 1,4 | 6,9 |
| Lukket kildekode | Gemini 2.5 Flash | 0,3 | 2,3 | |
| Lukket kildekode | Gemini 2.5 Pro | 1,2 | 9,2 | |
| Lukket kildekode | Gemini 3.1 Pro Preview | 1,8 | 11,1 | |
| Lukket kildekode | Gemini 3.1 Flash-Lite Preview | 0,2 | 1,4 | |
| Åpen kildekode | Sverigehostet - driftet av Intric | 0,0 | 0,0 | |
| Lukket kildekode | OpenAI | Whisper | 0,3 | — |
| Åpen kildekode | Kungliga biblioteket | KB - Whisper * | 0,1 | — |
| Lukket kildekode | OpenAI | GPT - Image-1 | — | Ca. 0,3 € per bilde |
For transkripsjon tilsvarer prisen per spørring 60 minutters opptak.
Egendefinerte og selvhostede modeller
Section titled “Egendefinerte og selvhostede modeller”Intric kjenner ikke automatisk prisen på en egendefinert eller selvhostet modell, så en administrator setter tokenkostnaden direkte i modellens konfigurasjon. Se Modeller for hvor dette konfigureres, og hold verdien oppdatert — en foreldet eller manglende kostnad gir under- eller overrapporterte tall for den modellen.
Hvordan modellvalg påvirker kostnaden
Section titled “Hvordan modellvalg påvirker kostnaden”Å velge en mer kapabel og dyrere modell til en enkel oppgave koster mer uten nødvendigvis å gi et bedre resultat. Reserver de dyreste modellene til oppgaver som faktisk trenger deres resonneringsevne, og bruk et økonomisk eller raskt alternativ til hverdagsarbeid — se Fullføringsmodell for hvordan det valget gjøres per assistent.