Hoppa till innehåll
Boka offert
AI

Tokens — varför AI kostar det den kostar.

Vad är en token, och varför kostar AI olika mycket?

En token är den textbit en språkmodell räknar i — ungefär fyra tecken engelsk text, men bara två till tre tecken svensk, eftersom modellernas ordlistor är byggda på engelska. Du betalar per token in och per token ut. Det är därför samma fråga kostar mer på svenska än på engelska, och varför ett långt samtal blir dyrare för varje replik: hela historiken skickas in på nytt varje gång.

En språkmodell läser inte bokstäver och inte ord. Den läser tokens — textbitar som ligger någonstans däremellan.

Ordet hemsida blir troligen en enda token på svenska om det är vanligt nog i modellens ordlista. Ordet sökmotoroptimering blir förmodligen fyra eller fem. Ett mellanslag hör oftast ihop med ordet efter. Siffror hackas i småbitar.

Varför spelar det roll? För att varenda prislista för AI är satt i tokens, och för att antalet tokens i en svensk text inte alls är samma som i en engelsk text av samma längd. OpenAI anger själva tumregeln ungefär fyra tecken per token för engelska; vill du räkna exakt på din egen text finns Anthropics API för tokenräkning.

Svenska kostar mer. Ganska mycket mer.

Modellernas ordlistor byggdes på texter som till stor del är engelska. Engelska ord får därför egna tokens, medan svenska ord oftare måste sättas ihop av flera fragment.

Engelska ~4 tecken per token Svenska ~2,5–3 tecken per token Samma text på svenska blir grovt räknat 30–50 procent fler tokens.
Siffrorna är ungefärliga och varierar mellan modeller och mellan texter — facktext med långa sammansatta ord ligger i övre delen av spannet, enkel vardagsprosa i nedre. Mät på din egen text om beloppen betyder något.

Praktisk följd: när du jämför en amerikansk prislista med din egen faktiska kostnad, räkna med att svenska texter drar mer än exemplen i dokumentationen antyder.

Du betalar två gånger, och det ena är dyrare

Nästan alla leverantörer prissätter input och output separat, och output kostar typiskt tre till fem gånger så mycket per token.

Vad Vad det är Relativ kostnad
Input Allt du skickar in: din fråga, systemprompt, bifogade dokument, hela samtalshistoriken Lägre
Output Det modellen skriver tillbaka 3–5× högre per token
Cachad input Input som återanvänds mellan anrop och som leverantören får läsa billigare Ofta 10 % av vanlig input

Den tredje raden är den som sparar mest pengar i praktiken och den som flest missar.

Varför ett långt samtal blir dyrare för varje replik

Det här överraskar nästan alla: modellen minns ingenting.

Varje gång du skickar en ny replik skickas hela samtalet med igen — din första fråga, modellens första svar, din andra fråga, och så vidare. Modellen är statslös. “Minnet” är att klienten skickar med historiken varje gång. Det är därför tokenräkning görs på hela meddelandelistan, inte bara på den sista frågan.

Följden är att kostnaden per replik växer linjärt med samtalets längd:

Replik Vad som skickas in Ungefärlig input
1 Fråga 1 500 tokens
2 Fråga 1 + svar 1 + fråga 2 1 800 tokens
3 … + svar 2 + fråga 3 3 100 tokens
10 Hela historiken ~13 000 tokens

Ett samtal på tjugo repliker kostar alltså inte tjugo gånger den första repliken — det kostar betydligt mer. Det är därför det ofta lönar sig att starta ett nytt samtal när ämnet byts, i stället för att fortsätta i samma tråd.

Räkna om en prislista till något du förstår

Ta ett pris i dollar per miljon tokens och gör så här:

  1. En A4-sida svensk text ≈ 400 ord ≈ 900–1 100 tokens. Räkna med 1 000.
  2. En miljon tokens ≈ 1 000 A4-sidor.
  3. Kostar modellen 3 dollar per miljon input-tokens, kostar det alltså ungefär 3 öre att låta modellen läsa en A4-sida — vid en växelkurs kring tio kronor.

Det gör det lätt att se var pengarna faktiskt går. Att låta en modell läsa hela din produktkatalog en gång är oftast billigt. Att låta den läsa om den vid varje enskild kundfråga är det inte.

Vad det betyder om du köper AI-tjänster

Två frågor är värda att ställa till den som säljer:

  • Skickas hela historiken varje gång, eller bara det som behövs? Det är skillnaden mellan en kostnad som är platt och en som växer.
  • Cachas det som är oförändrat mellan anropen? Systemprompt och fasta dokument bör cachas. Görs det inte betalar du fullpris för att skicka samma text tusen gånger.

Får du inget rakt svar på de två frågorna är det ett rimligt skäl att fråga vidare.


Sidan är fri att läsa, citera och länka till. Hittar du ett fel eller en siffra som hunnit bli gammal — mejla hej@webraketen.se, så rättar vi och skriver ut ändringsdatumet.

Boka offert — svar inom 24 timmar