Kunskapskartan
Token
Förbrukningen mäts i text som passerar, inte i personer som använder.
Du betalar per användare och månad. Det talet är vad licensen kostar, inte vad tjänsten kostar att köra.
Det som körs räknas i tokens. En token är den minsta biten text en språkmodell räknar med, i svenska ungefär ett halvt till ett ord: ”och” är en, ”kommunstyrelsens” är fyra eller fem. Modellen läser varken tecken eller ord. Den läser tokens, och den räknar dem åt båda hållen, både det den får läsa och det den skriver.
Därför kostar en mening på svenska mer än samma mening på engelska. Långa sammansättningar blir fler bitar.
Två personer med samma licens kan förbruka hundra gånger olika mycket. Det beror inte på hur mycket de arbetar utan på hur mycket text de skickar in, och det syns inte för någon av dem. Den vanliga slutsatsen blir därför fel i båda riktningarna. Fler användare antas kosta mer, vilket det inte behöver göra. Ett dyrt flöde antas vara ett flitigt använt flöde. Det dyra flödet är oftast det som läser mycket och används sällan.
Så här går det fel
Fast pris per användare tecknas, eftersom det gick att budgetera. Sedan byggs ett flöde som skickar med hela ärendemappen i varje fråga.
Fakturan växer, och talet går inte att förhandla, eftersom det inte är en licens utan en avläsning av faktisk förbrukning. Det går inte att härleda heller: det finns en enda summa för trettio flöden. Det som saknas är alltså inte en prisförhandling utan en uppdelning, och den går inte att lägga till i efterhand.
Det här måste någon bestämma
Om förbrukningen ska gå att bryta ner, eller bara att betala.
Priset per användare sitter inte där texten räknas. Det sitter på dörren in. För att kunna styra behövs förbrukning per flöde, per ärendetyp och över tid, och det avgörs när lösningen byggs. Läggs mätningen på i efterhand kommer den bara åt det som råkade hamna i loggarna.