Beim Tokenisieren wird Text in kleine Bausteine zerlegt: haeufige Woerter werden zu einem Token, seltene oder lange Woerter in mehrere. Als Faustregel entsprechen 1.000 Token im Englischen etwa 750 Woertern. Sowohl die Eingabe (Prompt) als auch die Ausgabe zaehlen zu den Token, und API-Kosten werden pro Token berechnet. Das Token-Budget eines Modells ist durch sein Kontextfenster begrenzt.
