AI-token-tæller
Tæl tokens for GPT, Claude, Gemini, Llama og enhver AI-model. Estimer API-omkostninger med tilpassede priser. Gratis og privat i din browser.
Hvad er en token i AI?
En token er den grundlæggende tekst-enhed, som AI-modeller behandler. På engelsk er ca. 1 token = 4 tegn eller cirka 0,75 ord. For eksempel er \"hello\" normalt 1 token, mens \"unbelievable\" kan opdeles i 2 tokens: \"un\" og \"believable\".
Fungerer dette værktøj til alle AI-modeller?
Ja. Dette værktøj bruger en universel tilnærmelsesalgoritme, der fungerer til alle store LLM-modeller, herunder GPT-4, GPT-3.5, Claude, Gemini, Llama, Mistral, DeepSeek og flere. Estimatet ligger typisk inden for 5-10% af nøjagtige tællinger.
Hvor præcis er token-tællingen?
Tællingen bruger en universel tilnærmelsesalgoritme baseret på BPE-tokeniseringsmønstre (Byte Pair Encoding). Giver nære estimater normalt inden for 5-10% men kan afvige lidt fra nøjagtige API-tællinger fordi hver model bruger sin egen tokenizer.
Hvordan estimerer jeg API-omkostninger?
Udvid sektionen Omkostningsestimat og indtast dine API-priser for input-, output- og cache-hit-tokens. Værktøjet beregner automatisk de estimerede omkostninger baseret på det talte token-antal og din pris per million tokens.
Bliver min tekst sendt til en server?
Nej. Al token-tælling sker helt i din browser. Din tekst forlader aldrig din enhed og sendes ikke til nogen server. Dette værktøj er 100% klientside for fuld privatliv.
Hvad er BPE-tokenisering?
BPE (Byte Pair Encoding) er den mest almindelige tokeniseringsmetode brugt af store sprogmodeller. Den fungerer ved iterativt at sammensmelte de hyppigste tegnpar i et træningskorpus og bygger et ordforråd, der balancerer effektivitet og dækning.
Hvordan adskiller tokens sig mellem sprog?
Token-effektivitet varierer betydeligt mellem sprog. Engelsk tekst gennemsnitligt cirka 1 token per 4 tegn. CJK-sprog (kinesisk, japansk, koreansk) kræver typisk 1,5-2 tegn per token på grund af kompleksiteten i deres skriftsystemer.
Hvad er forskellen mellem tokens og ord?
Tokens er ikke det samme som ord. Almindelige engelske ord er normalt 1 token, men lange eller sjældne ord kan opdeles i flere tokens. Tegn og mellemrum kan også være uafhængige tokens.
Kan jeg bruge dette til fine-tuned eller tilpassede modeller?
Ja. Den universelle tilnærmelsesalgoritme fungerer for enhver model uafhængigt af specifik tokenizer. Selvom estimatet kan variere lidt, giver det en pålidelig approksimation til omkostningsestimat og tekstplanlægning.
Hvordan fungerer cache-hit-prissætning?
Mange AI-udbydere som OpenAI og Anthropic tilbyder nedsatte priser for cachelagrede tokens. Cache-hit-tokens prises typisk til 10% af den normale inputpris. Indtast din cache-hit-pris for at se besparelser.