Compteur de tokens gratuit pour GPT, Claude, Gemini et Llama
Collez votre texte, voyez le nombre de tokens instantanément. Aucun envoi, aucune inscription.
Les API de modèles de langage facturent au token, pas au caractère ni au mot, et chaque modèle découpe le texte en tokens différemment. Ce compteur de tokens (aussi appelé calculateur de tokens ou compteur de jetons) calcule le nombre de tokens localement, dans votre navigateur, avec la même famille d'encodage par paires d'octets (BPE) qu'utilisent les modèles d'OpenAI, puis estime les valeurs pour Claude, Gemini et Llama à partir de ce compte de base.
Rien de ce que vous collez n'est envoyé ni stocké : le calcul se fait entièrement sur votre appareil.
| Modèle | Tokens estimés | Fenêtre de contexte | Ça tient ? |
|---|---|---|---|
| GPT (OpenAI) | — | 1.05M | — |
| Claude (Anthropic) | — | 1M | — |
| Gemini (Google) | — | 1.05M | — |
| Llama (Meta) | — | 1M | — |
Le compte pour GPT est exact (encodage BPE compatible tiktoken, celui que le tokenizer officiel d'OpenAI utilise). Les valeurs pour Claude, Gemini et Llama sont des estimations calculées à partir du compte GPT, car ces fournisseurs ne publient pas de tokenizer utilisable côté navigateur ; comptez un écart d'environ 5 à 15 % avec le compte réel. Les fenêtres de contexte indiquées sont celles du modèle phare actuel de chaque fournisseur, vérifiées sur leur propre documentation.
Tokens par mot, en moyenne
Si vous n'avez pas encore de texte à coller, voici un repère de planification pour de la prose en anglais. Le code, le texte non anglais et une mise en forme inhabituelle changent tout : le code utilise en général 10 à 20 % de tokens en plus par caractère que la prose, car les tokenizers de la famille GPT ont été construits autour d'un vocabulaire de langage naturel.
| Texte | ≈ tokens (anglais) |
|---|---|
| 1 mot | ~1,3 token |
| 1 phrase (~15 mots) | ~20 tokens |
| 1 paragraphe (~100 mots) | ~130 tokens |
| 1 000 mots | ~1 300 à 1 500 tokens |
| 1 page (~500 mots) | ~650 à 750 tokens |
Ce sont des moyennes pour de la prose anglaise standard (le guide des tokenizers de Cohere et les benchmarks de la communauté OpenAI donnent tous deux environ 1,3 token par mot). Collez votre texte réel ci-dessus pour un compte exact plutôt qu'une estimation à partir de ce tableau.
Vous cherchez à estimer une facture d'API, pas juste à vérifier que ça tient ?
Cet outil compte les tokens ; il ne les tarifie pas. Les tarifs par token des API changent assez souvent pour qu'on les suive séparément.
Voir les tarifs réels de génération IA par clip, tous fournisseurs →Questions fréquentes
Qu'est-ce qu'un token ?
Un token est le fragment de texte qu'un modèle de langage traite réellement, en général quelques caractères ou une partie de mot plutôt qu'un mot entier. En français, un token correspond en moyenne à environ 4 caractères.
1 000 mots correspondent à combien de tokens ?
Environ 1 300 à 1 500 tokens pour de la prose anglaise standard, car un mot correspond en moyenne à environ 1,3 token. Les mots simples et courants tiennent souvent en 1 token ; les mots plus longs ou moins courants se découpent en 3 tokens ou plus.
Pourquoi Claude compte-t-il les tokens différemment de GPT ?
Chaque famille de modèles entraîne son propre tokenizer sur son propre vocabulaire, donc la même phrase se découpe en un nombre de fragments différent selon le modèle. Le tokenizer de GPT (o200k_base) est public et donne un compte exact utilisable dans un navigateur ; Anthropic n'en a pas publié qui fonctionne côté navigateur, c'est pourquoi le chiffre de Claude ici est une estimation plutôt qu'un compte exact.
Pourquoi le nombre de tokens compte-t-il ?
La plupart des API IA facturent au token et limitent le nombre de tokens qu'une requête ou une fenêtre de contexte peut contenir. Compter les tokens avant d'envoyer un prompt permet de savoir s'il tient dans la limite, et d'estimer son coût.
Ce compteur de tokens est-il exact pour tous les modèles ?
Il est exact pour les modèles GPT, qui utilisent un tokenizer public. Claude, Gemini et Llama ne publient pas de tokenizer utilisable dans un navigateur, donc ces valeurs sont des estimations basées sur le compte GPT.
Mon texte est-il envoyé quelque part ?
Non. Le calcul se fait entièrement dans votre navigateur via une bibliothèque locale ; le texte collé ne quitte jamais votre appareil.
