Tout le monde utilise l'IA. Personne ne comprend les tokens.

Tout le monde utilise l'IA. Personne ne comprend les tokens.

Vous payez pour quelque chose que vous ne voyez jamais. Il est temps que ça change.

Chaque fois que vous envoyez un message à ChatGPT, Claude ou Gemini, une comptabilité invisible s'enclenche. Pas en mots. Pas en caractères. En tokens. Et si vous ne savez pas ce que c'est, vous naviguez à l'aveugle dans un système conçu pour mesurer chaque syllabe que vous produisez.

Les tokens sont la monnaie cachée de l'intelligence artificielle. Comprendre leur fonctionnement, c'est comprendre pourquoi votre IA "oublie" ce que vous lui avez dit, pourquoi certaines requêtes coûtent plus cher que d'autres, et comment obtenir de meilleurs résultats pour moins cher. Voici tout ce que vous devez savoir.

Qu'est-ce qu'un token, exactement ?

Un token n'est ni un mot, ni une lettre. C'est un fragment de texte que le modèle de langage utilise comme unité de base pour lire et générer du contenu. Concrètement :

  • Le mot "bonjour" compte comme 1 token.
  • Le mot "extraordinaire" peut en compter 3 ou 4.
  • Un espace, une ponctuation, un préfixe comme "re-" peuvent chacun former un token distinct.
  • En anglais, 1 token représente environ 4 caractères. En français, la moyenne est légèrement plus haute en raison des accents et de la morphologie des mots.

Les modèles comme GPT-4 ou Claude utilisent ce découpage parce qu'il reflète des patterns statistiques dans le langage : certaines syllabes apparaissent si souvent ensemble qu'il est plus efficace de les traiter comme un bloc unique. C'est une décision d'ingénierie, pas linguistique.

Pourquoi les tokens ont-ils un impact direct sur vous ?

Il y a deux raisons concrètes pour lesquelles vous devriez vous y intéresser : le coût et la mémoire.

Le coût : vous payez au token, pas au mot

Quand vous utilisez une API comme celle d'OpenAI ou d'Anthropic, la facturation se fait en milliers de tokens — souvent appelés MTok. Le prix varie selon le modèle : GPT-4o facture différemment des tokens en entrée (ce que vous envoyez) et en sortie (ce que l'IA génère). Un long contexte, un document joint, un historique de conversation chargé : tout cela s'additionne.

Même sur des outils en abonnement fixe comme ChatGPT Plus, les tokens définissent des limites d'utilisation. Dépasser un certain volume déclenche des ralentissements ou des restrictions. Ce n'est pas un bug. C'est la mécanique du système.

La mémoire : la fenêtre de contexte a une taille fixe

Chaque modèle dispose d'une fenêtre de contexte, exprimée en tokens. GPT-4 Turbo peut traiter jusqu'à 128 000 tokens. Claude 3.5 Sonnet monte à 200 000. Gemini 1.5 Pro annonce jusqu'à 1 million.

Au-delà de cette limite, le modèle n'a plus accès aux informations antérieures. Il ne les "oublie" pas au sens humain : elles sont simplement hors de portée. Si votre conversation est longue, vos premières instructions peuvent disparaître du champ de vision du modèle. C'est pourquoi il est parfois utile de récapituler vos consignes clés en cours de session.

Un exemple concret pour tout clarifier

Prenons cette phrase : "L'intelligence artificielle transforme les entreprises."

Elle contient 7 mots, mais environ 12 à 14 tokens selon le modèle utilisé — notamment à cause des apostrophes, des accents et des terminaisons verbales. Si vous joignez un PDF de 10 pages à votre requête, vous ajoutez potentiellement 3 000 à 5 000 tokens supplémentaires avant même que l'IA commence à répondre.

Multiplié par des centaines d'appels quotidiens dans une entreprise, cela représente une somme non négligeable — et un paramètre à intégrer dans toute stratégie d'adoption de l'IA.

Comment optimiser son usage des tokens ?

  • Soyez précis dans vos prompts. Un message court et ciblé consomme moins de tokens qu'un long paragraphe vague.
  • Évitez les répétitions inutiles. Reformuler plusieurs fois la même consigne gonfle le contexte sans améliorer le résultat.
  • Utilisez des instructions système. Dans les outils avancés, les instructions en amont (system prompt) permettent de cadrer le comportement de l'IA sans surcharger chaque message.
  • Segmentez les longs documents. Plutôt que d'envoyer un fichier entier, extrayez les passages pertinents.

Ce que les tokens révèlent sur la nature de l'IA

Au fond, comprendre les tokens, c'est comprendre que l'IA ne "lit" pas comme un humain. Elle ne saisit pas le sens d'un texte de manière globale et intuitive. Elle le découpe, probabilise et reconstruit fragment par fragment. Cette mécanique explique à la fois ses capacités remarquables et ses limites parfois déconcertantes.

Un modèle qui génère du texte cohérent ne "sait" pas ce qu'il dit. Il prédit le token le plus probable à chaque étape. C'est puissant. C'est aussi fondamentalement différent de la compréhension humaine.

Conclusion : la transparence comme levier de performance

Les tokens ne sont pas un détail technique réservé aux développeurs. Ce sont les règles du jeu de tout outil d'IA moderne. Ceux qui les comprennent écrivent de meilleurs prompts, contrôlent leurs coûts, et obtiennent des résultats plus fiables.

La prochaine fois que votre IA semble vous avoir "oublié" ou qu'une facture d'API vous surprend, vous saurez exactement pourquoi. Et vous saurez quoi faire.


— Reservoir Live