Une IA ne lit pas les phrases lettre par lettre, ni même mot par mot : elle les découpe en tokens. Un mot court et courant forme souvent un seul token ; un mot long ou rare en forme plusieurs, tout comme les nombres et la ponctuation. Le français demande en général un peu plus de tokens que l’anglais pour dire la même chose.

Les tokens servent d’unité de mesure un peu partout :

  • la fenêtre de contexte, ce qu’une IA peut lire d’un coup, se compte en tokens ;
  • les limites d’usage de certains abonnements dépendent de la longueur des échanges, donc des tokens ;
  • les API des éditeurs d’IA sont facturées au nombre de tokens envoyés et reçus.

Pour une équipe non technique, retenir le principe suffit : plus vous envoyez de texte, de fichiers ou d’historique, plus l’IA consomme de tokens. Une longue séance avec Claude Code, qui lit les fichiers de votre outil au fil du travail, en consomme bien plus qu’une simple question. C’est souvent ce qui explique qu’on atteigne la limite de son abonnement plus vite que prévu.

À ne pas confondre avec le jeton de sécurité, ce code temporaire qui prouve qu’on est bien connecté, ni avec les jetons des cryptomonnaies : en anglais, c’est le même mot, mais pas la même chose.

Exemple

À la trésorerie, Fabien atteignait vite la limite de son abonnement en joignant à chaque question tous les relevés bancaires de l’année ; il n’envoie plus que le mois concerné.