CapsurIA
CapsurIA

Guide · pour aller un cran plus loin

Les tokens, leurs limites, et le bon modèle

Comprendre ce qui se passe sous le capot, sans mal de tête.

Deux mots reviennent souvent quand on avance avec l'IA : les tokens et la fenêtre de contexte. Ça semble technique, mais l'idée est simple, et ça change vraiment ta façon de t'en servir.

Retour à l'accueil
Ton cap vers l'IA, On y va!

La brique de base

C'est quoi un token

Un token, c'est un petit morceau de texte. Souvent un mot court, parfois un bout de mot ou un signe de ponctuation. L'IA ne lit pas lettre par lettre ni mot par mot, elle avance token par token.

Une image pour retenir

Pense à des jetons dans un jeu de société. Chaque bout de ta phrase vaut quelques jetons. Pour te donner un ordre de grandeur, environ 100 tokens représentent à peu près 75 mots. Une page de texte, c'est quelques centaines de jetons.

Et surtout, tout est compté en tokens : ta question, le document que tu colles, et la réponse que l'IA rédige. Plus il y a de texte en jeu, plus il y a de jetons sur la table.

La mémoire de travail

La fenêtre de contexte

Chaque modèle a une mémoire limitée pour une même conversation. On l'appelle la « fenêtre de contexte », et elle se mesure en tokens. C'est tout ce que l'IA peut garder en tête d'un coup : tes messages, ses réponses, et les documents que tu lui as donnés.

Une image pour retenir

Imagine un tableau blanc d'une taille fixe. Tant qu'il reste de la place, tout s'écrit dessus. Mais quand il est plein, pour écrire du nouveau en bas, il faut effacer le haut. L'IA fait pareil : au-delà de sa fenêtre, elle oublie le début de la conversation.

Bonne nouvelle : ces fenêtres ont beaucoup grandi. Certains modèles gèrent aujourd'hui des centaines de milliers de tokens, parfois jusqu'à environ un million, soit l'équivalent de plusieurs livres. Ces chiffres évoluent vite, alors vérifie au besoin, mais l'idée reste la même.

Ce qui te concerne vraiment

Les deux limites à connaître

Dans la vraie vie, deux limites peuvent te toucher. Les comprendre t'évite bien des surprises.

  • La fenêtre de contexte : la mémoire d'une conversation. Au-delà, l'IA perd de vue le début.
  • Les limites d'usage : sur les versions gratuites surtout, tu as un nombre de messages ou une quantité de calcul par période. Les longues conversations, les gros documents et les modèles puissants consomment ce quota plus vite.

Les signaux

Repérer quand ça bloque

Tu n'as pas à surveiller un compteur. Ce sont des signes simples qui te préviennent que tu approches d'une limite :

  • L'IA oublie ce que tu as dit plus tôt, ou se met à te reposer des questions déjà réglées.
  • Elle se répète, perd le fil, ou mélange des éléments.
  • Elle t'indique qu'elle ne peut pas tout traiter d'un coup.

Quand ça arrive, tu as trois réflexes. Repartir sur une nouvelle conversation. Résumer l'essentiel pour la relancer proprement. Ou ne recoller que le morceau vraiment utile plutôt que tout le document.

Relancer proprement une longue discussion
Résume notre conversation en 5 points essentiels, pour que je reparte sur une nouvelle discussion sans rien perdre.

Le bon outil pour la bonne tâche

Choisir le bon modèle

Un même outil te propose souvent plusieurs modèles : un léger et rapide, un équilibré, et un puissant. Le réflexe gagnant, c'est d'accorder le modèle à la tâche, pas de prendre le plus gros par défaut.

Léger et rapide

Tâches simples

Reformuler, une petite question, une réponse courte. Rapide et économe, souvent le modèle gratuit.

Ex. : « corrige ce court message ».

Équilibré

Tâches courantes

Rédiger, résumer une page, organiser des idées. Le bon compromis pour la plupart de tes journées.

Ex. : « rédige ce courriel et propose deux tons ».

Puissant

Tâches complexes

Longs documents, analyse fine, raisonnement en plusieurs étapes. Grande fenêtre de contexte.

Ex. : « analyse ce rapport de 40 pages ».
Le truc qui aide : le modèle le plus puissant est plus lent et consomme ton quota plus vite. Pour une petite tâche, tu ne verras pas la différence. Garde la grosse puissance pour les moments qui la méritent. Pour savoir quel modèle vit dans quel outil, va voir mon guide « Le tour des outils ».

À quoi ça ressemble dans les vrais outils

Dans chaque outil, le choix se fait dans un petit menu, souvent juste à côté de la zone d'écriture. Tu y règles deux choses : le modèle, et un niveau d'effort ou de réflexion. Le nom exact des versions change souvent, mais la logique reste la même.

Menu de modèles dans Claude
Claude · tu choisis le modèle (Opus pour le complexe, Sonnet pour l'équilibre, Haiku pour la vitesse) et un niveau d'effort.
Menu de modèles dans ChatGPT
ChatGPT · tu règles un niveau d'intelligence (instantané, moyen, élevé) puis la version du modèle.
Menu de modèles dans Copilot
Copilot · tu choisis surtout la durée de réflexion : réponse rapide pour le simple, approfondie pour le complexe.

Bien gérer tes jetons

Rester dans les clous

Quelques habitudes simples t'évitent de gaspiller des tokens et de toucher les limites trop vite :

  • Sois concise : va droit au but, l'IA n'a pas besoin de romans.
  • Ne colle que le passage utile d'un document, pas le document entier.
  • Découpe un gros fichier en morceaux et traite-les un à un.
  • Quand la conversation s'embrouille, ouvre-en une nouvelle.
  • Pour poursuivre un long échange, demande d'abord un résumé, puis repars avec.

À ne pas oublier

Le réflexe vie privée

Coller un long document pour le faire résumer, c'est pratique, mais c'est aussi le moment où l'on transmet parfois des informations sensibles sans y penser. Avant de le déposer, retire ou remplace ce qui est confidentiel.

La méthode complète est dans mon guide dédié : la question d'or, la méthode crochets et les 11 choses à ne jamais faire.

Voir le guide vie privée

Ta petite fiche

À retenir

  • Un token est un petit morceau de texte. L'IA compte tout en tokens.
  • La fenêtre de contexte, c'est sa mémoire pour une conversation. Au-delà, elle oublie le début.
  • Attention aussi aux quotas d'usage, surtout en version gratuite.
  • Choisis le modèle selon la tâche : léger pour le simple, puissant pour le complexe.
  • Sois concise, ne colle que l'utile, repars à neuf quand ça s'embrouille.
  • Anonymise ce qui est sensible avant de coller un document.
Ton cap vers l'IA, On y va!
Comprendre ses limites, c'est mieux naviguer