Voyez quelle part de la fenêtre de contexte votre invite utilise et ce qui tient

Configuration
jetons

Sert à estimer combien d'éléments de cette taille tiennent.

Utilisation de la fenêtre
0% 0 / 0
Système Entrée Sortie Libre
0
Utilisé
0
Restant
0
Éléments

Le nombre de jetons est estimé ; gardez une marge pour la réponse du modèle.


À propos de Calculateur de fenêtre de contexte IA

La calculatrice de fenêtre de contexte IA montre quelle part de la fenêtre de contexte d'un modèle votre invite consomme et combien d'espace il reste. Choisissez un modèle — les tailles de fenêtre des modèles d'IA populaires sont intégrées — ou entrez une fenêtre personnalisée, puis définissez vos tokens d'invite système, vos tokens d'entrée/conversation et les tokens de sortie que vous réservez pour la réponse.

Une barre d'utilisation visualise la répartition entre système, entrée, sortie réservée et espace libre, avec des comptes exacts d'utilisation et de reste. Entrez la taille type en tokens d'un document ou d'un message et la calculatrice vous indique combien d'éléments de cette taille peuvent encore tenir — ou de combien de tokens vous dépassez la limite.

Elle répond aux questions quotidiennes du RAG et des chatbots : combien d'articles d'assistance tiennent à côté de l'invite système, ou quand un historique de conversation doit être raccourci. L'outil est gratuit et instantané; les chiffres de tokens sont des estimations, gardez donc une marge raisonnable pour la réponse du modèle.

Comment utiliser Calculateur de fenêtre de contexte IA

  1. Sélectionnez un modèle pour charger sa fenêtre de contexte, ou entrez une taille de fenêtre personnalisée en tokens.
  2. Entrez vos tokens d'invite système et vos tokens d'entrée ou de conversation.
  3. Définissez les tokens de sortie que vous souhaitez réserver pour la réponse du modèle.
  4. Entrez éventuellement les tokens par document ou message pour voir combien d'éléments peuvent tenir.
  5. Lisez la barre d'utilisation, les comptes utilisés et restants, et le verdict de capacité ou de dépassement.

Questions fréquentes

C'est le nombre maximal de tokens qu'un modèle peut traiter en une seule requête — invite système, historique de conversation, documents et réponse générée se partagent tous ce même budget.

La réponse est générée dans la même fenêtre que votre entrée. Si l'invite remplit entièrement la fenêtre, le modèle n'a plus de place pour répondre et la réponse est tronquée — réservez une marge réaliste.

La calculatrice divise l'espace libre — la fenêtre moins le système, l'entrée et la sortie réservée — par la taille de token par élément que vous entrez, indiquant combien de documents ou messages supplémentaires de cette taille peuvent encore tenir.

L'outil affiche le dépassement en tokens. Réduisez l'historique de conversation, résumez ou découpez les documents, raccourcissez l'invite système, ou passez à un modèle avec une fenêtre de contexte plus grande.

Non — ce sont des estimations, et chaque modèle tokenise le texte légèrement différemment. Gardez une marge de sécurité plutôt que de planifier au token près, surtout pour du contenu multilingue ou riche en code.


Recherches populaires
calculateur fenêtre de contexte calculateur budget jetons taille de contexte llm combien de jetons tiennent longueur de contexte ia planificateur de jetons
Besoin d'aide ?
Un problème avec cet outil ? Signalez-le à notre équipe.
Signaler un problème

Ajoutez cet outil gratuit à votre propre site web — copiez-collez le code ci-dessous.