Veja quanto da janela de contexto de um modelo o seu prompt usa e o que cabe

Configuração
tokens

Usado para estimar quantos itens deste tamanho cabem.

Utilização da janela
0% 0 / 0
Sistema Entrada Saída Livre
0
Usado
0
Restante
0
Itens que cabem

As contagens de tokens são estimativas; reserve margem para a resposta do modelo.


Sobre Calculadora de janela de contexto de IA

A calculadora de janela de contexto de IA mostra quanto da janela de contexto de um modelo o seu prompt consome e quanto espaço resta. Escolha um modelo — os tamanhos de janela dos modelos de IA populares já estão incluídos — ou digite uma janela personalizada, depois defina os tokens do seu prompt de sistema, os tokens de entrada/conversa e os tokens de saída reservados para a resposta.

Uma barra de uso visualiza a divisão entre sistema, entrada, saída reservada e espaço livre, com contagens exatas de usado e restante. Digite o tamanho típico em tokens de um documento ou mensagem e a calculadora informa quantos itens desse tamanho ainda cabem — ou por quantos tokens você está acima do limite.

Ela responde às perguntas cotidianas de RAG e chatbot: quantos artigos de suporte cabem junto com o prompt de sistema, ou quando um histórico de conversa precisa ser cortado. A ferramenta é gratuita e instantânea; os números de tokens são estimativas, então mantenha uma margem sensata para a resposta do modelo.

Como usar Calculadora de janela de contexto de IA

  1. Selecione um modelo para carregar sua janela de contexto, ou digite um tamanho de janela personalizado em tokens.
  2. Digite os tokens do seu prompt de sistema e os tokens de entrada ou conversa.
  3. Defina os tokens de saída que deseja reservar para a resposta do modelo.
  4. Opcionalmente, digite os tokens por documento ou mensagem para ver quantos itens cabem.
  5. Leia a barra de uso, as contagens de usado e restante, e o veredito de encaixe ou excesso de limite.

Perguntas frequentes

É o número máximo de tokens que um modelo pode processar em uma requisição — prompt de sistema, histórico de conversa, documentos e a resposta gerada compartilham esse mesmo orçamento.

A resposta é gerada dentro da mesma janela da sua entrada. Se o prompt preenche a janela completamente, o modelo não tem espaço para responder e a resposta fica truncada — reserve uma margem realista.

A calculadora divide o espaço livre — janela menos sistema, entrada e saída reservada — pelo tamanho de token por item que você informa, indicando quantos documentos ou mensagens desse tamanho ainda cabem.

A ferramenta mostra o excesso em tokens. Corte o histórico de conversa, resuma ou divida documentos em partes, encurte o prompt de sistema ou mude para um modelo com uma janela de contexto maior.

Não — são estimativas, e cada modelo tokeniza o texto de forma ligeiramente diferente. Deixe uma margem de segurança em vez de planejar até o último token, especialmente para conteúdo multilíngue ou repleto de código.


Pesquisas populares
calculadora janela de contexto calculadora orçamento de tokens tamanho de contexto llm quantos tokens cabem comprimento de contexto ia planeador de tokens
Precisa de ajuda?
Encontrou um problema com esta ferramenta? Avise a nossa equipa.
Relatar um problema

Adicione esta ferramenta gratuita ao seu próprio site — copie e cole o código abaixo.