Узнайте, какую часть контекстного окна модели использует ваш промпт и что в него помещается

Настройка
токенов

Используется для оценки, сколько элементов такого размера помещается.

Использование окна
0% 0 / 0
Система Ввод Вывод Свободно
0
Использовано
0
Осталось
0
Помещается элементов

Количество токенов оценочное; оставьте запас для ответа модели.


О Калькулятор контекстного окна ИИ

Калькулятор контекстного окна ИИ показывает, сколько из контекстного окна модели занимает ваш запрос и сколько места остается. Выберите модель — размеры окон для популярных моделей ИИ встроены — или введите пользовательское окно, затем установите токены системного запроса, входные/диалоговые токены и выходные токены, которые вы резервируете для ответа.

Индикатор использования визуализирует разделение между системой, вводом, зарезервированным выходом и свободным пространством, с точным количеством использованных и оставшихся токенов. Введите типичный размер документа или сообщения в токенах, и калькулятор скажет, сколько еще таких элементов поместится — или на сколько токенов вы превысили лимит.

Он отвечает на повседневные вопросы RAG и чат-ботов: сколько статей поддержки поместится рядом с системным запросом, или когда историю разговора нужно урезать. Инструмент бесплатный и мгновенный; цифры токенов являются оценкой, поэтому оставляйте разумный запас для ответа модели.

Как использовать Калькулятор контекстного окна ИИ

  1. Выберите модель, чтобы загрузить ее контекстное окно, или введите пользовательский размер окна в токенах.
  2. Введите токены вашего системного запроса и входные или диалоговые токены.
  3. Установите выходные токены, которые вы хотите зарезервировать для ответа модели.
  4. При желании введите количество токенов на документ или сообщение, чтобы увидеть, сколько элементов поместится.
  5. Прочитайте индикатор использования, количество использованных и оставшихся токенов, а также вердикт о том, помещается ли всё в лимит или он превышен.

Часто задаваемые вопросы

Это максимальное количество токенов, которое модель может обработать за один запрос — системный запрос, история разговора, документы и сгенерированный ответ все делят этот единый бюджет.

Ответ генерируется внутри того же окна, что и ваш ввод. Если запрос полностью заполняет окно, у модели не остается места для ответа, и он обрезается — резервируйте реалистичный запас.

Калькулятор делит свободное пространство — окно минус система, ввод и зарезервированный выход — на введенный вами размер токенов на элемент, показывая, сколько еще документов или сообщений такого размера поместится.

Инструмент показывает превышение в токенах. Урежьте историю разговора, обобщите или разбейте документы на части, сократите системный запрос или переключитесь на модель с большим контекстным окном.

Нет — это оценки, и каждая модель токенизирует текст немного по-разному. Оставляйте запас прочности, а не планируйте до последнего токена, особенно для многоязычного или насыщенного кодом контента.

Поделиться

Популярные запросы
калькулятор контекстного окна калькулятор бюджета токенов размер контекста llm сколько токенов помещается длина контекста ии планировщик токенов промпта
Нужна помощь?
Возникла проблема с этим инструментом? Сообщите нам.
Сообщить о проблеме

Добавьте этот бесплатный инструмент на свой сайт — скопируйте и вставьте код ниже.