Alle Tools Kostenlos

Sehen Sie, wie viel des Kontextfensters eines Modells Ihr Prompt nutzt und was hineinpasst

Einrichtung
Tokens

Dient zur Schätzung, wie viele Elemente dieser Größe hineinpassen.

Fensternutzung
0% 0 / 0
System Eingabe Ausgabe Frei
0
Belegt
0
Verbleibend
0
Passende Elemente

Token-Anzahlen sind Schätzungen; halten Sie Spielraum für die Modellantwort frei.


Über KI-Kontextfenster-Rechner

Der KI-Kontextfenster-Rechner zeigt, wie viel vom Kontextfenster eines Modells Ihr Prompt verbraucht und wie viel Platz übrig bleibt. Wählen Sie ein Modell — die Fenstergrößen gängiger KI-Modelle sind integriert — oder geben Sie ein benutzerdefiniertes Fenster ein, legen Sie dann Ihre System-Prompt-Token, Eingabe-/Konversations-Token und die für die Antwort reservierten Ausgabe-Token fest.

Ein Nutzungsbalken visualisiert die Aufteilung zwischen System, Eingabe, reservierter Ausgabe und freiem Platz, mit exakten Werten für Verbrauch und verbleibenden Raum. Geben Sie die typische Token-Größe eines Dokuments oder einer Nachricht ein, und der Rechner sagt Ihnen, wie viele weitere Elemente dieser Größe noch hineinpassen — oder um wie viele Token Sie das Limit überschreiten.

Er beantwortet die alltäglichen RAG- und Chatbot-Fragen: Wie viele Support-Artikel passen neben den System-Prompt, oder wann muss ein Gesprächsverlauf gekürzt werden. Das Tool ist kostenlos und sofort verfügbar; Token-Zahlen sind Schätzungen, behalten Sie also einen sinnvollen Puffer für die Antwort des Modells.

So verwenden Sie KI-Kontextfenster-Rechner

  1. Wählen Sie ein Modell aus, um dessen Kontextfenster zu laden, oder geben Sie eine benutzerdefinierte Fenstergröße in Token ein.
  2. Geben Sie Ihre System-Prompt-Token sowie die Eingabe- oder Konversations-Token ein.
  3. Legen Sie die Ausgabe-Token fest, die Sie für die Antwort des Modells reservieren möchten.
  4. Geben Sie optional die Token pro Dokument oder Nachricht ein, um zu sehen, wie viele Elemente hineinpassen.
  5. Lesen Sie den Nutzungsbalken, die verbrauchten und verbleibenden Zahlen sowie das Ergebnis „passt“ oder „über dem Limit“.

Häufig gestellte Fragen

Es ist die maximale Anzahl an Token, die ein Modell in einer Anfrage verarbeiten kann — System-Prompt, Gesprächsverlauf, Dokumente und die generierte Antwort teilen sich dieses eine Budget.

Die Antwort wird innerhalb desselben Fensters wie Ihre Eingabe generiert. Füllt der Prompt das Fenster vollständig aus, hat das Modell keinen Platz mehr zum Antworten, und die Antwort wird abgeschnitten — reservieren Sie einen realistischen Puffer.

Der Rechner teilt den freien Platz — Fenster minus System, Eingabe und reservierte Ausgabe — durch die von Ihnen eingegebene Token-Größe pro Element und zeigt so, wie viele weitere Dokumente oder Nachrichten dieser Größe noch hineinpassen.

Das Tool zeigt den Überlauf in Token an. Kürzen Sie den Gesprächsverlauf, fassen Sie Dokumente zusammen oder teilen Sie sie auf, verkürzen Sie den System-Prompt, oder wechseln Sie zu einem Modell mit größerem Kontextfenster.

Nein — sie sind Schätzungen, und jedes Modell tokenisiert Text leicht anders. Lassen Sie einen Sicherheitspuffer, statt bis zum letzten Token zu planen, besonders bei mehrsprachigen oder codelastigen Inhalten.


Beliebte Suchen
kontextfenster rechner token budget rechner llm kontextgröße wie viele tokens passen ki kontextlänge prompt token planer
Brauchen Sie Hilfe?
Ein Problem mit diesem Tool gefunden? Sagen Sie es unserem Team.
Problem melden

Füge dieses kostenlose Tool zu deiner eigenen Website hinzu — kopiere den Code unten und füge ihn ein.