KI verstehen – Grundlagen

Tokens & Kontextfenster

Kostenlos lesbar — melde dich an, um deinen Fortschritt zu speichern.

Wenn Sie verstehen, was Tokens und Kontextfenster sind, verstehen Sie auch, warum ein Modell manchmal präzise antwortet und manchmal Details verliert. Diese beiden Grundlagen erklären Grenzen, Kosten und Verhalten von KI besser als viele technische Schlagwörter. Im Arbeitsalltag hilft dieses Wissen Ihnen, bessere Prompts zu schreiben, lange Dokumente sinnvoll aufzubereiten und die Qualität von Ergebnissen realistischer einzuschätzen.

Was Tokens tatsächlich sind

Ein Token ist eine Verarbeitungs-Einheit für Sprachmodelle. Das kann ein ganzes Wort sein, ein Wortteil, ein Satzzeichen oder bei manchen Sprachen auch ein sehr kurzer Zeichenblock. Das Modell liest also nicht in „Wörtern“, sondern in Tokenfolgen. Für die Praxis heißt das: Ein kurzer Text kann überraschend viele Tokens enthalten, besonders bei Fachbegriffen, Zahlen, Aufzählungen oder gemischten Sprachen. Deshalb sind Token nicht identisch mit Wörtern, und eine grobe Wortzählung reicht für KI-Arbeit oft nicht aus.

Warum das Kontextfenster wichtig ist

Das Kontextfenster ist die Menge an Tokens, die ein Modell in einer einzelnen Unterhaltung oder Anfrage gleichzeitig berücksichtigen kann. Dazu gehören Ihre Eingabe, frühere Nachrichten, Systemhinweise und oft auch die Antwort des Modells selbst. Ist das Fenster voll, werden ältere Teile abgeschnitten oder nur teilweise berücksichtigt. Das erklärt, warum ein Modell am Anfang eines langen Chats sauber arbeitet und später vergisst, was ganz am Anfang stand. Ein großes Kontextfenster ist hilfreich, ersetzt aber keine gute Struktur: Je klarer Sie Informationen gliedern, desto besser kann das Modell die relevanten Teile im Blick behalten.

Folgen für Qualität, Kosten und Prompting

Tokens beeinflussen direkt die Kosten und manchmal auch die Antwortgeschwindigkeit. Längere Prompts, umfangreiche Dokumente und ausführliche Ausgaben verbrauchen mehr Tokens. Wer große Mengen Text in ein Modell schickt, bezahlt also nicht nur mit Geld, sondern auch mit Aufmerksamkeit: Wichtige Informationen können im Rauschen untergehen. Gutes Prompting bedeutet deshalb oft, zu komprimieren, zu priorisieren und zu strukturieren. Statt alles gleichzeitig zu senden, sollten Sie Ziele, Kontext und gewünschtes Format klar trennen. Bei langen Aufgaben ist es häufig besser, Dokumente in Abschnitte zu gliedern und das Modell schrittweise arbeiten zu lassen.

Wie Sie mit langen Texten praktisch umgehen

Wenn Sie ein langes Dokument analysieren lassen, sollten Sie zuerst das Ziel definieren: Zusammenfassung, Extraktion von Risiken, Vergleich von Versionen oder Formulierungsvorschläge. Danach geben Sie nur den relevanten Ausschnitt oder eine geordnete Struktur. So reduzieren Sie Tokenverbrauch und erhöhen die Trefferquote. Ein weiterer bewährter Ansatz ist, das Modell zunächst eine Kurzfassung erstellen zu lassen und darauf aufbauend Detailfragen zu stellen. Dadurch bleibt der Kontext präziser, und Sie vermeiden, dass wichtige Informationen in einem zu großen Textblock untergehen.

Beispiele

  • Ein 20-seitiger Vertragsentwurf wird in mehrere Abschnitte zerlegt, damit das Modell zuerst Haftung, dann Laufzeit und zuletzt Kündigung prüft.
  • Eine E-Mail-Kette mit vielen Antworten wird vor dem Prompten auf die letzten drei relevanten Nachrichten reduziert, damit die Frage nicht im Verlauf verloren geht.
  • Ein Berater lässt aus einem Workshop-Transkript zuerst eine strukturierte Zusammenfassung erzeugen und fragt danach gezielt nach Entscheidungen, offenen Punkten und nächsten Schritten.
Token-Check

Analysiere den folgenden Text und erkläre mir in 5 Punkten, welche Teile wahrscheinlich besonders viele Tokens verbrauchen und wie ich den Text effizienter für ein KI-Modell aufbereiten kann: [TEXT EINSETZEN].

Kontext-strukturieren

Ich möchte folgenden langen Inhalt mit einem KI-Modell bearbeiten. Bitte schlage mir eine sinnvolle Gliederung in Abschnitte vor, damit der Kontext klar bleibt und wichtige Details nicht verloren gehen: [TEXT EINSETZEN].

Übung

Nehmen Sie einen aktuellen Arbeitsdokument-Text von 300 bis 800 Wörtern und schätzen Sie, welche Passagen besonders tokenintensiv sind. Kürzen Sie den Text anschließend auf die Hälfte, ohne die Kerninformation zu verlieren, und vergleichen Sie beide Versionen im KI-Tool.

Häufige Fehler

  • — Tokens mit Wörtern gleichsetzen und dadurch die tatsächliche Länge von Eingaben unterschätzen.
  • — Zu viel Kontext auf einmal senden und erwarten, dass das Modell alles gleichermaßen wichtig behandelt.
  • — Lange Chats ohne Struktur führen, obwohl ältere Informationen später aus dem Kontext fallen können.
Kernaussage

Wer Tokens und Kontextfenster versteht, steuert nicht nur die Länge seiner Eingaben, sondern auch die Qualität der Antworten.

Bereit, es anzuwenden?

Erstelle ein kostenloses Konto, speichere deinen Fortschritt und erhalte am Ende dein Abschlusszertifikat.

Kostenlos starten
AI Lernwerk

Die premium Akademie, die dich von den Grundlagen zur professionellen KI-Nutzung führt — für Arbeit, Business und Kreativität.

© 2026 AI Lernwerk. Alle Rechte vorbehalten.

Wir nutzen Cookies für Login und (später) Analyse. Details im Datenschutz.