Kowol Service
Zur Übersicht
KI-GrundlagenTokensKontextfensterPromptKI-KostenKMU

Tokens, Kontextfenster, Kosten: Die wichtigsten KI-Begriffe endlich verständlich erklärt

Tokens, Kontextfenster, Prompt, Temperatur – die wichtigsten KI-Begriffe verständlich erklärt. So nutzen KMU-Inhaber KI bewusster und sparen bares Geld.

Robert Kowol
24. Juli 2026
6 Min. Lesezeit
Teilweise KI-bearbeitet
Tokens, Kontextfenster, Kosten: Die wichtigsten KI-Begriffe endlich verständlich erklärt

Wer heute mit ChatGPT, Claude oder einem anderen KI-Tool arbeitet, trifft früher oder später auf Begriffe, die zunächst nach Informatikstudium klingen: Token, Kontextfenster, Prompt, Modell. Die meisten KMU-Inhaber überspringen diese Erklärungen — und wundern sich dann, warum das Tool plötzlich den Anfang eines langen Gesprächs „vergessen” hat, oder warum die monatliche Abrechnung höher ausfällt als erwartet.

Dieser Artikel übersetzt die wichtigsten Fachbegriffe in klares Deutsch. Kein Vorwissen nötig. Und am Ende wissen Sie, wie Sie KI-Tools bewusster einsetzen — und im Zweifel Geld sparen.

Was ist eigentlich ein Token?

KI-Sprachmodelle lesen und schreiben keinen Text so, wie wir Menschen es tun. Sie zerlegen alles in sogenannte Tokens — kleine Textbausteine, die mal einem ganzen Wort, mal nur einem Wortteil oder einem Satzzeichen entsprechen.

Ein paar Beispiele zur Orientierung:

  • „Handwerk” ist ungefähr ein bis zwei Tokens.
  • „Auftragsbestätigung” wird in mehrere Teile zerlegt.
  • Ein kurzer Satz wie „Guten Morgen, wie kann ich helfen?” entspricht etwa sieben bis zehn Tokens.

Warum ist das wichtig? Weil KI-Dienste in der Regel nach Tokens abrechnen — sowohl für das, was Sie eingeben (Ihre Anfrage), als auch für das, was die KI ausgibt (die Antwort). Wer lange Texte eingibt und lange Antworten erwartet, verbraucht entsprechend viele Tokens. Das ist kein Problem, solange man es weiß.

Praxisbeispiel Gastronomie: Sie lassen Ihre neue Speisekarte von einer KI überarbeiten und schicken den gesamten alten Text als Grundlage mit. Das ist sinnvoll — aber je länger der Ausgangstext, desto mehr Tokens werden verbraucht. Wenn Sie dieselbe Anfrage mehrfach wiederholen, summiert sich das.

Was bedeutet „Kontextfenster”?

Das Kontextfenster ist der „Arbeitsspeicher” einer KI für ein laufendes Gespräch. Es legt fest, wie viel Text das Modell gleichzeitig „im Blick” behalten kann — also sowohl Ihre bisherigen Nachrichten als auch die Antworten der KI.

Stellen Sie sich das wie einen Schreibtisch vor: Je größer der Schreibtisch, desto mehr Unterlagen können Sie gleichzeitig ausbreiten und miteinander vergleichen. Ein kleines Kontextfenster bedeutet: Wird das Gespräch zu lang, „vergisst” die KI, was am Anfang besprochen wurde.

Was das im Alltag bedeutet:

  • Ein Handwerksbetrieb, der eine KI zur Angebotserstellung nutzt, schickt am Anfang eines Gesprächs seine Preisliste, Kundendaten und die Anforderungen des Auftrags mit. Ist das Kontextfenster zu klein oder das Gespräch zu lang geworden, kann die KI auf die frühen Informationen nicht mehr vollständig zugreifen.
  • Bei einer längeren E-Mail-Korrespondenz, die Sie der KI zur Zusammenfassung geben, ist ein großes Kontextfenster entscheidend — sonst fehlen wichtige Teile.

Verschiedene KI-Modelle haben unterschiedlich große Kontextfenster. Für einfache Alltagsaufgaben reichen kleinere Fenster völlig aus. Für komplexere Aufgaben — etwa das Analysieren eines langen Vertrags oder das Einpflegen einer umfangreichen Wissensbasis — lohnt sich ein Modell mit größerem Kontextfenster.

Was ist ein Prompt und warum ist er so entscheidend?

Der Prompt ist Ihre Eingabe an die KI — also die Frage, Anweisung oder der Text, mit dem Sie das Gespräch starten. Die Qualität Ihres Prompts bestimmt maßgeblich, wie nützlich die Antwort ist.

Ein schlechter Prompt: „Schreib mir was für meine Webseite.” Ein guter Prompt: „Ich betreibe einen Malerbetrieb in Heidenheim. Schreib einen kurzen Text (ca. 80 Wörter) für meine Über-uns-Seite. Ton: freundlich und regional. Zielgruppe: Privatpersonen, die ihr Haus renovieren möchten.”

Der Unterschied liegt im Kontext, den Sie mitliefern. Die KI kann nicht raten, was Sie meinen — sie arbeitet mit dem, was Sie ihr geben.

Praktische Tipps für bessere Prompts:

  1. Beschreiben Sie kurz Ihren Betrieb und die Zielgruppe.
  2. Geben Sie an, in welchem Ton der Text sein soll.
  3. Nennen Sie den gewünschten Umfang oder das Format.
  4. Wenn Sie mit einem Ergebnis nicht zufrieden sind, präzisieren Sie — statt alles neu zu schreiben.

Modell, Anbieter, API: Was ist was?

Hinter jedem KI-Tool steckt ein Modell — das eigentliche „Gehirn” der KI, das auf riesigen Textmengen trainiert wurde. Bekannte Modelle stammen von Anbietern wie OpenAI, Anthropic oder Google. Diese Modelle können Sie entweder über fertige Oberflächen (wie ChatGPT oder Claude.ai) nutzen oder — für eigene Anwendungen — über eine sogenannte API (Application Programming Interface) direkt in Software einbinden.

Für die meisten KMU ist die direkte API-Nutzung nicht notwendig. Die fertigen Oberflächen sind für den Alltag gut geeignet. Relevant wird die API erst, wenn Sie KI tief in eigene Prozesse integrieren möchten — etwa in ein automatisiertes Buchungssystem oder eine interne Wissensdatenbank.

Was Sie sich merken sollten: Nicht jedes Tool, das KI nutzt, ist auch das stärkste Modell. Viele günstige oder kostenlose Angebote setzen ältere oder kleinere Modelle ein. Das ist für einfache Aufgaben oft völlig ausreichend — für komplexere Texte oder sensible Geschäftsdokumente sollten Sie wissen, welches Modell im Hintergrund arbeitet.

Wie entstehen die Kosten — und wo lässt sich sparen?

Die meisten KI-Dienste bieten zwei Zugangsmodelle an: ein Abo-Modell (monatlicher Festpreis, begrenzte oder unbegrenzte Nutzung) oder eine verbrauchsbasierte Abrechnung (Sie zahlen nach tatsächlich genutzten Tokens).

Für KMU-Inhaber, die KI regelmäßig nutzen, ist ein Abo oft die einfachere Lösung — keine Überraschungen auf der Rechnung, keine Hemmungen bei der Nutzung. Die verbrauchsbasierte Abrechnung lohnt sich eher, wenn Sie KI nur gelegentlich oder für automatisierte Prozesse mit klar definiertem Volumen einsetzen.

Wo sich unnötige Kosten einsparen lassen:

  • Redundante Eingaben vermeiden: Wenn Sie jeden Tag dieselbe lange Firmenbeschreibung als Kontext mitsenden, überlegen Sie, ob Sie das in einem System-Prompt (einer festen Vorgabe) hinterlegen können.
  • Passendes Modell wählen: Für einfache Aufgaben wie das Umformulieren einer E-Mail brauchen Sie kein Hochleistungsmodell. Kleinere, günstigere Modelle reichen hier oft aus.
  • Ausgaben bewusst begrenzen: Viele Tools erlauben es, eine maximale Ausgabelänge festzulegen. Wer nur eine kurze Antwort braucht, sollte das angeben.
  • Testergebnisse nicht vergessen: Wenn Sie einen Prompt entwickeln und fünfmal testen, entstehen dabei Kosten. Besser: Prompt einmal sorgfältig formulieren, dann testen.

Temperatur, Kreativität und Zuverlässigkeit

Ein Begriff, der in Einstellungen mancher KI-Tools auftaucht, ist die Temperatur. Damit wird gesteuert, wie „kreativ” oder wie „vorhersehbar” die Antworten ausfallen.

  • Niedrige Temperatur: Die KI antwortet konservativer und konsistenter — gut für sachliche Texte, Zusammenfassungen oder strukturierte Ausgaben wie Rechnungspositionen.
  • Hohe Temperatur: Die KI variiert mehr, ist kreativer — sinnvoll für Werbetexte oder Brainstorming.

Für die meisten Alltagsaufgaben im Betrieb — Angebote schreiben, E-Mails formulieren, Texte zusammenfassen — ist eine mittlere bis niedrige Temperatur empfehlenswert. Verlässlichkeit geht hier vor Originalität.

Fazit: Wissen schützt vor bösen Überraschungen

Sie müssen kein Informatiker sein, um KI sinnvoll im Betrieb einzusetzen. Aber ein grundlegendes Verständnis dieser Begriffe hilft Ihnen, bewusster mit den Tools umzugehen — und vermeidet typische Fehler wie unerwartete Kosten, vergessene Kontextinformationen oder enttäuschende Ergebnisse durch unklare Prompts.

Kurz zusammengefasst:

  • Token = Abrechnungseinheit und Maß für Textlänge
  • Kontextfenster = Arbeitsspeicher der KI im laufenden Gespräch
  • Prompt = Ihre Eingabe — je präziser, desto besser das Ergebnis
  • Modell = das eigentliche KI-System im Hintergrund
  • Temperatur = Regler zwischen Verlässlichkeit und Kreativität

Wenn Sie das nächste Mal ein KI-Tool einrichten oder ein Angebot für KI-Automatisierung prüfen, können Sie gezielt nachfragen: Welches Modell? Wie groß ist das Kontextfenster? Wie wird abgerechnet? Das sind die Fragen, die den Unterschied machen.

Über den Autor

Robert Kowol

KI-Entwickler und Inhaber von Kowol Service in Heidenheim. Baut KI-Automatisierungen für Handwerk, Gastronomie und Dienstleister in Ostwürttemberg.

Erstgespräch buchen →
Anrufen Termin buchen