netzstrategen
Consulting denken & planen Übersicht
KI-Strategie & Game Plan Übersicht MarktpotenzialanalyseWettbewerbsanalyseBusiness AuditZielgruppen & PersonasCustomer JourneysOrganisationsberatung
Brand & Design Übersicht MarkenpositionierungCorporate & Visual DesignCorporate & Digital LanguageUser Experience & UI DesignInformation Architecture
Marketing & Sales Übersicht SEOSEAGEOGEASocial Media AdsE-Mail-MarketingMarketing Automation & CRM
Content & Communication Übersicht Content-StrategieContent Audit & ReviewContent-ErstellungCommunication GuidelinesBrandvoicePR & ReputationsmanagementSocial Media StrategieBarrierefreie Kommunikation
Technology & Data Übersicht TechnologieanalyseAnforderungsentwicklungDatenstrategieImplementierung & IntegrationDatenanalyse
Implementation bauen & einführen Übersicht
Web- & Daten-Infrastruktur Übersicht Websites & Landing PagesWebshops & Web-KatalogeData & Reporting
KI-Schulung & Enablement Übersicht Schulungen & TrainingsAI-Lernprogramme
Marketing-Betrieb & Automation Übersicht Search AdsSocial AdsSEO- & GEO-BetreuungNewsletterContent-Betrieb
AI Operations betreiben & weiterentwickeln Übersicht
KI-Plattform Übersicht Strategy LayerOperations LayerOutput LayerAdmin Layer
KI-Verordnung & DSGVO Übersicht EU-Hosting & AnonymisierungAuditierbarkeit & DokumentationLeitplanken gegen Halluzinationen
KI-Agenten & Studios Übersicht Content StudioSEO StudioMarketing StudioData StudioSales StudioService Studio
ReferenzenInsightsProfile English Diagnose Call
Tools & Regulierung

Token

Auch bekannt als: Tokens, Input-Token, Output-Token, Tokenisierung

Token sind die kleinsten Einheiten, in die ein Sprachmodell Text zerlegt, bevor es damit rechnet. Nicht Wörter, nicht Zeichen: Fragmente dazwischen. Jede Abrechnung, jedes Limit und jedes Kontextfenster wird in Token gemessen.

Was ein Token ist

Ein Token ist ein häufig vorkommendes Zeichenfragment. Kurze, gängige Wörter bilden oft ein einzelnes Token, längere oder seltene Wörter zerfallen in mehrere. „Betrieb” ist ein Token, „Betriebsvereinbarung” mehrere. Auch Leerzeichen und Satzzeichen zählen mit.

Als Faustregel für die Planung: Im Englischen entspricht ein Token etwa vier Zeichen oder rund 0,75 Wörtern. Verlässlich ist nur die Messung mit dem Tokenizer des jeweiligen Anbieters. Jedes Modell zerlegt anders.

Warum Deutsch teurer ist als Englisch

Tokenizer sind überwiegend auf englischen Texten trainiert. Deutsche Komposita, Umlaute und Flexionsendungen zerfallen deshalb in mehr Fragmente als ihre englischen Entsprechungen. Derselbe Sachverhalt kostet auf Deutsch je nach Text spürbar mehr Token als auf Englisch.

Für den Betrieb heißt das: Wer Volumen plant, rechnet mit der Sprache, in der tatsächlich gearbeitet wird, nicht mit englischen Benchmarks.

Input, Output und der Preisunterschied

Anbieter rechnen getrennt ab. Input-Token sind alles, was ins Modell geht: Anweisung, Kontext, angehängte Dokumente, bei Chats auch der bisherige Gesprächsverlauf. Output-Token sind die erzeugte Antwort.

Output kostet in der Regel ein Mehrfaches von Input. Deshalb ist die teuerste Angewohnheit nicht der lange Prompt, sondern die unnötig ausführliche Antwort. Wie sich daraus laufende Kosten ergeben, beschreibt der Eintrag zu LLM-Inferenz.

Kontextfenster: das zweite Limit

Das Kontextfenster ist die Obergrenze an Token, die ein Modell in einem Vorgang gleichzeitig verarbeiten kann, Eingabe und Antwort zusammen. Ist es erschöpft, fällt Kontext weg: Bei langen Gesprächen verschwindet der Anfang, bei großen Dokumenten fehlen Teile.

Ein großes Kontextfenster ist deshalb kein Freibrief. Jeder mitgeschleppte Token wird bezahlt und verdrängt anderen Inhalt. Präzise Zulieferung schlägt vollständige Zulieferung.

Was das für den Betrieb bedeutet

Token sind die einzige Größe, über die AI-Kosten direkt steuerbar sind. Drei Maßnahmen wirken sofort:

  • Kontext begrenzen. Nur die Dokumente anhängen, die für den Vorgang zählen. Ein ganzer Ordner als Anhang ist teuer und macht Antworten schlechter, nicht besser.
  • Antwortlänge festlegen. Wo ein Ergebnis strukturiert sein soll, gehört das Format in die Anweisung. Unbegrenzte Antworten sind die häufigste vermeidbare Ausgabe.
  • Modell nach Aufgabe wählen. Klassifikation, Extraktion und Routine brauchen kein Spitzenmodell. Der Preisunterschied zwischen Modellklassen ist größer als die meisten Optimierungen am Prompt.

Wie sich daraus ein systematischer Ansatz ergibt, beschreibt der Beitrag zu Token-Smart. Wir halten dabei einen Grundsatz ein: Kunden behalten ihre eigenen AI-Accounts. Wir verdienen nicht an ihrem Verbrauch, sondern helfen, ihn zu senken.

Standortbestimmung

Den nächsten Schritt im kostenlosen Diagnose-Call besprechen. Termin buchen →

Stand: August 2026

Kostenlos & aktuell

Claude Cheat Sheet

Alle Claude-Features, Modelle und Praxis-Tipps kompakt auf einen Blick. Bilingual (DE/EN), laufend aktualisiert von netzstrategen.

Jetzt öffnen
Newsletter

Digital Impact direkt ins Postfach

Eine Anmeldung, drei Newsletter: der AI Insights Newsletter jede Woche mit den neuesten Insights-Artikeln, der Digital Impact Longread Newsletter und das Digital Impact Update je einmal im Monat. Mit Double Opt-in und jederzeit abbestellbar.

Podcast

AI Operations zum Hören

Digital-Experten wie André Hellmann, Christina D'Ilio, Christian Sattel, Sarah Stock sowie regelmäßig Gäste aus der Praxis: alle Themen rund um AI Operations als Audio für unterwegs.

So ist dieser Beitrag entstanden

Mensch
  • Themenwahl
  • Quellenwahl
  • Faktenprüfung
  • Freigabe
AI
  • Recherche
  • Textentwurf
  • Schaubilder
  • Publishing

Dieser Beitrag entstand mit AI-Unterstützung. Ideenfindung, Redaktionsplanung, inhaltliche Prüfung und Freigabe liegen beim Menschen, das Lektorat bei der AI. Die redaktionelle Verantwortung trägt André Hellmann.

So entstehen unsere Inhalte →

Verwandte Begriffe