YouTube

Wie deine PROMPTS Geld verbennen! Tokens, Abos & API im Überblick!

27.07.2026YouTubeTokens
Wie deine PROMPTS Geld verbennen! Tokens, Abos & API im Überblick!

Tokens sind die gemeinsame Basis hinter fast jeder KI-Anfrage. Das Video zeigt ruhig und konkret, wie Input, Output, Kontextfenster, Cache und Modellwahl zusammen Kosten und Qualität deiner Arbeit beeinflussen.

Das Wichtigste in Kürze

Ein Wort ist nicht automatisch ein Token

Das Video zeigt am Beispiel eines einfachen Satzes, dass Modelle Texte in Token zerlegen. Je nach Modell wird derselbe Satz unterschiedlich aufgeteilt, manchmal fast wortnah, manchmal in kleinere Teile. Genau deshalb brauchst du ein Gefühl dafür, dass Tokens eine technische Recheneinheit sind und keine direkte Wortzählung.

Das teure Stück ist oft der versteckte Kontext

Zu einer Anfrage gehören nicht nur deine sichtbaren Zeilen, sondern auch System-Prompts, Agenten-Anweisungen, geladene Dateien und anderer Kontext im Hintergrund. Gerade bei Coding-Tools oder längeren Chats wächst dieser unsichtbare Teil schnell und treibt den Verbrauch hoch, bevor du überhaupt die eigentliche Antwort siehst.

Denken kostet extra, und zwar spürbar

Reasoning-Modelle erzeugen vor der Antwort zusätzliche Zwischenschritte. Das kann die Qualität verbessern, aber auch deutlich mehr Tokens verbrennen. Das Video macht klar, dass du Modell und Denktiefe bewusst wählen solltest, statt jede Aufgabe mit maximaler Intelligenz zu lösen.

Christoph’s hot takes

Warum Tokens überhaupt wichtig sind

Tokens sind die gemeinsame Währung fast aller KI-Modelle und KI-Tools. Wer sie versteht, kann besser einschätzen, warum ein Chat plötzlich teuer wird, warum ein Modell an Grenzen stößt und warum längere Aufgaben nicht einfach nur mehr Zeit, sondern auch mehr Rechenaufwand bedeuten.

Das Video zieht dafür einen nüchternen Vergleich zum Autofahren: Ohne Tacho merkst du erst zu spät, wie schnell du unterwegs bist. Genauso brauchst du bei KI ein Gefühl dafür, wie viel du verbrauchst, wenn du Modelle bewusst und wirtschaftlich einsetzen willst.

Was im Hintergrund wirklich mitgerechnet wird

Der sichtbare Prompt ist nur ein Teil der Rechnung. Mitgezählt werden auch System-Prompts, Tool-Kontext, Dateien, frühere Nachrichten und bei Agenten oft zusätzliche interne Schritte. Genau deshalb können scheinbar kleine Anfragen überraschend teuer werden.

Das Video betont außerdem, dass Kontextfenster begrenzt sind. Wenn sie voll werden, wird komprimiert. Das ist notwendig, aber kein Freifahrtschein, denn zu viel Kontext und zu viel Kompression können Qualität und Steuerbarkeit verschlechtern. Cache kann dabei helfen, wiederkehrende Informationen nicht jedes Mal neu zu berechnen und so Tokens zu sparen.

Modellwahl ist eine Kostenfrage, keine Glaubensfrage

Nicht jedes Modell kostet gleich viel, und nicht jede Aufgabe braucht das teuerste Modell. Das Video zeigt die Bandbreite zwischen sehr günstigen und sehr teuren Modellen und macht klar: Je anspruchsvoller die Aufgabe, desto eher lohnt sich ein stärkeres Modell, aber eben nur dann.

Eine pragmatische Regel aus dem Video: Für komplexe Aufgaben erst ein starkes Modell nutzen und dann bei Bedarf herunterstufen. Für klar definierte, einfache Aufgaben reichen kleinere Modelle mit sehr präzisem Prompt oft völlig aus. So vermeidest du unnötigen Verbrauch, ohne blind an Qualität zu sparen.

Abo, API oder Flatrate, was wirklich zählt

Das Video unterscheidet zwei Welten. Privatnutzer zahlen oft über Abos oder subventionierte Pläne, Unternehmen eher über Flatrates, Credits oder direkte API-Nutzung. Der Kernpunkt ist nicht das Preismodell an sich, sondern die Planbarkeit und die Frage, wie transparent der reale Verbrauch sichtbar wird.

Für Unternehmen ist das besonders relevant, weil API-Nutzung und Agenten schnell deutlich teurer werden können als ein scheinbar günstiger Monatsplan. Deshalb braucht es Limits, Budgets und eine klare Zuständigkeit in den Fachbereichen, statt Tokenkosten einfach als diffuse IT-Kosten zu behandeln.

Take a look and learn!

Externer Inhalt

YouTube-Video laden

Wird von Google Ireland Ltd. geladen.

Optionen & Datenschutz

„Wie deine PROMPTS Geld verbennen! Tokens, Abos & API im Überblick!" ist bei YouTube gehostet. Beim Laden wird eine Verbindung zu YouTube/Google aufgebaut.

Beim Laden werden Daten (z. B. IP-Adresse, Browser-Informationen) an Google Ireland Ltd. / Google LLC übertragen. Beim Laden Verbindung zu YouTube/Google; eine Übermittlung in die USA kann nicht ausgeschlossen werden.

Ist das Thema interessant für dich? Dann gibt es drei sinnvolle nächste Schritte.

Wir haben die Kernideen dieser Quelle als strukturierte Markdown Datei aufbereitet, damit du es perfekt als Kontext für dein eigenes KI-Projekt nutzen kannst. Lade die Datei herunter, wirf sie in das Tool deiner Wahl und arbeite damit weiter!

Für den Download brauchen wir deine E-Mail-Adresse. Infos zur Datenverarbeitung findest du in der Datenschutzerklärung.

Wenn du aus deinem Interesse echte Praxis machen willst, komm' in die Blackboat Academy! Von kompakten Workshops über mehrwöchige Intensivprogramme bis zur persönlichen Begleitung über ein ganzes Quartal: in unserer Academy findest du das Format, das zu deinem Ziel, deinem Level und deinem Zeitrahmen passt.

Wenn das Thema gerade für dein Team, dein Event oder deine Führungsebene relevant ist, kann Christoph den Impuls auch live in eure Organisation bringen.

AI generated

Diese redaktionelle Aufbereitung kommt direkt aus der KI-Werkstatt. Unsere Crew hat die Inhalte nicht geprüft. Dies bezieht sich nicht auf die Originalquelle.

Zurück zu Inspiration