1) Eine Anfrage = EIN Aufruf, den Ihr Programm an die KI macht
Eine Anfrage ist, wenn ein Programm die KI einmal fragt und eine Antwort zurückbekommt. ACHTUNG: eine Nachricht, die Sie eintippen, ist NICHT zwangsläufig eine Anfrage. Wie viele Anfragen Ihre Nachricht wird, hängt vom verwendeten Tool ab.
Programm fragt→Modell denkt→Modell antwortet
= 1 ANFRAGEOb Ihre Nachricht 5 Wörter oder 500 hat, dieser einzelne Aufruf zählt als 1 Anfrage. Die Länge ändert nicht die ANZAHL der Anfragen — aber sie ändert die verbrauchten Token und damit, was Sie unter PAYG zahlen.
Und wie viele Anfragen wird eine Ihrer Nachrichten?
Im Chatfenster: 1 Nachricht = 1 Anfrage. Einfach. Aber in Coding-Tools (Claude Code, Cline, Codex…) ist es ganz anders. Diese Tools arbeiten wie Agenten: Sie schreiben einen Satz, und sie arbeiten im Hintergrund Schritt für Schritt — und fragen das Modell bei JEDEM Schritt erneut.
Beispiel: Sie sagten Claude Code „behebe diesen Fehler“. Im Hintergrund:1Es liest Ihre Dateien → 1 Anfrage
2Es untersucht den Code, um den Fehler zu finden → 1 Anfrage
3Es schreibt die Korrektur → 1 Anfrage
4Es führt die Tests aus und liest das Ergebnis → 1 Anfrage
5Wenn ein Test fehlgeschlagen ist, korrigiert es erneut → 1 weitere Anfrage… und so weiter
Ihr EINER Satz kann also im Hintergrund zu 20–30 Anfragen werden. Genau deshalb ist ein Paket mit „1.000 Anfragen/Tag“ schneller aufgebraucht als erwartet. Das ist kein Fehler — so arbeiten agentische Tools.
Wie viele Anfragen Sie verbraucht haben, sehen Sie jederzeit auf der Aktivität-Seite in Ihrem Panel; jede Anfrage ist eine eigene Zeile.
2) Token = Teile von Wörtern
Die KI liest Wörter nicht so wie wir. Sie zerlegt Text in kleine Teile, und jeder Teil heißt TOKEN. Ein Token ist mal ein ganzes Wort, mal ein halbes Wort, mal ein Satzzeichen.
Dieser Satz: „Das Wetter ist heute wunderschön.“Bugün hava çok güzel.
Das sind etwa 5 Token. Grob: 1 Token ≈ 4 Zeichen. Da Wörter im Türkischen lang sind, fallen etwas mehr Token an. Die Abrechnung erfolgt über Token — nicht über Wörter oder Zeichen.
3) Zwei Arten von Token: ausgehend und eingehend
In einer Anfrage fließen Token in beide Richtungen. Beide werden gezählt.
- EINGABE (was Sie senden) — Ihre Frage + die der KI gegebenen Anweisungen + ggf. das vorherige Gespräch.
- AUSGABE (was das Modell schreibt) — die gesamte Antwort, die Sie zurückbekommen. Die Ausgabe ist meist teurer als die Eingabe, denn das ist der Teil, der das Modell wirklich Arbeit kostet.
⚠ Das Überraschendste: In einem Chat wird der Verlauf jedes Mal erneut gesendet
Die KI hat KEIN Gedächtnis. Sie erinnert sich nicht an Ihre vorherige Nachricht. Wenn Sie also einen Chat fortsetzen, sendet das Programm das GESAMTE Gespräch von Anfang an erneut — sonst wüsste das Modell nicht, wovon Sie sprechen. Das heißt: je länger der Chat, desto teurer wird jede Nachricht:
11. Nachricht — nur Ihre Frage wird gesendet~30 token
22. Nachricht — Frage 1 + Antwort 1 + Frage 2 werden gesendet~90 token
33. Nachricht — alles davor + Frage 3 werden gesendet~200 token
Was zu tun ist: starten Sie einen NEUEN CHAT, wenn sich das Thema ändert. 50 Nachrichten in einem Chat anzuhäufen macht jede neue Nachricht sehr teuer.
4) In Coding-Tools reist selbst „hallo“ nie allein
Tools wie Claude Code und Cline senden im Hintergrund viel, ohne dass Sie es merken: den Inhalt Ihrer geöffneten Dateien, die Projektstruktur, die dem Tool gegebenen Anweisungen… Selbst wenn Sie „hallo“ tippen, können im Hintergrund Tausende Token gesendet werden.
Das ist kein Fehler — es ist die Arbeitsweise des Tools, und es erklärt, warum selbst eine kleine Frage etwas kostet.
5) Wie wird gezählt? Bei Paketen und Guthaben UNTERSCHIEDLICH
📦 Wenn Sie ein Paket gekauft habenSie erhalten ein tägliches Kontingent. Jede ANFRAGE (jeder API-Aufruf) verbraucht 1 Kontingenteinheit — nicht jede Nachricht, die Sie tippen. Kurz oder lang macht keinen Unterschied. Mit einem Paket von 500 Anfragen/Tag kann ein agentisches Tool das in einer Handvoll Aufgaben verbrauchen.
1 API-Aufruf = 1 Kontingenteinheit 💳 Wenn Sie vom Guthaben zahlen (PAYG)Kein Kontingent. Welche Token eine Anfrage verbraucht, das wird von Ihrem Guthaben abgezogen. Kurze Frage = wenig Geld. Langer Chat = viel Geld.
pro Token zahlen
Echtes Beispiel: bei claude-haiku-4-5 kosten 1M Token $0.3. Eine Anfrage mit 1.000 Token kostet also etwa 0.0142 ₺. (Preise aus dem Live-Katalog.)6) Warum sehe ich DREI Zeilen im Ledger?
In der Aktivität sehen Sie drei Zeilen für eine einzige Anfrage. Keine Sorge — das Geld geht nur einmal ab. So funktioniert es: zu Beginn können wir nicht wissen, was eine Anfrage kosten wird, also „legen wir zuerst einen Betrag beiseite“. Wenn sie fertig ist, geben wir ALLES zurück, was wir beiseitegelegt haben, und ziehen nur das tatsächlich Ausgegebene ab.
Reservierung — beiseitegelegt (geschätztes Maximum)−$0,05
Rückerstattung — die gesamte Reservierung zurückgegeben+$0,05
Nutzung — das tatsächlich Ausgegebene abgezogen−$0,01
Nettoergebnis: nur das tatsächlich Ausgegebene verlässt Ihre Tasche. Alle drei tragen dieselbe Anfrage-ID, sodass nichts durcheinandergerät.
7) Wie gebe ich weniger aus?
- Starten Sie einen neuen Chat, wenn sich das Thema ändert — damit das alte Gespräch nicht jedes Mal erneut gesendet wird.
- Seien Sie konkret. Sagen Sie genau, was Sie wollen, statt lange zu erklären.
- Nutzen Sie für einfache Arbeiten ein günstiges Modell (GLM, Kimi). Nicht jede Aufgabe braucht das teuerste Modell.
- Wenn Sie es regelmäßig nutzen, kaufen Sie ein Paket — da es kontingentbasiert ist, kommt es bei langen Anfragen deutlich günstiger.