Zum Inhalt springen
ma-ki.io

Alle Beiträge

Werkzeuge · 5 von 8 Nr. 0049

Was eine Stunde Agent kostet

Von Martin Kirschner · · 4 Minuten Lesezeit · Belege geprüft am

Alle drei Werkzeuge, mit denen ich programmiere, messen die Arbeit in Tokens. Was davon auf der Rechnung landet, hängt am Abo, und da verpackt es jeder anders. Warum die dritte Stunde mehr kosten kann als die erste, was der Deckel im Konto bringt und wohin die Zahl in der Rechnung gehört.

Ein Nachmittag am Programm, das Angebote in den Preisspiegel stellt. Der Agent liest Dateien, ändert, lässt Tests laufen, ich lese mit und greife ein. Am Abend zeigt die Nutzungsanzeige keine Stunden. Sie zeigt Tokens, und aus denen wird gerechnet.

Drei Verpackungen, eine Währung

Was ein Agent kostet, hängt nicht an der Uhr, sondern daran, wie viel Text bei jedem Schritt zum Modell geht und von ihm zurückkommt, gemessen in Tokens. Alle drei Werkzeuge, mit denen ich programmiere, rechnen so, verpacken es aber verschieden.

Claude Code. Im Abo zieht die Arbeit von einem Kontingent ab, das sich in einem rollierenden Fünf-Stunden-Fenster und einem Wochenfenster erneuert; über die API wird stattdessen rein nach Tokens gezahlt. Als Erfahrungswert aus Firmen nennt Anthropic rund 13 US-Dollar je Entwickler und aktivem Tag (Manage costs effectively, code.claude.com, abgerufen 18. August 20261). Die Planpreise stehen auf claude.com/pricing2.

Codex. Im ChatGPT-Konto enthalten, Nachrichten je Modell in Fünf-Stunden-Fenstern begrenzt, danach Credits. Die werden nach Tokens verrechnet: für GPT-5.6 Sol 100 Credits je Million Eingabe- und 500 je Million Ausgabetoken, eine Nachricht liegt laut Seite im Schnitt bei 5 bis 30 Credits (Pricing, learn.chatgpt.com, Stand 18. August 20263).

Mistral. Das Programmierwerkzeug heißt Vibe for Code, im Terminal Mistral Vibe CLI. Der Zugang steckt im Vibe-Abo: Free kostenlos mit 10 US-Dollar API-Guthaben im Monat, Pro 14,99 US-Dollar im Monat mit 30 US-Dollar Guthaben, Team 24,99 US-Dollar je Nutzer und Monat bei mindestens 50 US-Dollar (Pricing, mistral.ai, abgerufen 19. August 20264). Darüber hinaus läuft es über Studio nach Tokens: Devstral 2 kostet 0,40 US-Dollar je Million Eingabe- und 2,00 US-Dollar je Million Ausgabetoken (Devstral 2 and the Vibe CLI, mistral.ai, abgerufen 19. August 20265). Das günstige Guthaben hat einen Preis, der nicht in Dollar dasteht: Bei Vibe Free und Pro werden Eingaben und Ausgaben standardmäßig zum Training verwendet, solange man nicht widerspricht, bei Team und Enterprise nicht (Do you use my user data to train, help.mistral.ai, abgerufen 19. August 20266).

Warum die dritte Stunde mehr kosten kann als die erste

Ein Agent schickt bei jedem Schritt die gesamte bisherige Unterhaltung mit: jede gelesene Datei, jede Befehlsausgabe, jede Korrektur. Anthropic beschreibt es so: Eine einzeilige Frage in einer Sitzung, die den ganzen Tag offen war, zieht Nutzung für die ganze Unterhaltung. Ein Zwischenspeicher (Prompt Caching) dämpft das, doch nach einer Pause, die länger dauert als seine Lebensdauer, wird alles noch einmal voll verarbeitet (Manage costs effectively1).

Deshalb kostet die dritte Stunde am selben Problem bei mir mehr als die erste, obwohl ich in ihr weniger tippe. Offen stehen lassen allein kostet fast nichts; der nächste Aufruf darin trägt die ganze Vorgeschichte mit.

Darauf achte ich:

  • Neue Aufgabe, neue Sitzung. Alter Zusammenhang geht bei jedem Schritt mit und hilft der neuen Aufgabe nicht.
  • Zusammenfassen ist nicht gratis. Das Verdichten liest die ganze Unterhaltung. Brauche ich einen frischen Start, mache ich ihn, statt zu verdichten.
  • Ausgaben klein halten. Ein Testlauf mit 10.000 Zeilen Protokoll landet komplett im Zusammenhang. Ein Filter davor, der nur die Fehlerzeilen durchlässt, macht daraus ein paar Hundert Tokens.
  • Kontrolle vor dem Losbauen. Ich lasse erst planen und gebe den Plan frei. Ein falscher Weg, den der Agent eine Stunde weit gegangen ist, kostet die Stunde doppelt: einmal hin, einmal zurück.

Der Deckel im Konto

Tages- und Monatslimit, wie in meiner Wissensdatenbank, gibt es bei den Werkzeugen als Einstellung. Bei Anthropic ist das Kontingent des Plans die Grenze; darüber hinaus lässt sich Zusatzverbrauch mit einem Ausgabenlimit freischalten, in der Console gibt es Limits je Workspace (Manage costs effectively1). Bei Mistral ist das im Abo enthaltene API-Guthaben die Grenze (Pricing4). Bei Codex sind es Credits, die man nachkauft.

Ganz ohne Abrechnung läuft es im eigenen Rechner: Die Mistral Vibe CLI arbeitet auch mit einem lokalen, quelloffenen Modell, dann fällt keine Tokenrechnung mehr an, nur Strom und Wartezeit. Wie weit das trägt und was dafür abzuschalten ist, steht in Mistral Vibe: der Agent, der auch ohne Netz arbeitet.

Der Deckel verhindert keine teure Sitzung, sondern die Überraschung am Monatsende. Ich setze ihn vor der ersten Sitzung, nicht danach.

Die Zahl in der Rechnung

In Rechnen, bevor man baut steht das Bauen als einmaliger Posten, und dort gehört die Stunde Agent hin: nicht zu den laufenden Modellkosten, sondern neben die eigene Zeit. Die Angebotsprüfung spart mir 23 Minuten je Angebot. Was das Bauen samt Agent gekostet hat, entscheidet, wann diese Minuten die Kosten eingeholt haben.

Die Nutzungsanzeige am Abend ist deshalb keine Spielerei. Ich schreibe die Zahl gleich mit; sonst suche ich sie später aus Abrechnung, Konsole oder Protokollen zusammen oder rechne mit einer Schätzung. Und Schätzungen fallen, das habe ich in der Fachbauaufsicht oft genug gesehen, fast immer zu niedrig aus.

Quellen

  1. 1Manage costs effectively, code.claude.com, abgerufen 18. August 2026 code.claude.com b
  2. 2claude.com/pricing claude.com
  3. 3Pricing, learn.chatgpt.com, Stand 18. August 2026 learn.chatgpt.com
  4. 4Pricing, mistral.ai, abgerufen 19. August 2026 mistral.ai b
  5. 5Devstral 2 and the Vibe CLI, mistral.ai, abgerufen 19. August 2026 mistral.ai
  6. 6Do you use my user data to train, help.mistral.ai, abgerufen 19. August 2026 help.mistral.ai

Teilen

Dazu passt

Weiter in Werkzeuge Welches Werkzeug für welche Arbeit