Anthropic & Claude

Nur 11 Prozent der Unternehmen können ihre KI-Ausgaben vorhersagen

2 Min. Lesezeit KI-generiert

Zuerst kam #tokenmaxxing, dann kam die Rechnung. Das WSJ beruft sich auf eine Erhebung unter knapp 400 Unternehmen.

Featured image for "Nur 11 Prozent der Unternehmen können ihre KI-Ausgaben vorhersagen"

Das Wall Street Journal hat am Sonntagabend eine Zahl veröffentlicht, die ich mir merken werde: Von knapp 400 befragten Unternehmen konnten 11 Prozent ihre KI-Ausgaben verlässlich vorhersagen. Nicht punktgenau treffen – nur grob vorhersagen.

Zuerst #tokenmaxxing, dann die Rechnung

Die Vorgeschichte beschreibt das WSJ in zwei Sätzen. Erst haben US-Unternehmen ihre Leute ermuntert, so viel KI zu benutzen wie möglich, Hashtag #tokenmaxxing. Dann kam die Abrechnung, und seitdem zählen dieselben Firmen ihre Tokens.

Der Grund für das Problem steckt in der Abrechnungseinheit selbst: Wie viele Tokens ein Modell für eine bestimmte Aufgabe verbraucht, lässt sich vorher nicht sagen. Zwei Mitarbeiter stellen dieselbe Frage, einer bekommt eine kurze Antwort, beim anderen denkt das Modell drei Minuten lang nach und ruft vier Tools auf. Beides ist korrektes Verhalten. Nur die Rechnung unterscheidet sich um den Faktor zehn.

Warum sich Tokens nicht budgetieren lassen

Wer mit Claude Code oder einem Agenten arbeitet, kennt das aus der eigenen Sitzung. Die Kosten hängen nicht an der Zahl der Aufgaben, sondern daran, wie lang der Weg zur Lösung war. Ein Agent, der sich verrennt und zweimal neu ansetzt, kostet ein Vielfaches desselben Agenten, der im ersten Versuch richtig abbiegt. Je länger die Sitzungen werden und je mehr Schritte ein Lauf selbständig macht, desto größer wird diese Streuung.

Für einen Controller ist das eine unangenehme Eigenschaft. Serverkosten skalieren mit Last, Lizenzen mit Köpfen, beides lässt sich planen. Agentenkosten skalieren mit Umwegen.

Harte Obergrenzen sind die naheliegende Antwort

Genau darum ging es vorgestern bei Simon Willison. Er hat gefordert, dass harte Budget-Obergrenzen zum Standard werden und nicht zur Option, die man irgendwo in den Einstellungen findet. Das WSJ liefert jetzt die Zahl dazu: Neun von zehn Unternehmen können nicht vorhersagen, was sie ausgeben werden.

Zwei Werkzeuge gegen dasselbe Problem, und sie ergänzen sich. Anthropic zeigt seit 2.1.284 das Gateway-Budget in Dollar an statt in abstrakten Einheiten. Das hilft beim Hinsehen. Was das WSJ beschreibt, braucht aber mehr als eine Anzeige: eine Grenze, die hält, wenn niemand hinsieht. Solange die obere Schranke eine Schätzung ist, bleibt KI die einzige Position im Budget, bei der man am Monatsanfang nicht weiß, ob sie 5.000 oder 50.000 Dollar groß wird.

Quellen:

KostenTokensUnternehmenAPIClaude