For AI agents: the public content index is available at https://we0.ai/llms.txt, and the English article bundle is available at https://we0.ai/llms-full.txt.
For AI agents: the complete content index is available at https://we0.ai/llms.txt, the full English article bundle is available at https://we0.ai/llms-full.txt, and this page is available as Markdown at https://we0.ai/de/articles/amazon-s-1-8m-claude-overrun.md.
KI-Agenten können auf eine Weise versagen, wie es bei normaler Software selten vorkommt: Sie versuchen es immer wieder. Menschliche Mitarbei...

KI-Agenten können auf eine Weise versagen, wie es bei normaler Software selten vorkommt: Sie versuchen es immer wieder.
Ein menschlicher Mitarbeiter, der auf einen fehlerhaften Prozess stößt, wird irgendwann müde, sucht Hilfe, geht nach Hause oder wartet bis zum nächsten Morgen.
Ein autonomer Agent hingegen kann kontinuierlich Modelle aufrufen, eigene Ausgaben lesen, Tools erneut versuchen, Pläne umschreiben und eine weitere Schleife starten – über Stunden oder sogar Tage hinweg.
Wenn die Aufgabe schwierig ist, ist diese Beharrlichkeit nützlich.
Wenn die Aufgabe selbst problematisch ist, ist diese Beharrlichkeit teuer.
Laut einem Bericht der Financial Times vom Juli 2026, der sich auf Amazon-Mitarbeiter und Personen mit Kenntnis interner Projekte stützt, hat ein Projekt bei Amazon, das Claude Sonnet verwendete, bei dem Versuch, Autoreninformationen auf der Amazon-Website anzureichern, kumulierte KI-Kosten von rund 1,8 Millionen US-Dollar verursacht.
Berichten zufolge belief sich die Rechnung auf etwa:
860 % über dem Projektbudget
Diese Überschreitung blieb Berichten zufolge über einen Zeitraum von:
fünf Monaten
unbemerkt.
Und trotz der enormen Kosten wurde das Projekt Berichten zufolge nicht erfolgreich eingesetzt.
Diese Kombination macht den Vorfall bedeutsamer als eine bloß ungewöhnlich hohe Rechnung.
Sie offenbart ein neues Problem der Unternehmenssoftware:
Kleiner Logikfehler
×
Autonome Wiederholungsversuche
×
Nutzungsbasierte Abrechnung
×
Schwache Beobachtbarkeit
=
Erheblicher finanzieller Verlust
Dieses Problem ist nicht einzigartig für Claude, Amazon oder einen einzelnen KI-Anbieter.
Agentsysteme wandeln Rechenleistung in variable Betriebsausgaben um. Wenn sie unabhängig laufen dürfen, werden Kosten zu einem Teil des Anwendungsverhaltens und nicht mehr zu einem einfachen Software-Abo.
Ein Fehler erzeugt nicht mehr nur falsche Ergebnisse.
Er kann weiterhin Geld ausgeben und gleichzeitig Millionen falscher Ergebnisse erzeugen.
Die im Financial-Times-Bericht beschriebene Aufgabe klingt alltäglich.
Amazon wollte die Autoreninformationen auf seiner Website verbessern.
Berichten zufolge wurde ein auf Claude Sonnet basierender Workflow eingesetzt, um beim Abgleichen oder Generieren der benötigten Autoreninformationen zu helfen.
Anschließend verbrauchte das Projekt weit mehr KI-Ressourcen als erwartet.
Amazon-Mitarbeiter beschrieben die Endkosten Berichten zufolge mit etwa:
1,8 Millionen US-Dollar
Das entspricht einer geschätzten:
860-prozentigen Budgetüberschreitung
Das auffälligste Detail dürfte jedoch die Verzögerung bei der Erkennung sein.
Das Kostenproblem blieb Berichten zufolge über einen Zeitraum von etwa fünf Monaten aktiv bzw. unentdeckt.
Das zeigt, dass das Versagen nicht nur beim KI-Modell lag.
Es war auch ein Problem der Überwachung und Governance.
Wenn eine Unternehmens-Workload siebenstellige Beträge ausgeben kann, ohne dass ein klarer Alarm ausgelöst wird, fehlen dem System eine oder mehrere Kontrollen, die bei anderer Abrechnungsinfrastruktur üblicherweise vorhanden wären.
Zu diesen Kontrollen könnten gehören:
Die Financial Times berichtete außerdem, dass Amazon weitere Fälle ungewöhnlich hoher KI-Kosten festgestellt habe und Ingenieure an automatisierten Schutzmechanismen arbeiteten.
Amazon erklärte gegenüber der Zeitung, dass es sich bei solchen Fällen um isolierte Erfahrungen handle, nicht um ein repräsentatives Beispiel für seine breiteren KI-Bemühungen.
Diese Unterscheidung ist wichtig.
Der Vorfall mit 1,8 Millionen US-Dollar war Berichten zufolge ein internes Projektversagen.
Er beweist nicht, dass das gesamte KI-Programm von Amazon wirtschaftlich erfolglos ist.
Der ursprüngliche chinesische Artikel stellte eine übertriebene Berechnung an.
Darin hieß es, dass man mit 1,8 Millionen US-Dollar zu einem Preis von 3 US-Dollar pro Million Eingabe-Token maximal erwerben könne:
600 Milliarden Eingabe-Token
Die Rechnung ist einfach:
1,8 Millionen US-Dollar
÷
3 US-Dollar pro Million Token
=
600.000 Millionen Token
=
600 Milliarden Token
Dies ist jedoch keine Messung des tatsächlichen Token-Verbrauchs des Amazon-Projekts.
Es handelt sich lediglich um eine illustrative Obergrenzenberechnung unter mehreren unrealistischen Annahmen:
Die aktuellen Preise von Anthropic variieren zudem je nach Sonnet-Generation.
Stand August 2026 sieht die Preisliste von Anthropic wie folgt aus:
| Modell | Standard-Eingabe | Standard-Ausgabe |
|---|---|---|
| Claude Sonnet 5 | 2 US-Dollar/Million Token | 10 US-Dollar/Million Token |
| Claude Sonnet 4.6 | 3 US-Dollar/Million Token | 15 US-Dollar/Million Token |
| Claude Sonnet 4.5 | 3 US-Dollar/Million Token | 15 US-Dollar/Million Token |
Der Financial-Times-Bericht bestätigt Claude Sonnet, aber die öffentlichen Berichte enthalten nicht genügend Abrechnungsdetails, um die genaue Modellversion, das Eingabe-/Ausgabeverhältnis, das Cache-Verhalten oder die tatsächliche Token-Anzahl zu rekonstruieren.
Daher ist die belastbare Schlussfolgerung:
Dem Bericht zufolge gab das Projekt rund 1,8 Millionen US-Dollar aus; der genaue Token-Verbrauch ist der Öffentlichkeit nicht bekannt.
Dies ist wichtig, weil eine Kostenanalyse für Unternehmen irreführend wird, wenn ein Dollar-Betrag automatisch mit einer einzigen Listenpreiszahl in Token umgerechnet wird.
Herkömmliche Software hat in der Regel relativ vorhersehbare Kostentreiber.
Teams können abschätzen:
Großsprachmodell-Agenten fügen eine weitere Komplexitätsebene hinzu.
Eine einzelne Benutzeranfrage kann auslösen:
1 Modellaufruf
Oder sie kann auslösen:
200 Modellaufrufe
+ Tool-Aufrufe
+ Wiederholungsversuche
+ Kontextwiedergabe
+ Websuchen
+ Codeausführung
Der Benutzer sieht möglicherweise nur eine endgültige Antwort.
Der Kostenmesser sieht jedoch die gesamte Prozessablaufverfolgung.
Agenten senden bei jedem Denkschritt oft einen Großteil ihres Arbeitskontexts erneut.
Daher kann ein sehr großes Code-Repository, ein großes Dokument, ein Tool-Verlauf oder ein Gespräch wiederholt abgerechnet werden.
Der zuvor vom Agenten generierte Text wird in der Regel zum Kontext für den nächsten Modellaufruf.
Das System gibt also erst Geld aus, um Informationen zu erzeugen, und dann noch einmal, um diese Informationen zu lesen.
Ein fehlgeschlagener Tool-Aufruf kann Folgendes auslösen:
Eine Wiederholungsschleife, die auf Codeebene harmlos aussieht, kann einen erheblichen Token-Verbrauch erzeugen.
zufallsabhängig
Forschung zur Codeausführung durch Agenten hat gezeigt, dass der Token-Verbrauch für dieselbe Aufgabe zwischen verschiedenen Läufen stark variieren kann.
Eine Studie aus dem Jahr 2026, die mehrere moderne Modelle auf SWE-bench Verified untersuchte, berichtete von Unterschieden von bis zu etwa dem 30-Fachen zwischen verschiedenen Läufen derselben Aufgabe.
Mehr Token führen auch nicht immer zu besseren Ergebnissen.
Dies macht „Rechnung basierend auf Aufgabenschwierigkeit schätzen“ zu einer unzuverlässigen Budgetmethode.
Der Quellartikel wendet sich anschließend vom 1,8-Millionen-US-Dollar-Vorfall einer übergeordneten Perspektive zu.
Amazon zieht sich nicht aus dem KI-Bereich zurück.
Es erhöht seine Investitionen.
CEO Andy Jassy hat wiederholt erklärt, dass generative KI und Agenten sowohl Kundenprodukte als auch die internen Abläufe von Amazon neu gestalten werden.
Im Juni 2025 sagte Jassy gegenüber Mitarbeitern, dass Amazon bereits über mehr als:
1.000 generative-KI-Dienste und -Anwendungen
verfüge, sei es bereits gebaut oder in der Umsetzung.
Er prognostizierte außerdem:
Milliarden von KI-Agenten
in Unternehmen und Bereichen aller Art.
Jassy sagte, Agenten könnten folgende Arbeiten ausführen:
Er sagte auch, dass die breitere Anwendung von KI die Mitarbeiterstruktur von Amazon verändern werde und langfristig möglicherweise die Gesamtzahl der Unternehmensmitarbeiter reduzieren könnte, da die Effizienz steige.
Daher ereignete sich dieser 1,8-Millionen-Dollar-Claude-Vorfall in einem Unternehmen, das bewusst stärker auf Automatisierung setzt statt auf weniger.
Das Ausmaß der Infrastrukturinvestitionen von Amazon ist enorm.
Im Berichtszeitraum des zweiten Quartals 2026 hob Jassy die für 2026 erwarteten Kapitalausgaben des Unternehmens auf etwa:
220 Milliarden US-Dollar
an, gegenüber dem zuvor geplanten Betrag von etwa 200 Milliarden US-Dollar.
Der Großteil dieser Ausgaben steht im Zusammenhang mit:
Der Aktionärsbrief von Amazon für 2025 hat bereits klargestellt, dass das Unternehmen seine frühere Schätzung von 200 Milliarden US-Dollar nicht „aus dem Bauch heraus“ getroffen hat.
Jassy erklärte, dass AWS über eine Vielzahl von Kundenverpflichtungen verfügt, die einen Großteil des Infrastrukturaufbaus rechtfertigen.
Das ergibt einen deutlichen Kontrast:
Amazon investiert Hunderte von Milliarden Dollar,
um KI-Kapazitäten auszubauen
und lernt gleichzeitig,
wie man verhindert, dass einzelne KI-Workloads
Millionen von Dollar verschwenden.
Diese beiden Probleme widersprechen sich nicht.
Infrastrukturkapazität und Workload-Effizienz sind zwei verschiedene Dinge.
Der Quellartikel stellt zu Recht fest, dass die KI- und Cloud-Ausgaben von Amazon nicht nur Kosten verursachen.
Die offiziellen Ergebnisse von Amazon für das zweite Quartal 2026 zeigen ein starkes AWS-Wachstum.

Für das am 30. Juni 2026 endende Quartal:
| Kennzahl | Zweites Quartal 2026 |
|---|---|
| Gesamtumsatz (Netto) von Amazon | 200,6 Milliarden US-Dollar |
| AWS-Nettoumsatz | 42,2 Milliarden US-Dollar |
| AWS-Umsatzwachstum im Jahresvergleich | 37 % |
| Gesamtbetriebsgewinn von Amazon | 27,5 Milliarden US-Dollar |
| AWS-Betriebsgewinn | 16,6 Milliarden US-Dollar |
Damit trug AWS ungefähr:
60 % des Betriebsgewinns von Amazon
bei und machte gleichzeitig etwa:
21 % des Gesamtumsatzes (Netto)
in diesem Quartal aus.
Amazon gab außerdem an, dass die annualisierte Umsatzrate seines KI-Geschäfts und seines Chip-Geschäfts jeweils 25 Milliarden US-Dollar überschritten hat.
Das Unternehmen hat also starke wirtschaftliche Gründe, die Einführung von KI weiter voranzutreiben und gleichzeitig die Kostendisziplin zu verbessern.
KI-Ausgaben sind nur ein Aspekt der Automatisierungspläne von Amazon.
Das Unternehmen baut auch Unternehmensstellen ab.
Im Oktober 2025 berichtete Reuters, dass Amazon den Abbau von bis zu 30.000 Unternehmensstellen plant.
Jassy sagte den Mitarbeitern außerdem, dass die breitere Einführung generativer KI bedeuten könnte, dass einige Arten von Arbeitsplätzen reduziert werden, während andere zunehmen.
Es ist wichtig zu beachten, dass nicht jede Stellenstreichung bei Amazon auf „KI ersetzt Mitarbeiter“ reduziert werden kann.
Personalkürzungen in großen Unternehmen können umfassen:
Klar ist, dass Amazon selbst erwartet, dass KI seinen zukünftigen Personalbedarf verändern wird.
Die Quelle wechselt anschließend von der Büroautomatisierung zu Lagerhäusern und Logistik.
Berichte, die auf internen Amazon-Dokumenten basieren, beschreiben eine ehrgeizige Roboterstrategie.
Berichten zufolge ist das Ziel, innerhalb der nächsten Jahre einen großen Teil des Lagerbetriebs zu automatisieren, was Amazon möglicherweise ermöglicht, bei steigendem Frachtvolumen die Einstellung von zusätzlich mehreren hunderttausend Mitarbeitern zu vermeiden.
Eine weit verbreitete Schätzung besagt, dass die Automatisierung es Amazon ersparen könnte:
bis 2027 rund 160.000 zusätzliche US-Mitarbeiter einzustellen
sowie mehr als:
bis etwa 2033 über 600.000 zusätzliche Mitarbeiter einzustellen
verglichen mit einem weniger automatisierten Wachstumspfad.
Diese Zahlen basieren auf berichteten internen Prognosen und nicht auf öffentlichen Zusagen von Amazon, 600.000 bestehende Mitarbeiter zu entlassen.
Diese Unterscheidung ist wichtig.
„Zukünftige Einstellungen vermeiden“ und „bestehende Arbeitsplätze abbauen“ sind wirtschaftlich verwandt, aber nicht identisch.

Amazon betont öffentlich, dass Robotik auch unterschiedliche Rollen schaffen kann in Bereichen wie:
Die langfristigen Auswirkungen auf die Belegschaft bleiben umstritten.
Der Ökonom Daron Acemoglu ist einer der prominentesten Kritiker. Er warnt, dass aggressive Automatisierung durch große Arbeitgeber Unternehmen von Massenarbeitsplatzschaffern in Akteure verwandeln könnte, die zahlreiche Stellen abbauen oder vermeiden.
Das zweite Hauptkapitel der Quelle wechselt von Amazon zu breiterem Silicon-Valley-Verhalten: Tokenmaxxing (Maximierung des Token-Verbrauchs).
Eine Zeit lang trieben Unternehmen die KI-Nutzung so aggressiv voran, dass die Nutzung selbst zu einem Statussymbol wurde.
Manager wollten, dass Mitarbeiter:
In einigen Organisationen entwickelte sich diese Ermutigung zu Bestenlisten.
Und sobald Metriken sichtbar werden, lernen Mitarbeiter, diese Metrik zu optimieren.
Dies ist ein klassischer Fall des Goodhartschen Gesetzes:
Sobald eine Kennzahl zum Ziel wird, ist sie keine gute Kennzahl mehr.
Das Unternehmen möchte produktive KI-Anwendungen.
Es misst die Token-Nutzung, weil die Token-Nutzung leicht zu erfassen ist.
Die Mitarbeiter erhöhten daraufhin die Token-Nutzung.
Die Zahlen stiegen.
Aber die effektive Leistung stieg nicht unbedingt mit.
Amazon hatte eine inoffizielle interne Bestenliste namens KiroRank.
Sie verfolgte oder rankte Mitarbeiter anhand ihrer Aktivitäten mit Kiro (dem KI-Entwicklungstool von Amazon).
Laut Business Insider und der Financial Times begannen einige Mitarbeiter, unnötige KI-Aufgaben auszuführen, um ihre Punktzahl zu verbessern.
Amazon schloss die Bestenliste schließlich.
Der Senior Vice President Dave Treadwell sagte den Mitarbeitern, sie sollten KI nicht um der KI willen nutzen.
Amazon wechselte zu Kennzahlen, die stärker auf die tatsächliche Leistung fokussiert sind, einschließlich einer Metrik namens normalisierte Bereitstellungen (normalized deployments).
Die Lehre ist einfach:
Token-Verbrauch
≠
Produktivität
Ein Entwickler, der 100 Millionen Tokens verbraucht und nichts liefert, ist nicht automatisch produktiver als einer, der mit 5 Millionen Tokens ein Problem löst.
Berichten zufolge machte auch Meta ähnliche Experimente.
Eine von Mitarbeitern erstellte interne Bestenliste namens Claudeonomics aggregierte die KI-Nutzung von über 85.000 Mitarbeitern und zeigte die Top-250-Nutzer an.
In den Berichten tauchten Titel auf wie:
Beschreibe deine Idee einmal, und We0 AI erstellt eine Showcase-Website, Seiten und ein CMS und hilft nach dem Launch bei Kunden und Traffic.
Eine komplette Projektgeneration zur kostenlosen Registrierung
Am besten geeignet, um einen vollständigen Generierungsablauf auszuprobieren und schnell einen ersten Projektentwurf zu sehen.
Session Immortal.
Laut The Information verbrauchten Meta-Mitarbeiter innerhalb eines rollierenden 30-Tage-Zeitraums zig Billionen Token.
Spätere Berichte bezifferten die 30-Tage-Gesamtmenge auf annähernd:
73,7 Billionen Token
Meta führte daraufhin strengere Nutzungskontrollen ein und richtete ein zentrales AI Gateway ein, für Kostentransparenz und Budgetverwaltung.
Diese Daten basieren auf der Abdeckung interner Berichte, nicht auf Meta’s öffentlichen Finanzberichten.
Der Quellartikel rechnete die 73,7 Billionen Token zudem in eine hypothetische monatliche Rechnung von 221 Millionen US-Dollar um.
Diese Zahl ist nicht als tatsächliche Rechnungshöhe von Meta zu verstehen.
Im Kern handelt es sich um:
73,7 Billionen Token
×
3 US-Dollar pro Million Token
≈
221 Millionen US-Dollar
Dies setzt voraus, dass jeder Token zum Listenpreis eines Eingabetokens abgerechnet wird.
Die tatsächliche Nutzung kann unterschiedliche Modelle, ausgehandelte Unternehmensraten, Eingabe-/Ausgabemischungen, Caching, interne Modelle und Plattformvereinbarungen umfassen.
Die brauchbare Tatsache ist der berichtete Umfang der Token-Nutzung – nicht die vereinfachte Abrechnungsumrechnung.
Auch Uber stieß auf ähnliche Budgetprobleme.
Einem Bericht vom Juni 2026 zufolge hatte das Unternehmen sein Jahresbudget für agentische Codierungswerkzeuge bereits im ersten Quartal ausgeschöpft.
Vier Monate in das Jahr hinein.
Daraufhin führte Uber standardmäßige Obergrenzen ein:
1.500 US-Dollar pro Mitarbeiter
monatlich
pro agentischem Codierungswerkzeug
Diese Grenze galt jeweils für folgende Werkzeuge:
Mitarbeiter konnten ihre Nutzung über ein internes Dashboard einsehen; Ausnahmen waren möglich, wenn Mehrkosten begründet waren.
Dies ähnelt stärker dem klassischen Cloud-FinOps.
Die Frage verlagerte sich von:
Wie viel KI nutzen Mitarbeiter?
hin zu:
Was kostet dieser Workflow,
und ist das Ergebnis den Preis wert?
Uber-Führungskräfte vertraten durchweg die Auffassung, dass KI erhebliche Effizienzsteigerungen bringen kann.
Es ging nicht um den Wechsel von „KI nutzen“ zu „KI nicht nutzen“.
Sondern von unbegrenztem Konsum zu gelenktem Konsum.
Auch Modellanbieter stehen intern vor diesen wirtschaftlichen Fragen.
Bei einer Unternehmensveranstaltung im Juni 2026 sagte Sam Altman, der interne Spitzenverbraucher von Tokens bei OpenAI verbrauche monatlich etwa:
100 Milliarden Token
Er verglich dies mit vor etwa sechseinhalb Jahren, als 100.000 Token pro Monat bereits als ungewöhnlich hoch galten.
Business Insider zitierte zudem einen Bericht der New York Times, wonach ein OpenAI-Mitarbeiter innerhalb einer Woche etwa:
210 Milliarden Token
verbrauchte.
Altman sagte, die Kosten hätten sich von einem Thema, das Kunden Anfang 2026 kaum erwähnten, zu einem:
„riesigen Problem“
im selben Jahr entwickelt.
Die Ironie liegt auf der Hand.
KI-Labore wollen Modelle billiger machen, damit Kunden mehr KI einsetzen können.
Da Modelle günstiger und Agenten autonomer werden, kann das Gesamtnutzungswachstum den Rückgang der Einheitspreise übertreffen.
Dies ist eine Ausprägung des Jevons-Paradoxons:
Niedrigere Stückkosten
→ mehr Nutzung
→ Gesamtausgaben können steigen
Kostenkontrolle ist schwierig, weil KI-Nutzung überall verstreut ist.
Unternehmen können KI auf folgenden Wegen bezahlen:
Ein CFO-Bericht des Wall Street Journal zitierte eine Umfrage, die ergab, dass nur:
26 % der Unternehmen
ihre KI-Kosten vollständig überblicken können.
Das bedeutet, viele Unternehmen versuchen bereits, KI-Ausgaben zu optimieren, bevor sie KI-Kosten zuverlässig zuordnen können.
Finanzteams kennen vielleicht die Gesamtrechnung von Anbietern, aber nicht:
Ein brauchbares unternehmensweites KI-Kostensystem sollte mehrere Ebenen von Fragen beantworten.
Nachverfolgung nach:
Unterscheidung zwischen:
Kosten verknüpfen mit:
Gelieferten Ergebnissen.
Überwachung auf:
Ziel ist nicht nur die Reduzierung von Token.
Sondern die Erkennung von Tokens mit geringem Wert.
Eine monatliche Dollar-Obergrenze ist nützlich, aber nicht vollständig.
Produktionsreife Agenten sollten in der Regel mehrere Begrenzungen gleichzeitig haben.
Beispiel:
Pro Aufgabe:
Maximale Laufzeit: 30 Minuten
Maximale Anzahl Modellaufrufe: 80
Maximale Wiederholungen pro Werkzeug: 3
Maximale Kosten: 5 $
Pro Benutzer:
Tagesbudget: 50 $
Pro Team:
Monatsbudget: 25.000 $
Global:
Alarm bei +100 % Stundenausgaben
Notfall-Schalter
Die konkreten Werte hängen vom Anwendungsfall ab.
Die Architektur ist der entscheidende Teil.
Ein außer Kontrolle geratenes System sollte mehrere voneinander unabhängige Barrieren treffen, bevor es zu einer unerwarteten Siebenstelligen-Rechnung kommt.
Herkömmliche Software wartet in der Regel auf neue Anfragen, bevor sie weiterarbeitet.
Agenten können sich ihren nächsten Schritt selbst erschaffen.
Das verändert das Risikomodell.
Angenommen, ein Agent erhält einen Auftrag wie:
Finde den richtigen Autorendatensatz und aktualisiere die Datenbank.
Er stellt fest, dass eine Mehrdeutigkeit vorliegt.
Er sucht erneut.
Dann lässt er das Modell Kandidaten vergleichen.
Dann wiederholt er einen API-Aufruf.
Dann erzeugt er neue Suchabfragen.
Dann erweitert er den Kontext.
Dann läuft er in einer Schleife.
Wenn das Erfolgskriterium schlecht definiert ist, kann das System lange „beschäftigt“ bleiben, ohne korrekter zu werden.
Agenten brauchen ein Konzept von:
Stopp
– aus technischen wie aus finanziellen Gründen.
Der Originaltext endete mit einem bekannten Automatisierungs-Fiasko aus der Zeit vor der KI: Knight Capital.
Der Vergleich ist nützlich, weil Knights Problem nichts mit LLMs zu tun hatte.
Es war ein Versagen bei automatisierter Software, Deployment-Kontrolle und Verlustbegrenzung.
Am 1. August 2012 stellte Knight Capital neue Handelsoftware für das Retail-Liquiditätsprogramm der New Yorker Börse bereit.
Nach Angaben der US-Börsenaufsicht SEC führte ein fehlerhaftes Deployment dazu, dass alter Code auf einem Server weiterhin aktiv blieb.
Als das neue System online ging, begann die ruhende Funktion, ungewollte Aufträge an den Markt zu senden.
Das System lief etwa:
45 Minuten
weiter.
Die SEC erklärte später, Knight habe ein unbeabsichtigtes Portfolio von Wertpapieren im Umfang von mehreren Milliarden Dollar angehäuft, mit Verlusten von über:
460 Millionen US-Dollar
Der ursprüngliche chinesische Artikel verwendete die häufig zitierte Zahl von 440 Millionen US-Dollar. Späteres Durchsetzungsmaterial der SEC nennt über 460 Millionen US-Dollar, daher übernimmt diese Übersetzung die Zahl der Aufsichtsbehörde, um Genauigkeit zu gewährleisten.
Die Kritik der SEC zielte nicht nur auf den Softwarefehler.
Software hat immer Fehler.
Die schwerwiegenderen Versäumnisse waren:
Knights Systeme arbeiten mit Maschinengeschwindigkeit.
Diese Geschwindigkeit ist
in der Regel ein Vorteil.
Bei einer Störung verstärkt dieselbe Geschwindigkeit den Schaden.
Das Grundmuster ist nahezu identisch mit dem Risiko der Vertretungskosten:
Automatisierung funktioniert normal
→ Geschwindigkeit ist Wert
Automatisierung versagt
→ Geschwindigkeit vergrößert Verluste
Knights Systeme verloren direkt Geld durch Handel.
Die meisten Unternehmensagenten haben keinen Brokerzugang.
Aber sie haben einen Zähler.
Jeder Modellaufruf kann Kosten verursachen.
Jedes Tool kann Auswirkungen nachgelagerter Systeme haben.
Bestimmte Agenten können auch autorisiert sein, um:
Je mehr Berechtigungen KI-Systeme erhalten, desto mehr ähneln ihre Fehlerbilder nicht mehr Chatbot-Fehlern, sondern vielmehr einem Versagen der Automatisierungssteuerung.
Deshalb muss sich KI-Governance zunehmend an Konzepten orientieren, die aus Finanzsystemen und Cloud-Infrastruktur vertraut sind:
Der Originaltext endet mit dem richtigen Prinzip.
Automatisierung verspricht:
Diese Vorteile sind real.
Aber Systeme verstärken nicht selektiv nur korrektes Verhalten.
Sie verstärken gleichermaßen:
Die gefährlichste Automatisierung ist nicht unbedingt das System, das sofort zusammenbricht.
Sondern das, das weiterhin produktiv aussieht, während es schnell, wiederholt und unsichtbar versagt.
Berichten zufolge ist das 1,8-Millionen-Dollar-Claude-Projekt bei Amazon kein Grund, den Einsatz von Agenten einzustellen.
Sondern ein Grund, den Agentenverbrauch nicht mehr als unbegrenztes Experiment zu betrachten.
Es geht nicht darum, die Rechnung um jeden Preis so niedrig wie möglich zu halten.
Sondern darum, die Rechnung erklärbar zu machen.
Die Financial Times berichtete, dass ein Amazon-Projekt mit Claude Sonnet kumulierte Kosten von etwa 1,8 Millionen Dollar verursachte, etwa 860% über dem Budget, wobei das Problem erst nach etwa fünf Monaten entdeckt wurde. Die Zahl stammt aus internen Mitarbeiterberichten, nicht aus einem öffentlichen Vorfallsbericht von Amazon.
Hat das Amazon-Projekt wirklich 600 Milliarden Token verwendet?
Diese Zahl ist nur ein grobes Rechenbeispiel, basierend auf 1,8 Millionen Dollar geteilt durch einen Preis von 3 Dollar pro Million Eingabe-Token. Die tatsächliche Tokenanzahl des Projekts, die Modellversion, die Eingabe-/Ausgabekombination, die Cache-Nutzung und andere Gebühren wurden nicht öffentlich offengelegt.
Anthropic listet Claude Sonnet 5 derzeit mit 2 Dollar pro Million Standard-Eingabe-Token und 10 Dollar pro Million Ausgabe-Token. Sonnet 4.6 und 4.5 werden mit 3 Dollar bzw. 15 Dollar gelistet, ohne anwendbare Cache-, Batch-Verarbeitungs- oder Cloud-Plattformunterschiede.
Agenten können für eine einzelne Benutzeranfrage mehrere Modellaufrufe auslösen, große Kontexte wiedergeben, Tools aufrufen und fehlgeschlagene Operationen automatisch wiederholen. Wenn der Workflow in eine Schleife gerät oder es an einer Stoppbedingung fehlt, können die Ausgaben weiter steigen, selbst wenn die Aufgabe keinen sinnvollen Fortschritt mehr erzielt.
KiroRank ist Berichten zufolge ein inoffizielles internes Ranking, das mit der Nutzung von Amazons KI-Tool Kiro durch Mitarbeiter zusammenhängt. Berichten zufolge hat Amazon es abgeschaltet, nachdem Mitarbeiter begannen, nur noch diese Kennzahl zu optimieren, und die Führungskräfte die Mitarbeiter anwiesen, KI nicht nur zur Steigerung der Nutzung einzusetzen.
Wirksame Kontrollen umfassen: Dollar-Budgets pro Aufgabe, Begrenzung der Modellaufrufe, Wiederholungsobergrenzen, Timeouts, Kontingente pro Benutzer und Team, Anomaliewarnungen, Nutzungszuordnung und einen Not-Aus-Schalter. Die beste Kennzahl ist in der Regel die Kosten pro erfolgreichem Geschäftsergebnis, nicht die rohe Tokenmenge.
Knight Capital verlor nach einem fehlgeschlagenen automatisierten Handelseinsatz ohne ausreichende Sicherheitsmechanismen in etwa 45 Minuten mehr als 460 Millionen Dollar. Der Vorfall veranschaulicht dasselbe allgemeine Prinzip: Automatisierung erhöht die Geschwindigkeit effektiver Arbeit, aber auch die Geschwindigkeit und das Ausmaß von Fehlern.
Eine reine Preissenkung reicht nicht aus. Niedrigere Stückpreise können zu höherer Nutzung ermutigen, insbesondere wenn Agenten autonom laufen. Unternehmen benötigen weiterhin Transparenz, Budgets, Routing, Caching und ergebnisbasierte Messung.
führt zu unkontrollierten Ausgaben](https://www.ft.com/content/77baac40-d803-4084-94f3-a133653072cf): Der Hauptbericht über das 1,8-Millionen-Dollar-Claude-Projekt bei Amazon und andere interne Kostenüberschreitungen.
com/news/company-news/amazon-ceo-andy-jassy-on-generative-ai): Offizielles Amazon-Memorandum, das über 1.000 generative KI-Dienste sowie Jassys Erwartungen an Milliarden zukünftiger Agenten beschreibt.
Einem Bericht zufolge verursachte ein Amazon-Projekt mit Claude Sonnet Rechnungen in Höhe von 1,8 Millionen US-Dollar – rund 860 % über dem Budget. Es dauerte fünf Monate, bis der Fehler entdeckt wurde, und das Projekt wurde letztlich nie in Betrieb genommen. Dieser Vorfall zeigt, dass ein gewöhnlicher Softwarefehler außergewöhnlich teuer werden kann, wenn ein Agent wiederholt kostenpflichtige KI-Ressourcen ohne starke Abbruchbedingungen verbraucht.
Amazon zieht sich nicht aus dem KI-Bereich zurück. AWS wächst rasant, das Unternehmen plant für 2026 Kapitalausgaben von rund 220 Milliarden US-Dollar, und Andy Jassy beschreibt eine Zukunft mit Milliarden von Agenten. Die Reaktion auf außer Kontrolle geratene Kosten dürfte daher eher eine verstärkte Kostenkontrolle sein als eine Reduzierung der Automatisierung.
Der gleiche Wandel ist im gesamten Silicon Valley sichtbar. Amazon hat KiroRank eingestellt, Meta ist von Tokenmaxxing zu Budgetmodellen übergegangen, Uber hat eine monatliche Obergrenze von 1.500 US-Dollar pro Mitarbeiter und Tool für die Codierung festgelegt, und Sam Altman erklärte, dass KI-Kosten selbst innerhalb von OpenAI zu einem großen Anliegen geworden sind.
Das Scheitern von Knight Capital bietet eine zeitlose Lehre: Automatisierung verstärkt nicht nur Effizienz. Wenn die Kontrollen schwach sind, verstärkt sie Fehler im gleichen Tempo.
Die richtige unternehmensweite KI-Kennzahl lautet nicht: „Wie viele Tokens haben wir verbraucht?“ sondern: „Welche messbaren Ergebnisse haben diese Tokens erzielt, und was bringt das System zum Stillstand, sobald sie keinen Wert mehr erzeugen?“
Starte mit einem Satz und erhalte in wenigen Minuten eine vollständige Website.