For AI agents: the public content index is available at https://we0.ai/llms.txt, and the English article bundle is available at https://we0.ai/llms-full.txt.
For AI agents: the complete content index is available at https://we0.ai/llms.txt, the full English article bundle is available at https://we0.ai/llms-full.txt, and this page is available as Markdown at https://we0.ai/de/articles/claude-haiku-5-vs-gpt-6-luna-benchmarks-p-ec36c306.md.
Anthropic hat **Claude Haiku 5.5** veröffentlicht – und das ist keine routinemäßige Aktualisierung eines kleinen Modells.

Anthropic hat Claude Haiku 5.5 veröffentlicht – und das ist keine routinemäßige Aktualisierung eines kleinen Modells.
Das neue Haiku geht bei Computersteuerung, Programmierung, professioneller Arbeit und agentischen Aufgaben mit vielen Tool-Aufrufen weit über Haiku 4.5 hinaus und senkt gleichzeitig den offiziellen API-Preis deutlich.
In den eigenen Launch-Vergleichen von Anthropic übertrifft Haiku 5.5 GPT-6 Luna außerdem bei mehreren Benchmarks, darunter GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0, FrontierCode 1.1 und Chartography.
Damit wird Haiku 5.5 zu einer ernstzunehmenden neuen Option für Workloads mit hohem Volumen, etwa:
Der Launch bringt jedoch auch wichtige Einschränkungen mit sich.
Die Preise ändern sich an der Grenze von 100.000 Prompt-Token, der Tokenizer verwendet für denselben Text mehr Token, und die Aktualisierung einer bestehenden Haiku-4.5-Integration erfordert mehrere API-Änderungen.

Anthropic positioniert Haiku 5.5 als das bisher günstigste, schnellste und leistungsfähigste kleine Modell des Unternehmens.
Die offizielle Benchmark-Tabelle macht den vorgesehenen Wettbewerber deutlich: GPT-6 Luna wird direkt neben Haiku 5.5 aufgeführt.

Die Launch-Ergebnisse umfassen:
| Benchmark | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1, Offline-Teilmenge | 72,4 % | 15,7 % | 48,9 % | 83,9 % |
| Humanity’s Last Exam, ohne Tools | 45,9 % | 10,2 % | — | 56,9 % |
| Humanity’s Last Exam, mit Tools | 57,4 % | 18,7 % | — | 64,5 % |
| Terminal-Bench 4.0 | 39,2 % | 0,0 % | 16,4 % | 70,6 % |
| FrontierCode 1.1 (Main) | 46,4 % | — | 42,4 % | 52,1 % |
| Chartography, ohne Tools | 46,4 % | 6,4 % | 29,1 % | 61,6 % |
Die Schlussfolgerung lautet nicht, dass Haiku 5.5 plötzlich jedes größere Modell ersetzt.
Vielmehr ist die kleinste Claude-Klasse bei Aufgaben deutlich leistungsfähiger geworden, für die zuvor häufig ein größeres Modell erforderlich war.
Für Prompts mit bis zu 100.000 Token berechnet Anthropic:
Haiku 5.5 Eingabe: $0.10 / 1 Mio. Token
Haiku 5.5 Ausgabe: $0.50 / 1 Mio. Token
Cache-Lesen: $0.01 / 1 Mio. Token
Cache-Schreiben: $0.125 / 1 Mio. Token
Die Standardpreise von OpenAI für GPT-6 Luna liegen derzeit bei:
GPT-6 Luna Eingabe: $0.10 / 1 Mio. Token
GPT-6 Luna Cache-Eingabe: $0.01 / 1 Mio. Token
GPT-6 Luna Cache-Schreiben: $0.125 / 1 Mio. Token
GPT-6 Luna Ausgabe: $0.50 / 1 Mio. Token
Bei Standard-API-Aufgaben mit kurzem Kontext liegen die beiden Modelle bei den offiziellen Tokenpreisen also nahezu exakt gleichauf.

Haiku 5.5 verwendet zwei Preisstufen.
| Tokentyp | Prompt ≤100K | Prompt >100K |
|---|---|---|
| Cache-Lesen | $0.01/M | $0.05/M |
| Cache-Schreiben | $0.125/M | $0.625/M |
| Eingabe | $0.10/M | $0.50/M |
| Ausgabe | $0.50/M | $2.50/M |
Anthropic zufolge entfielen bei Haiku 4.5 rund 90 % der Anfragen auf Prompts mit bis zu 100.000 Token. Deshalb deckt die niedrigere Preisstufe den erwarteten Großteil des Traffics ab.
Bei Prompts mit mehr als 100.000 Token ist Haiku 5.5 weiterhin günstiger als Haiku 4.5, allerdings fällt der Rabatt geringer aus.
Der Ausgangsartikel vergleicht Haiku 5.5 mit DeepSeek-V4.1-Flash.
Die offiziellen Preise von DeepSeek verwenden derzeit Spitzen- und Nebenzeiten.
Für Eingaben ohne Cache-Treffer und Ausgaben gilt:
| Modell | Eingabe / 1 Mio. | Ausgabe / 1 Mio. |
|---|---|---|
| Haiku 5.5, Prompt ≤100K | $0.10 | $0.50 |
| DeepSeek-V4.1-Flash, Nebenzeiten | $0.15 | $0.60 |
| DeepSeek-V4.1-Flash, Spitzenzeiten | $0.30 | $1.20 |
DeepSeek bleibt bei Cache-Treffern günstiger, insbesondere außerhalb der Spitzenzeiten. Die Gesamtkosten hängen daher weiterhin von der Struktur des Workloads ab.

Die vorherige Haiku-Generation war bei anspruchsvollen Aufgaben mit Computersteuerung nicht konkurrenzfähig.
Haiku 5.5 verändert das deutlich.
Das Ergebnis von Anthropic auf der Offline-Teilmenge von OSWorld 2.1 steigt von 15,7 % bei Haiku 4.5 auf 72,4 % bei Haiku 5.5 mit maximalem Aufwand.
Der Ausgangsartikel führte außerdem einen Praxistest durch: Haiku 5.5 sollte Preisangaben zu GPT-6 und DeepSeek in die Tabelle auf der Haiku-Launch-Seite einfügen.
Statt einzelne HTML-Elemente manuell über die Benutzeroberfläche zu bearbeiten, öffnete das Modell die Browserkonsole und fügte die Änderungen per Skript ein.

Dieses Verhalten ist nützlich, weil Agenten mit Computersteuerung nicht immer menschliche Mausbewegungen buchstäblich nachahmen müssen.
Wenn eine Browserumgebung einen direkteren Ausführungspfad bietet, kann die Verwendung eines Skripts schneller und zuverlässiger sein, als jede einzelne Zelle anzuklicken.
Haiku 5.5 ist das erste Modell der Haiku-Klasse mit einer einstellbaren Kontrolle für den Bearbeitungsaufwand.
Das Modell unterstützt ein Spektrum von kostengünstigerem, schnellerem Verhalten bis hin zu teurerem und gründlicherem Schlussfolgern.
Das Launch-Diagramm von Anthropic zeigt bei OSWorld eine klare Kurve zwischen Genauigkeit und Kosten.

Der Ausgangsartikel hebt zwei Punkte dieser Kurve hervor:
Die genauen Kosten einer Produktionsaufgabe variieren je nach Prompt-Länge, Ausgabelänge, Caching und Tool-Nutzung. Das grundsätzliche Muster ist jedoch wichtig.
Haiku kann jetzt abhängig von der Aufgabe abgestimmt werden, anstatt „kleines Modell“ als eine einzige feste Leistungsstufe zu behandeln.
GDPval-AA v2.1 misst reale professionelle Arbeit in 44 Berufen.

Bei maximalem Aufwand meldet Anthropic für Haiku 5.5 eine Elo-Zahl von 1620, verglichen mit 735 für Haiku 4.5.
Auch hier bleibt Sonnet 5.5 leistungsfähiger. Der Abstand zwischen „klein“ und „für den professionellen Einsatz nützlich“ hat sich jedoch stark verringert.
Haiku 5.5 führt einen neueren Tokenizer ein, der mit neueren Claude-Generationen geteilt wird.
Das ist relevant, weil derselbe Text nicht dieselbe Tokenanzahl erzeugt wie bei Haiku 4.5.
Anthropics Migrationsleitfaden zufolge erzeugt derselbe Eingabetext bei Haiku 5.5 ungefähr 30 % mehr Token als bei Haiku 4.5, wobei der genaue Anstieg vom Inhalt abhängt.
Je nach Workload kann die Auswirkung größer oder kleiner sein. Code, Tabellen und nicht englischsprachige Texte sollten besonders gründlich neu vermessen werden.
Daher ist dieser Vergleich zu einfach:
Alter Eingabepreis: $1.00
Neuer Eingabepreis: $0.10
Daraus folgt: Jede Aufgabe ist exakt 90 % günstiger
Die bessere Berechnung lautet:
tatsächliche Aufgabenkosten
= neue Tokenanzahl
× neuer Tokenpreis
+ Cache-Kosten
+ Ausgabekosten
+ Tool-Kosten
Anthropic selbst erklärt, dass Haiku 5.5 unter Berücksichtigung der Änderungen am Tokenizer durchschnittlich etwa 75 % günstiger als Haiku 4.5 ist – und nicht bei jeder Aufgabe pauschal 90 % günstiger.
Artificial Analysis zeigt außerdem, warum die Tokeneffizienz beim Vergleich günstiger Modelle wichtig ist.

Ein Modell kann einen niedrigen Tokenpreis haben und trotzdem deutlich mehr Ausgabetoken benötigen, um eine Aufgabe abzuschließen.
Für Produktionssysteme ist der Preis pro abgeschlossener Aufgabe aussagekräftiger als der Preis pro Million Token allein.
Der Ausgangsartikel macht diesen Punkt deutlich: Die „kleine Tasse“ bleibt eine kleine Tasse.
Haiku 5.5 ist deutlich leistungsfähiger als Haiku 4.5, aber komplexe autonome Programmierung bleibt eine Aufgabe für größere Modelle.
Terminal-Bench 4.0 zeigt den Abstand:
Haiku 5.5: 39,2 %
Sonnet 5.5: 70,6 %
Anthropic empfiehlt für komplexe agentische Programmierung ausdrücklich Sonnet 5.5 oder Opus 5.5.
Haiku 5.5 eignet sich besser für Aufgaben, die bereits klar abgegrenzt sind:
Cognition verwendet diese Struktur bereits in Devin Fusion.
Auf der Launch-Seite heißt es, dass Opus 5.5 als führendes Modell agieren kann, während Haiku 5.5 als Unterstützung arbeitet.
Diese Kombination erreichte im von Cognition gemeldeten Setup einen FrontierCode-Wert von 66,2 und senkte dabei Kosten und Latenz.

Das Muster ist unkompliziert:
Opus / Sonnet
→ Planung, Zerlegung, schwierige Beurteilungen
Haiku 5.5
→ eng abgegrenzte Teilaufgaben, parallele Ausführung, schnelle Abfragen, Zusammenfassungen
Das ist wahrscheinlich eine realistischere Art, Haiku 5.5 einzusetzen, als überall ein größeres Modell ersetzen zu wollen.
Wenn eine Anwendung bereits Haiku 4.5 verwendet, warnt Anthropic davor, dass mehrere Änderungen bestehende Anfragen unbrauchbar machen können.
Die offizielle Modell-ID lautet jetzt:
claude-haiku-5-5
Die Migration umfasst jedoch mehrere zusätzliche Anforderungen.
Eine Haiku-4.5-Anfrage wie diese ist nicht mehr gültig:
{
"thinking": {
"type": "enabled",
"budget_tokens": 8000
}
}
Beschreibe deine Idee einmal, und We0 AI erstellt eine Showcase-Website, Seiten und ein CMS und hilft nach dem Launch bei Kunden und Traffic.
Eine komplette Projektgeneration zur kostenlosen Registrierung
Am besten geeignet, um einen vollständigen Generierungsablauf auszuprobieren und schnell einen ersten Projektentwurf zu sehen.
Haiku 5.5 verwendet stattdessen adaptives Denken und Aufwandssteuerungen:
{
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "medium"
}
}
Eine Anfrage, die noch das alte Format budget_tokens sendet, gibt einen 400-Fehler zurück.
Adaptives Denken ist standardmäßig ebenfalls aktiviert. Anwendungen sollten daher nicht davon ausgehen, dass der erste Inhaltsblock der Antwort immer normaler Antworttext ist.
Analysieren Sie Blöcke anhand ihres type.
max_tokens erneut prüfenDa der neue Tokenizer denselben Text als mehr Token zählt, bieten alte max_tokens-Werte möglicherweise nicht mehr genügend Raum für eine gleichwertige Ausgabe.
Auch Denktoken werden auf das Ausgabebudget angerechnet.
Zählen Sie Prompts mit claude-haiku-5-5 neu, anstatt Token-Schätzungen von Haiku 4.5 wiederzuverwenden.
Haiku 5.5 unterstützt beliebige Sampling-Einstellungen nicht mehr auf dieselbe Weise wie Haiku 4.5.
Anthropic empfiehlt, Folgendes wegzulassen:
temperature
top_p
top_k
Nicht standardmäßige Werte können 400-Fehler verursachen, und top_k wird nicht akzeptiert.
Anwendungen, die Sampling-Parameter für kreative Variationen verwendet haben, sollten diese Steuerung in Prompts oder eine andere Strategie auf Anwendungsebene verlagern.
Haiku 4.5 konnte in bestimmten Konfigurationen mit einer abschließenden Assistant-Nachricht fortfahren.
Haiku 5.5 lehnt Assistant-Prefill ab.
Wenn Sie zuvor ein Präfix wie:
{"result":
verwendet haben, um eine JSON-Ausgabe zu erzwingen, wechseln Sie stattdessen zu strukturierten Ausgaben oder einem Tool-Schema.
Für Claude-API- und Google-Cloud-Integrationen muss die alte Computersteuerungs-Deklaration:
computer_20250124
auf Folgendes umgestellt werden:
computer_toolset_20260801
Das neue Toolset hat eine andere Ereignisstruktur. Die Agentenschleife muss daher die zurückgegebenen Tool-Use-Blöcke korrekt verarbeiten und toolset_name in den Ergebnissen beibehalten.
Haiku 5.5 unterstützt auf unterstützten Plattformen außerdem Anthropics Browser-Use-Toolset für Aufgaben auf Webseiten.
Prüfen Sie vor der Bereitstellung von Haiku 5.5 mindestens die folgenden Punkte:
claude-haiku-5-5.budget_tokens durch adaptives Denken und eine Aufwandsstufe.type, statt davon auszugehen, dass Block null Antworttext enthält.computer_toolset_20260801.refusal.Anthropic stellt außerdem einen automatisierten Claude-Code-Migrationsbefehl bereit:
/claude-api migrate this project to claude-haiku-5-5
Das Tool kann Änderungen an der Modell-ID anwenden und mehrere inkompatible Anfrage-Muster erkennen. Eine manuelle Überprüfung wird dennoch empfohlen.
Haiku 5.5 war nicht die einzige Preisänderung, die Anthropic angekündigt hat.
Der Preis für das Lesen des Sonnet-5.5-Caches wurde gesenkt von:
$0.20 / 1 Mio. Token
auf:
$0.10 / 1 Mio. Token
Anthropic zufolge macht das Lesen des Caches in vielen agentischen Workflows einen großen Anteil des Tokenverbrauchs aus. Die Änderung senkt deshalb die Kosten der meisten agentischen Sonnet-5.5-Aufgaben um ungefähr 20 %.

Dadurch wird eine Architektur mit mehreren Modellen attraktiver:
Sonnet 5.5
→ Planung und anspruchsvollere Ausführung
Haiku 5.5
→ kostengünstige Teilaufgaben mit hohem Volumen
Anthropic hat außerdem monatliche Claude-Platform-Guthaben für berechtigte Max- und Team-Abonnenten eingeführt.
Die derzeit offiziell genannten Guthabenbeträge sind:
| Tarif | Monatliches API-Guthaben |
|---|---|
| Max 5x | $100 |
| Max 20x | $200 |
| Team Standard-Sitz | $20 pro Sitz |
| Team Premium-Sitz | $100 pro Sitz |
| Maximales Team-Pool | $500 |

Die Guthaben können für Claude-Platform-Workloads verwendet werden, etwa:
Sie erhöhen nicht die Nutzungslimits des Claude- oder Claude-Code-Abonnements. Außerdem decken sie keine normalen interaktiven Claude-Code-Sitzungen ab, wenn diese über das Abonnement abgerechnet werden.
Die Guthaben sind mit einer Claude-Console-Organisation verknüpft und werden nicht unbegrenzt übertragen.
Der Ausgangsartikel endet mit einem leichteren Vergleich.
Während Anthropic günstigere Modelle, günstigere Sonnet-Cache-Lesevorgänge und monatliche API-Guthaben ankündigte, gab Thibault Sottiaux, verantwortlich für Codex und ChatGPT Work bei OpenAI, einen weiteren gespeicherten Reset für zahlende Konten bekannt und feierte gleichzeitig 40 Millionen aktive Nutzer über Codex und ChatGPT Work hinweg.

Ein gespeicherter Reset unterscheidet sich von einer dauerhaften Preissenkung.
Dabei handelt es sich um einen zusätzlichen Nutzungs-Reset, den berechtigte Nutzer speichern und einlösen können – nicht um eine Änderung der laufenden Tokenpreise des Modells.
Der Vergleich ist daher eher rhetorischer als technischer Natur:
Anthropic-Launch:
neues kleines Modell + günstigeres Cache-Lesen + monatliche API-Guthaben
OpenAI-Update:
zusätzlicher gespeicherter Nutzungs-Reset für zahlende Codex-/Work-Konten
Beides soll intensiven Nutzern mehr Raum zum Experimentieren geben, funktioniert jedoch über unterschiedliche Mechanismen.
Der Launch macht Haiku deutlich nützlicher, aber die ideale Rolle bleibt relativ klar.
Verwenden Sie Haiku 5.5 für:
Bevorzugen Sie ein größeres Claude-Modell für:
Das günstigste Modell ist nicht immer der günstigste Weg, eine Aufgabe abzuschließen.
Messen Sie für Produktionssysteme:
Kosten pro erfolgreicher Aufgabe
=
Eingabe + Cache + Ausgabe + Tool-Nutzung + Wiederholungen + Fehler
Diese Kennzahl sagt mehr aus als der offizielle Eingabepreis eines Modells.
Claude Haiku 5.5 ist das neueste kleine Claude-Modell von Anthropic. Es wurde für Workloads mit hohem Volumen sowie Kosten- und Latenzempfindlichkeit veröffentlicht. Außerdem ist es das erste Haiku-Modell mit einstellbarem Aufwand und bei Bewertungen zu Programmierung, Computersteuerung und professioneller Arbeit deutlich leistungsfähiger als Haiku 4.5.
Für Prompts mit bis zu 100.000 Token kostet es $0.10 pro Million Eingabetoken und $0.50 pro Million Ausgabetoken. Bei Prompts mit mehr als 100.000 Token steigen die Preise auf $0.50 für Eingaben und $2.50 für Ausgaben pro Million Token. Für Cache-Lesen und Cache-Schreiben gelten separate Preise.
Bei den standardmäßigen Tokenpreisen für kurze Kontexte sind die offiziellen Preise für Eingabe, Cache-Eingabe, Cache-Schreiben und Ausgabe praktisch identisch. Der Preis von Haiku 5.5 steigt oberhalb der Grenze von 100.000 Prompt-Token. Workloads mit langem Kontext sollten daher separat verglichen werden.
Nein. Die eigenen Ergebnisse von Anthropic bei Terminal-Bench 4.0 zeigen 70,6 % für Sonnet 5.5 gegenüber 39,2 % für Haiku 5.5. Haiku eignet sich besser für eng abgegrenzte, wiederholbare Aufgaben mit hohem Volumen und für Subagenten, während Sonnet und Opus weiterhin besser für komplexe autonome Programmierung geeignet sind.
Haiku 5.5 verwendet einen neueren Tokenizer. Laut Anthropics Migrationsleitfaden erzeugt derselbe Text im Durchschnitt etwa 30 % mehr Token als bei Haiku 4.5. Der genaue Anstieg hängt jedoch vom Inhalt ab.
Ja. Zu den wichtigen Änderungen gehören adaptives Denken statt manueller budget_tokens, ein verändertes Verhalten bei Sampling-Parametern, der Wegfall von Assistant-Prefill, ein neues Toolset für Computersteuerung und die Pflicht, Antwortblöcke anhand ihres type zu analysieren. Anthropic stellt einen offiziellen Migrationsleitfaden und einen Claude-Code-Migrationsbefehl bereit.
In der Claude API lautet die Modell-ID claude-haiku-5-5. Anthropic dokumentiert entsprechende IDs für Amazon Bedrock, Google Cloud, Microsoft Foundry und Claude Platform auf AWS.
Berechtigte Max- und Team-Abonnenten können monatliche Claude-Platform-Guthaben beanspruchen. Max 5x erhält $100, Max 20x erhält $200. Bei Team werden die Guthaben nach Sitztyp berechnet und bis zu $500 pro Monat zusammengelegt.
Claude Haiku 5.5 ist eine wesentliche Weiterentwicklung der kleinen Modellklasse von Anthropic. Bei Computersteuerung, professioneller Arbeit, Programmierung und Schlussfolgern übertrifft es Haiku 4.5 deutlich. Gleichzeitig entspricht es bei den offiziellen API-Preisen für kurze Kontexte GPT-6 Luna und übertrifft Luna bei mehreren von Anthropic veröffentlichten Benchmark-Vergleichen.
Der niedrigere Preis ist real, aber Produktionsteams sollten den neuen Tokenizer und die Preisgrenze bei 100.000 Prompt-Token nicht ignorieren. Derselbe Text kann etwa 30 % mehr Token verbrauchen als bei Haiku 4.5, und lange Prompts werden nach der höheren Preisstufe abgerechnet.
Die Migration umfasst außerdem echte inkompatible Änderungen: Adaptives Denken ersetzt manuelle Denkbudgets, benutzerdefinierte Sampling-Steuerungen sind eingeschränkt, Assistant-Prefill entfällt und Integrationen für Computersteuerung benötigen das neuere Toolset. Bestehende Haiku-4.5-Anwendungen sollten dem Migrationsleitfaden folgen, statt nur den Modellnamen zu ändern.
Haiku 5.5 sollte am besten als schnelles, kostengünstiges Ausführungsmodell für Skalierung und Subagenten verstanden werden – nicht als universeller Ersatz für Sonnet oder Opus bei komplexen Aufgaben mit langem Planungshorizont.
Starte mit einem Satz und erhalte in wenigen Minuten eine vollständige Website.