Claude Haiku 5.5: Anthropic senkt API-Preise und verbessert Leistung deutlich
Anthropic hat mit Claude Haiku 5.5 die neueste Ausgabe seiner kleinsten und zugleich günstigsten Modellreihe vorgestellt. Das Modell ist für wiederkehrende und zeitkritische Aufgaben wie Zusammenfassungen, Datenbankabfragen oder Kundensupport gedacht und soll größere Claude-Modelle bei Programmieraufgaben als Subagent unterstützen. Bei Standardgeschwindigkeit handelt es sich laut Anthropic um das bislang schnellste Modell des Unternehmens. Das Kontextfenster wächst gegenüber Haiku 4.5 von 200.000 auf eine Million Tokens, die maximale Ausgabe steigt von 64.000 auf 128.000 Tokens, und der Wissensstand reicht bis Juni 2026.
Haiku 5.5 verarbeitet sowohl Text und Bilder, kann allerdings trotzdem nur Text ausgeben. Neu ist, dass es selbst entscheidet, wann und wie viele zusätzliche Denkschritte nötig sind, wobei Entwickler den Denkaufwand nun zudem über mehrere Stufen steuern können und standardmäßig die mittlere Stufe aktiv ist. Erstmals unterstützt Haiku außerdem ein Werkzeug zur Browserbedienung, das über die Anthropic-API und Google Cloud verfügbar ist, während die Python- und TypeScript-SDKs für die Browser- und Computerbedienung erweitert wurden. Das Modell läuft auf der Claude-Plattform sowie bei AWS, Google Cloud und Microsoft Azure.
Im Intelligence Index von Artificial Analysis erreicht Haiku 5.5 bei maximalem Denkaufwand 43 Punkte und liegt damit 26 Punkte über Haiku 4.5. Damit positioniert es sich knapp vor kleinen Konkurrenten wie Gemini 3.8 Flash und GPT-6 Luna, bleibt aber deutlich hinter Sonnet 5.5 mit 56 Punkten. Bei Agentenaufgaben legt das Modell ebenfalls zu. Im AA-Briefcase-Test für praxisnahe Wissensarbeit erzielt es ein Ergebnis, das mit GPT-6 Astra vergleichbar ist, und auf Terminal-Bench 4.0 löst es 33 Prozent der Aufgaben, während der Vorgänger gar keine löste. Bei der Computerbedienung steigt der durchschnittliche Anteil erfüllter Teilziele auf einer Offline-Teilmenge des OSWorld-2.1-Benchmarks nach Angaben von Anthropic von 15,7 auf 72,4 Prozent. Bei Faktenfragen ist Haiku 5.5 weniger treffsicher als mehrere Konkurrenten, halluziniert laut AA aber seltener.
Der Preis ist ein zentrales Argument. Für Prompts bis 100.000 Tokens verlangt Anthropic pro Million Eingabetokens 0,10 US-Dollar und pro Million Ausgabetokens 0,50 Dollar, was jeweils 90 Prozent weniger als bei Haiku 4.5 bedeutet. Bei längeren Prompts steigen die Preise auf 0,50 beziehungsweise 2,50 Dollar, liegen damit aber immer noch 50 Prozent unter denen des Vorgängers. Der günstige Tokenpreis wird allerdings durch einen hohen Verbrauch relativiert. Bei maximalem Denkaufwand benötigt Haiku 5.5 laut AA rund 162.000 Ausgabetokens pro Aufgabe und damit etwa dreimal so viele wie GPT-6 Luna. Der Sprung von der zweit- zur höchsten Denkstufe erhöht den Verbrauch um rund 80 Prozent, bringt aber nur zwei zusätzliche Indexpunkte. Hinzu kommt ein neuer Tokenizer, der denselben Eingabetext in etwa 30 Prozent mehr Tokens zerlegt als der von Haiku 4.5, sodass die tatsächliche Kostenersparnis etwas geringer ausfällt. Die vorläufigen Kostenvergleiche von AA berücksichtigen die höheren Preise für lange Prompts noch nicht.
Auch das neu eingeführte Sonnet 5.5 wird günstiger, denn der Cache-Lesepreis wird halbiert, wodurch agentische Aufgaben nach Unternehmensangaben rund 20 Prozent weniger kosten sollen. Max- und Team-Abonnenten können zudem monatliche API-Guthaben beanspruchen. Max 5x bietet 100 US-Dollar, Max 20x 200 Dollar und Team-Abos je nach gebuchten Plätzen insgesamt bis zu 500 Dollar. Diese Guthaben lassen sich für Anwendungen auf der Claude-Plattform verwenden, nicht aber für die reguläre interaktive Nutzung von Claude Code.