// HEISE ONLINE — INTELLIGENZA ARTIFICIALE
Claude Haiku 5.5: Anthropic senkt API-Preise um bis zu 90 Prozent
Haiku 5.5 legt in Benchmarks deutlich zu. Zugleich senkt Anthropic die API-Preise um bis zu 90 Prozent und reagiert damit auf den wachsenden Preisdruck.
Anthropic hat mit Claude Haiku 5.5 eine neue Version seiner kleinsten und günstigsten Modellreihe veröffentlicht. Es ist für wiederkehrende, zeitkritische Aufgaben wie Zusammenfassungen, Datenbankabfragen oder Kundensupport ausgelegt und soll größere Claude-Modelle als Subagent bei Programmieraufgaben unterstützen. Bei Standardgeschwindigkeit ist es laut Anthropic das bislang schnellste Modell des Unternehmens.
Haiku 5.5 verarbeitet Text und Bilder, gibt aber nur Text aus. Das Kontextfenster wächst gegenüber Haiku 4.5 von 200.000 auf eine Million Tokens, die maximale Ausgabe von 64.000 auf 128.000 Tokens. Der Wissensstand reicht bis Juni 2026.
Neu an Haiku 5.5 ist, dass es selbst entscheidet, wann und wie viele zusätzliche Denkschritte benötigt werden. Entwickler können den Denkaufwand über mehrere Stufen steuern, standardmäßig ist in der API die mittlere Stufe eingestellt. Außerdem unterstützt Haiku erstmals ein Werkzeug zur Browserbedienung, das derzeit über Anthropics API und Google Cloud verfügbar ist. Für die Browser- und Computerbedienung erweitert Anthropic zudem seine Python- und TypeScript-SDKs.
Haiku 5.5 ist über die Claude-Plattform sowie AWS, Google Cloud und Microsoft Azure verfügbar.
Im Intelligence Index von Artificial Analysis (AA) erreicht Haiku 5.5 bei maximalem Denkaufwand 43 Punkte und damit 26 mehr als Haiku 4.5. Es liegt damit knapp vor kleinen Konkurrenten wie Gemini 3.8 Flash und GPT-6 Luna, aber deutlich hinter Sonnet 5.5 (56 Punkte).
Auch bei Agentenaufgaben legt es zu. Im AA-Briefcase-Test für praxisnahe Wissensarbeit erreicht Haiku 5.5 ein Ergebnis, das mit GPT-6 Astra vergleichbar ist. Auf Terminal-Bench 4.0 löst es 33 Prozent der Aufgaben, der Vorgänger erreichte null Prozent. Auch bei der Computerbedienung gibt es deutliche Fortschritte: Auf einer Offline-Teilmenge des OSWorld-2.1-Benchmarks steigt der durchschnittliche Anteil erfüllter Teilziele laut Anthropic von 15,7 auf 72,4 Prozent. Bei Faktenfragen ist das Modell weniger treffsicher als mehrere Konkurrenten, halluziniert laut AA aber seltener.
Für Prompts bis 100.000 Tokens kostet Haiku 5.5 pro Million Eingabetokens 0,10 US-Dollar und pro Million Ausgabetokens 0,50 Dollar. Das ist jeweils 90 Prozent weniger als Haiku 4.5. Bei längeren Prompts steigen die Preise auf 0,50 beziehungsweise 2,50 Dollar, liegen damit aber immer noch 50 Prozent unter denen des Vorgängers.
Der günstige Tokenpreis wird durch hohen Verbrauch relativiert: Bei maximalem Denkaufwand benötigt Haiku 5.5 laut AA rund 162.000 Ausgabetokens pro Aufgabe, etwa dreimal so viele wie GPT-6 Luna. Der Sprung von der zweit- zur höchsten Denkstufe erhöht den Verbrauch um rund 80 Prozent, bringt aber nur zwei zusätzliche Indexpunkte.
Hinzu kommt ein neuer Tokenizer, der denselben Eingabetext in rund 30 Prozent mehr Tokens zerlegt als der von Haiku 4.5. Da Anthropic nach Tokens abrechnet, fällt die tatsächliche Kostenersparnis dadurch etwas geringer aus. Die vorläufigen Kostenvergleiche von AA berücksichtigen die höheren Preise für lange Prompts noch nicht.