KI-Modelle und Plattformen
Anthropic veröffentlicht Claude Haiku 5.5, senkt die Preise für Small‑Model‑APIs

Anthropic hat am 7. Oktober 2026 Claude Haiku 5.5 veröffentlicht, das neueste Modell seiner Small‑Model‑Klasse, das sofort auf der Claude Platform, Amazon Web Services, Google Cloud und Microsoft Azure zu niedrigeren Preisen als Haiku 4.5 verfügbar ist. Anthropic sagte, das Modell koste im Durchschnitt etwa 75 % weniger als sein Vorgänger.
Anthropic beschreibt Haiku 5.5 als das günstigste, schnellste und leistungsfähigste Small‑Model, das es veröffentlicht hat, konzipiert für volumenintensive, kostenempfindliche Aufgaben wie Zusammenfassungen, Komprimierungen, Datenbankabfragen und Klassifizierungsanfragen. Das Unternehmen sagte, das Modell arbeite zusammen mit Claude Opus 5.5 und Claude Sonnet 5.5 als Sub‑Agent bei Codierungsarbeiten und sei für geschwindigkeitskritische Aufgaben wie Live‑Kundensupport und Browser‑Nutzung geeignet. Eine Fußnote zur Ankündigung relativiert die Geschwindigkeitsbehauptung: Haiku 5.5 ist das bisher schnellste Modell des Unternehmens bei jeder Standardgeschwindigkeit, obwohl es langsamer läuft als die Opus‑Modelle im Schnell‑Modus.
Haiku 5.5 ist Anthropics erstes Haiku‑Klassen‑Modell mit einstellbarer Aufwandseinstellung, die es Nutzern ermöglicht, zwischen Kostenoptimierung und Intelligenzoptimierung zu wählen. Entwickler können es über den Modell‑String claude-haiku-5-5 aufrufen, und Anthropic hat einen Migrationsleitfaden für die Veröffentlichung veröffentlicht. Laut der Systemkarte des Modells wurde Haiku 5.5 auf einer proprietären Mischung aus öffentlich verfügbaren Internetinformationen, öffentlichen und privaten Datensätzen, ausdrücklich für das Training freigegebenen Benutzerdaten sowie synthetischen Daten trainiert, und sein Wissensstand endet im Juni 2026. Das Modell gibt ausschließlich Text aus.
Preisgestaltung und die angegebene Grundlage der Kostensenkung
Für Eingabeaufforderungen bis zu 100.000 Token kostet Haiku 5.5 $0,10 pro Million Eingabetoken und $0,50 pro Million Ausgabetoken, bei Cache‑Lesevorgängen $0,01 und Cache‑Schreibvorgängen $0,125 pro Million. Für Eingabeaufforderungen über 100.000 Token betragen die Preise $0,50 für Eingaben, $2,50 für Ausgaben, $0,05 für Cache‑Lesevorgänge und $0,625 für Cache‑Schreibvorgänge pro Million Token. Haiku 4.5 kostete $1,00 für Eingaben, $5,00 für Ausgaben, $0,10 für Cache‑Lesevorgänge und $1,25 für Cache‑Schreibvorgänge pro Million Token, während Claude Sonnet 5.5 mit $2,00 für Eingaben, $10,00 für Ausgaben, $0,10 für Cache‑Lesevorgänge und $2,50 für Cache‑Schreibvorgänge bepreist wird.
Anthropic sagte, Haiku 5.5 koste im Durchschnitt etwa 75 % weniger als Haiku 4.5, und eine Fußnote erläutert die Grundlage dieser Zahl: Die Listenpreise liegen 90 % unter denen von Haiku 4.5 für Anfragen bis zu 100.000 Token und 50 % darunter für Anfragen über dieser Schwelle, wobei etwa 90 % der Haiku‑4.5‑Anfragen in die niedrigere Kategorie fielen. Die Fußnote weist zudem darauf hin, dass die Berechnung einen aktualisierten Tokenizer berücksichtigt, ähnlich dem, der in Sonnet 5.5 und Opus 5.5 verwendet wird, was bedeutet, dass Haiku 5.5 leicht mehr Token benötigt, um ein gegebenes Arbeitspaket abzuschließen.
Veröffentlichte Benchmarks und frühe Kundentests
Die von Anthropic veröffentlichte Benchmark‑Tabelle zeigt Haiku 5.5 mit 1620 Punkten im GDPval‑AA v2.1, einer Bewertung von Wissensarbeit, im Vergleich zu 735 für Haiku 4.5 und 1437 für GPT‑6 Luna, wobei Sonnet 5.5 zu Referenzzwecken bei 1840 liegt. Dieselbe Tabelle gibt 1578 Punkte im AA‑Briefcase v1.1 gegenüber 614 für Haiku 4.5 an und 72,4 % im Offline‑Teil von OSWorld 2.1, einem Computer‑Nutzungs‑Benchmark, gegenüber 15,7 % für Haiku 4.5. Im Humanity’s Last Exam, einem Test für fachlich‑hochrangiges akademisches Wissen und Denken, verzeichnet die Tabelle 45,9 % ohne Werkzeuge und 57,4 % mit Werkzeugen, verglichen mit 10,2 % bzw. 18,7 % für Haiku 4.5. Außerdem werden 39,2 % im Terminal‑Bench 4.0, einer agentischen Codierungs‑Bewertung, bei der Haiku 4.5 0,0 % erreichte, sowie 46,4 % im FrontierCode 1.1 (Main) und 46,4 % im Chartography ohne Werkzeuge angegeben, wobei Haiku 4.5 dort 6,4 % erzielte.
Sechs Kunden beschrieben frühe Tests in von Anthropic zitierten Kommentaren. Der Staff Software Engineer bei Asana, Aaron Vinh, sagte, dass Haiku 5.5 im Vergleich zu dem Modell, das Asana derzeit verwendet, über 30 % geringere Latenz bei Aufgabenabschlüssen und bis zu 2,5‑mal schnellere Inferenz pro Agenten‑Turn in der Bewertungssuite für das AI‑Teammates‑Agent‑Produkt erreichte. Der herausragende Software Engineer bei HubSpot, Ze’ev Klapow, sagte, Haiku 5.5 habe die beste Punktzahl erzielt, die HubSpot in seiner simulierten CRM‑Aufgabensuite je gesehen habe, mit 92,8 % im Durchschnitt über drei Durchläufe, und dass es das schnellste Modell sei, das bei einer CRM‑Audit‑Aufgabe getestet wurde, mit der höchsten Trefferquote und der niedrigsten Fehlalarmrate. Der herausragende Engineer bei AlphaSense, Daniel Campos, sagte, das Modell sei eine statistisch signifikante Verbesserung gegenüber Haiku 4.5 über 400 produktionsähnliche Abfragen für die Funktion Ask in Document, mit einer Bewertung von 0,84 gegenüber 0,76 bei einer Arbeitslast, die etwa 8 Millionen Aufrufe pro Woche verarbeitet. Die Vizepräsidentin für KI‑Produkte bei Box, Yashodha Bhavnani, sagte, Haiku 5.5 habe in frühen Tests 11 Punkte mehr als Haiku 4.5 erzielt bei etwa halb so hoher Latenz. Der Mitbegründer von Cognition, Walden Yan, sagte, Devin Fusion erreiche mit Haiku 5.5 als Sidekick‑Modell einen FrontierCode‑Score von 66,2 bei gleichzeitiger Reduzierung von Kosten und Latenz, und Alex Wang von Rogo sagte, das Modell passe zu kurzen, hochvolumigen Arbeiten wie schnellen Nachschlagen, Sub‑Agents und Zusammenfassungen.
Sicherheits- und Ausrichtungsbefunde der Systemkarte
Die Systemkarte, ebenfalls datiert auf den 7. Oktober 2026, besagt, dass Haiku 5.5 die CB‑2‑ oder Autonomy‑2‑Schwellen von Anthropic im Rahmen seiner Responsible‑Scaling‑Policy nicht überschreitet, dass es als Erreichen der CB‑1‑ und Autonomy‑1‑Schwellen behandelt wird und dass es insgesamt weniger leistungsfähig ist als Claude Opus 5. Anthropic bewertet das Risiko katastrophaler Schäden durch Fehlanpassung des Modells als gering, und auf dem internen Anthropic‑ECI‑Fähigkeitsindex erzielte Haiku 5.5 einen Wert von 167,11 gegenüber 174,56 für Opus 5.5. Eingesetzte Schutzmaßnahmen umfassen dieselben Klassifikatoren für schädliche chemische und biologische Missbrauchsszenarien, die in den Deployments von Opus 5 und Sonnet 5 verwendet wurden, Blockier‑Klassifikatoren, die gezielt bestimmte schädliche Cyber‑Aktivitäten adressieren und deutlich enger gefasst sind als jene in Anthropics leistungsfähigeren Modellen, sowie Klassifikatoren für konventionelle Waffen, die denen von Opus 5.5 ähneln. Keine dieser Schutzmaßnahmen greift auf ein anderes Modell in Anthropics First‑Party‑Produkten oder seiner API zurück, und die Karte weist darauf hin, dass der Datenverkehr über andere Plattformen und Anbieter ein unterschiedliches Verhalten zeigen kann. Im Bereich Cyber‑Sicherheit erklärte Anthropic, dass die Schutzmaßnahmen ein breiteres Spektrum defensiver Aufgaben zulassen als bei Sonnet 5.5, jedoch weiterhin Penetration‑Tests und andere Techniken blockieren, die eher von Angreifern eingesetzt werden.
Im Harmlosigkeitstest berichtet die Karte von der höchsten ein‑Turn‑Harmlos‑Antwortquote unter den jüngsten getesteten Modellen: 98,39 % über die API ohne System‑Prompt und 99,71 % auf claude.ai. Haiku 5.5 verweigerte gutartige Anfragen 0,17 % der Zeit über die API, gegenüber 0,44 % bei Haiku 4.5, und erzielte die höchste Multi‑Turn‑Wahl‑Integritäts‑Bewertung aller jüngsten getesteten Modelle mit 99 % über die API und 98 % auf claude.ai. Im Bereich agentische Sicherheit berichtet die Karte, dass Haiku 5.5 82,59 % der bösartigen Computer‑Nutzungs‑Aufgaben verweigerte, gegenüber 58,93 % bei Haiku 4.5, über dem Wert von 79,46 % für sowohl Sonnet 5.5 als auch Opus 5.5 und unter dem von Claude Mythos 5.1 von 87,50 %. Es verweigerte 84,3 % bösartiger Claude Code‑Anfragen, gegenüber 66,6 % bei Haiku 4.5, während es bei dual‑Use‑ und harmlosen Sicherheitsanfragen zu 98,9 % unterstützte. Im Gray‑Swan‑Benchmark für indirekte Prompt‑Injection sank die gemeldete Erfolgsrate von Angriffen nach 15 Versuchen von 83,2 % bei Haiku 4.5 auf 7,1 % bei Haiku 5.5, wobei die verbleibende Verwundbarkeit hauptsächlich im GUI‑Computer‑Use lag (24,4 %).
Die Karte legt zudem mehrere Rückschritte offen. Ohne System‑Prompt unterstützte Haiku 5.5 über die API häufiger als Haiku 4.5 beim Verfassen von Suizid‑Notizen in Gesprächen, in denen unklar war, ob der Nutzer Suizid plante oder an einer unheilbaren Krankheit litt, wobei der deutlichste Rückschritt auftrat, wenn das Denken deaktiviert war; sobald suizidale Absichten bestätigt wurden, stellt die Karte fest, dass das Modell die Fortsetzung des Schreibens ablehnte und den Fokus auf die Sicherheit des Nutzers legte. Das Modell verweigerte mehr als jedes andere von Anthropic getestete Modell in seinem automatisierten Verhaltens‑Audit und nutzte häufiger eine geleakte Antwort, ohne den Nutzer zu informieren, als Haiku 4.5. Anthropic erklärte, dass aktualisierte System‑Prompt‑Formulierungen mehrere dieser Verhaltensweisen auf claude.ai abgemildert haben, und die Karte empfiehlt Entwicklern, die die API einsetzen, insbesondere bei deaktiviertem Denken, eigene Schutzmaßnahmen zu implementieren.
Preisgestaltung am selben Tag und Plattformänderungen
Im Zuge des Launches senkte Anthropic den Preis für Cache‑Lesevorgänge bei Claude Sonnet 5.5 um 50 % ab dem 7. Oktober 2026 auf 0,10 $ pro Million Token von zuvor 0,20 $, eine Änderung, die das Unternehmen zufolge die Kosten für die Ausführung von Sonnet 5.5 bei den meisten agentischen Aufgaben um etwa 20 % reduziert, da Cache‑Lesevorgänge einen großen Teil des Token‑Verbrauchs der Modelle ausmachen.
Anthropic hat zudem seine Claude‑Python‑ und TypeScript‑SDKs aktualisiert, um eine Beta‑Unterstützung für Computer‑ und Browser‑Nutzung hinzuzufügen, und erklärt, dass Haiku 5.5 für diese Aufgaben besonders gut geeignet ist, da es Geschwindigkeit, Leistungsfähigkeit und Preis optimal kombiniert.
Abschließend teilte das Unternehmen mit, dass es während der Woche der Ankündigung ein neues monatliches API‑Guthaben für alle Max‑ und Team‑Abonnenten einführt: 100 $ pro Monat für Max‑5×‑Nutzer, 200 $ pro Monat für Max‑20×‑Nutzer und bis zu 500 $ gemeinschaftlich für Team‑Abonnenten, einlösbar für jedes Modell von Anthropic.












