8. Oktober 2026

Claude Haiku 5.5: Mehr KI-Leistung bei deutlich niedrigeren API-Preisen

Kurz gesagt: Anthropic verbessert mit Claude Haiku 5.5 die Leistung und Agentenfähigkeiten seiner kompakten KI-Modellreihe. Die API-Preise sinken um bis zu 90 Prozent, während das Kontextfenster auf eine Million Tokens wächst. Ein hoher Tokenverbrauch relativiert allerdings die tatsächliche Kostenersparnis.

Wie viel Leistung lässt sich mit einem preisgünstigen KI-Modell erreichen? Anthropic positioniert Claude Haiku 5.5 für zeitkritische Routineaufgaben wie Zusammenfassungen, Datenbankabfragen und Kundensupport. Auch als Subagent soll es größere Claude-Modelle bei Programmieraufgaben unterstützen. Bei Standardgeschwindigkeit ist es laut Hersteller das bislang schnellste Modell des Unternehmens.

Mehr Kontext und eigenständige Denkschritte

Haiku 5.5 verarbeitet Texte und Bilder, erzeugt jedoch ausschließlich Textausgaben. Das Kontextfenster wächst gegenüber Haiku 4.5 von 200.000 auf eine Million Tokens. Gleichzeitig verdoppelt sich die maximale Ausgabelänge auf 128.000 Tokens. Der Wissensstand reicht bis Juni 2026.

Neu ist die automatische Steuerung zusätzlicher Denkschritte. Das Modell entscheidet selbst über deren Notwendigkeit und Umfang. Entwickler können den Denkaufwand über mehrere Stufen anpassen, wobei die API standardmäßig eine mittlere Stufe verwendet.

Erstmals unterstützt Haiku außerdem ein Werkzeug zur Browserbedienung. Dieses ist derzeit über Anthropics API und Google Cloud verfügbar. Erweiterte Python- und TypeScript-SDKs ergänzen die Browser- und Computersteuerung. Das Modell steht über die Claude-Plattform sowie AWS, Google Cloud und Microsoft Azure bereit.

Deutliche Fortschritte bei Benchmarks und KI-Agenten

Im Intelligence Index von Artificial Analysis erzielt Haiku 5.5 bei maximalem Denkaufwand 43 Punkte und damit 26 mehr als sein Vorgänger. Es liegt knapp vor Gemini 3.8 Flash und GPT-6 Luna, bleibt jedoch hinter Claude Sonnet 5.5 mit 56 Punkten zurück.

Auch bei agentischen Aufgaben zeigen sich Fortschritte. Im AA-Briefcase-Test erreicht Haiku 5.5 ein mit GPT-6 Astra vergleichbares Ergebnis. Auf Terminal-Bench 4.0 löst es 33 Prozent der Aufgaben, während Haiku 4.5 keine erfolgreich abschloss.

Bei der Computerbedienung steigt der durchschnittliche Anteil erfüllter Teilziele auf einer Offline-Teilmenge von OSWorld 2.1 laut Anthropic von 15,7 auf 72,4 Prozent. Bei Faktenfragen bleibt Haiku 5.5 hinter mehreren Konkurrenten zurück, halluziniert laut Artificial Analysis allerdings seltener.

Niedrige Tokenpreise bedeuten nicht automatisch geringe Gesamtkosten

Für Prompts bis 100.000 Tokens berechnet Anthropic 0,10 US-Dollar pro Million Eingabetokens und 0,50 US-Dollar pro Million Ausgabetokens. Beide Preise liegen 90 Prozent unter denen von Haiku 4.5. Bei längeren Prompts steigen sie auf 0,50 beziehungsweise 2,50 US-Dollar, bleiben aber 50 Prozent günstiger als beim Vorgänger.

Entscheidend für die tatsächlichen Betriebskosten ist jedoch der Tokenverbrauch. Bei maximalem Denkaufwand benötigt Haiku 5.5 laut Artificial Analysis rund 162.000 Ausgabetokens pro Aufgabe, etwa dreimal so viele wie GPT-6 Luna. Der Wechsel von der zweithöchsten zur höchsten Denkstufe erhöht den Verbrauch um rund 80 Prozent, bringt aber lediglich zwei zusätzliche Indexpunkte.

Hinzu kommt ein neuer Tokenizer, der identische Eingabetexte in etwa 30 Prozent mehr Tokens zerlegt. Dadurch verringert sich die praktische Kostenersparnis. Die vorläufigen Kostenvergleiche von Artificial Analysis berücksichtigen zudem noch nicht die höheren Preise für lange Prompts.

Anthropic reduziert außerdem bei Sonnet 5.5 den Cache-Lesepreis um die Hälfte. Agentische Aufgaben sollen dadurch rund 20 Prozent günstiger werden. Ergänzend erhalten berechtigte Max- und Team-Abonnenten monatliche API-Guthaben: 100 US-Dollar bei Max 5x, 200 US-Dollar bei Max 20x und abhängig von den gebuchten Plätzen bis zu 500 US-Dollar bei Team-Abonnements. Diese gelten für Anwendungen auf der Claude-Plattform, nicht für die reguläre interaktive Nutzung von Claude Code.

Für die Auswahl geeigneter KI-Modelle zählen damit neben den API-Preisen auch Denkaufwand, Tokenverbrauch und tatsächliche Aufgabenleistung. Der Newsletter Beratung-KI informiert regelmäßig über solche Entwicklungen und ihre praktische Bedeutung für den KI-Einsatz.

Effizienz durch Innovation: Teile der textlichen und visuellen Ausgestaltung dieser Seite wurden durch generative KI-Systeme unterstützt.


Wir führen seit Jahren Beratung zu KI (Künstlicher Intelligenz) für KMUs (Klein- und Mittelständische Unternehmen) erfolgreich durch.

Mehr zu aktuellen Themen der #KI (Künstlichen Intelligenz) oder zu

Ihrem individuellen, optimalen "KI-Masterplan" für Ihr Unternehmen finden Sie in unserem Newsletter.

Abonnieren Sie den Newsletter hier:


Tags


Das könnte Sie auch interessieren

Abonnieren Sie jetzt unseren Newsletter!

>