KI-Modelle

Claude Haiku 5.5: Kleines Modell, deutlich niedrigere Preise

Anthropic positioniert Haiku 5.5 für schnelle Aufgaben mit hohem Anfragevolumen. Wir ordnen Preise, Leistung, Verfügbarkeit und Grenzen der Herstellerangaben ein.

Claude Haiku 5.5

Was Anthropic am 7. Oktober veröffentlicht hat

Anthropic hat Claude Haiku 5.5 am 7. Oktober 2026 als neues kleines Modell seiner Claude-Familie vorgestellt. Der Hersteller richtet es auf kurze, wiederkehrende und kostenkritische Aufgaben aus: etwa Zusammenfassungen, Kontextkomprimierung, Datenbankabfragen, Klassifikation und schnelle Kundeninteraktionen.

Das Modell ist laut Anthropic ab sofort über die Claude Platform, Amazon Web Services, Google Cloud und Microsoft Azure verfügbar. Die Modell-ID für die API lautet claude-haiku-5-5. Damit handelt es sich nicht nur um eine Ankündigung, sondern um einen gestarteten, plattformübergreifenden Release.

Haiku 5.5 ist zugleich das erste Haiku-Modell mit einstellbarem Rechenaufwand. Entwickler können damit stärker zwischen Kosten, Geschwindigkeit und zusätzlicher Verarbeitung abwägen. Wie gut diese Abstufungen für eine konkrete Aufgabe funktionieren, muss jedoch im eigenen Test ermittelt werden.

Bestätigt sind Release, Modell-ID, Preise und Plattformverfügbarkeit. Aussagen zu Geschwindigkeit, Qualität und Kostenvorteilen beruhen auf Anthropic-Tests und frühen Kundenberichten.

Die Preise hängen von der Promptlänge ab

Für Prompts bis einschließlich 100.000 Tokens berechnet Anthropic 0,10 US-Dollar pro Million Input-Tokens und 0,50 US-Dollar pro Million Output-Tokens. Cache-Lesezugriffe kosten 0,01 US-Dollar, Cache-Schreibzugriffe 0,125 US-Dollar pro Million Tokens.

Für Prompts oberhalb von 100.000 Tokens steigt der Preis auf 0,50 US-Dollar für Input und 2,50 US-Dollar für Output. Cache Reads liegen dann bei 0,05 US-Dollar und Cache Writes bei 0,625 US-Dollar. Die günstige Positionierung gilt daher besonders für kurze und mittlere Kontexte, nicht pauschal für jede Anfrage.

Anthropic spricht von durchschnittlich rund 75 Prozent niedrigeren Laufkosten gegenüber Haiku 4.5. Laut Fußnote ist Haiku 5.5 bei Anfragen bis 100.000 Tokens um 90 Prozent und darüber um 50 Prozent günstiger. Die Durchschnittsangabe berücksichtigt außerdem eine veränderte Tokenisierung und die bisherige Nutzungsverteilung.

  • Bis 100.000 Tokens: 0,10 US-Dollar Input und 0,50 US-Dollar Output
  • Über 100.000 Tokens: 0,50 US-Dollar Input und 2,50 US-Dollar Output
  • Cache Reads: 0,01 beziehungsweise 0,05 US-Dollar
  • Cache Writes: 0,125 beziehungsweise 0,625 US-Dollar
  • Alle Angaben gelten pro Million Tokens

Was die Benchmarks zeigen und was nicht

Anthropic veröffentlicht deutliche Sprünge gegenüber Haiku 4.5. Auf dem Offline-Teil von OSWorld 2.1 für Computersteuerung nennt das Unternehmen 72,4 statt 15,7 Prozent. Bei Terminal-Bench 4.0 für agentisches Coding erreicht Haiku 5.5 laut Hersteller 39,2 Prozent, während für Haiku 4.5 null Prozent ausgewiesen werden.

Auch in Wissensarbeit, visuellem Reasoning und akademischen Fragen meldet Anthropic höhere Werte. Diese Ergebnisse helfen bei der Einordnung der Modellpositionierung, sind aber keine unabhängigen Praxistests. Benchmarkaufbau, Werkzeuge, Rechenaufwand und Vergleichskonfiguration beeinflussen das Ergebnis.

Anthropic grenzt das Modell selbst von größeren Varianten ab: Sonnet 5.5 und Opus 5.5 bleiben für komplexe, lange Coding-Aufgaben die stärkeren Optionen. Haiku 5.5 soll vor allem klar abgegrenzte Teilaufgaben übernehmen, bei denen niedrige Latenz und geringe Stückkosten wichtiger sind als maximale Problemlöseleistung.

Herstellerbenchmarks belegen keine allgemeine Überlegenheit. Für eine Beschaffungsentscheidung zählen eigene Aufgaben, dieselben Werkzeuge, identische Qualitätskriterien und die tatsächlich verbrauchten Tokens.

Warum Haiku 5.5 für Subagenten interessant ist

Anthropic empfiehlt Haiku 5.5 als günstigen Subagenten neben Sonnet 5.5 oder Opus 5.5. Ein größeres Modell kann dabei Planung und schwierige Entscheidungen übernehmen, während Haiku klar umrissene Recherche-, Extraktions- oder Klassifikationsschritte bearbeitet.

Zusätzlich erhalten die Python- und TypeScript-SDKs Unterstützung für Browser Use und Computer Use in einer Beta-Version. Die offizielle Dokumentation macht eine wichtige Grenze deutlich: Anthropic liefert Klassen und Ablaufsteuerung, aber keinen fertigen Browser, Desktop-Treiber oder automatisch sicheren URL-Filter. Diese Infrastruktur und ihre Richtlinien müssen Entwickler selbst bereitstellen.

Browser- und Computeragenten brauchen deshalb isolierte Laufzeiten, restriktive Netzwerkregeln, kontrollierte Dateiwege und Bestätigungen vor folgenreichen Aktionen. Der niedrige Modellpreis reduziert Rechenkosten, nicht die Verantwortung für eine sichere Ausführungsumgebung.

Welche Sicherheitsgrenzen Anthropic nennt

Anthropic berichtet gegenüber Haiku 4.5 von Verbesserungen in eigenen Alignment-Evaluationen und einer geringeren Bereitschaft, Missbrauch zu unterstützen. Die Cybersecurity-Schutzmechanismen seien strenger als beim Vorgänger, aber weniger restriktiv als bei einigen größeren aktuellen Claude-Modellen.

Nach Herstellerangaben sind mehr defensive Cyberaufgaben möglich, während Penetrationstests und eher offensiv nutzbare Techniken weiterhin blockiert werden. Für Biologie gelten dieselben Schutzmechanismen wie bei Sonnet 5, Sonnet 5.5 und Opus 5.

Diese Angaben stammen aus Anthropics eigener System Card und ersetzen keine Risikoprüfung des Einsatzes. Besonders bei Tool-Zugriff, personenbezogenen Daten oder automatisierten Entscheidungen sollten Berechtigungen begrenzt, Aktionen protokolliert und Ergebnisse fachlich geprüft werden.

So lässt sich das Modell sinnvoll testen

Ein guter Vergleich beginnt mit häufigen, klar bewertbaren Aufgaben. Geeignet sind zum Beispiel die Zuordnung von Supportanfragen, strukturierte Extraktion aus kurzen Dokumenten oder Zusammenfassungen mit einer festen Liste notwendiger Fakten. Dieselben Fälle sollten gegen das bisherige Modell und eine stärkere Claude-Variante laufen.

Neben der Antwortqualität gehören Latenz, Fehlerrate, Input- und Output-Tokens, Cache-Nutzung sowie notwendige Wiederholungen in die Messung. Ein niedriger Tokenpreis hilft wenig, wenn ein Modell häufiger korrigiert werden muss oder unnötig lange Ausgaben erzeugt.

Für Agentensysteme sollte zusätzlich geprüft werden, ob die Aufgabenteilung stabil bleibt: Welche Schritte darf Haiku selbst abschließen, wann muss ein stärkeres Modell übernehmen und vor welchen Aktionen ist eine menschliche Freigabe nötig?

  • Reale, wiederkehrende Aufgaben mit eindeutigen Abnahmekriterien wählen
  • Qualität, Latenz und Gesamtkosten gemeinsam messen
  • Prompts unter und über 100.000 Tokens getrennt betrachten
  • Tool-Aufrufe und Fehlerfolgen protokollieren
  • Eskalation zu einem stärkeren Modell vorab definieren

Die MindrAils-Einordnung

Claude Haiku 5.5 ist vor allem ein Wirtschaftlichkeits-Release. Die Kombination aus niedrigen Preisen, einstellbarem Rechenaufwand und breiter Cloud-Verfügbarkeit macht leistungsfähige kleine Modelle für sehr hohe Anfragezahlen und mehrstufige Agentenarchitekturen interessanter.

Der entscheidende Punkt ist nicht, dass ein kleines Modell jedes große Modell ersetzt. Interessant ist die feinere Arbeitsteilung: Ein starkes Modell plant, Haiku bearbeitet eng begrenzte Schritte in großer Zahl. Dadurch können Kosten sinken, ohne jede Aufgabe auf die kleinste Variante zu zwingen.

Ob diese Rechnung aufgeht, entscheidet nicht die Benchmarktabelle allein. Unternehmen sollten mit ihren Daten, Qualitätsgrenzen und Sicherheitsanforderungen testen. Besonders die Preisstufe oberhalb von 100.000 Prompt-Tokens und der Aufwand für sichere Browser- oder Computersteuerung gehören in eine vollständige Kalkulation.

Transparent belegt

Quellen und weiterführende Informationen

Die Quellen wurden zu den jeweils angegebenen Zeitpunkten abgerufen. Externe Inhalte können sich danach ändern.

  1. Claude Haiku 5.5Anthropic · abgerufen am
    Quelle öffnen
  2. Browser and computer use with the SDK toolsetsClaude Platform Docs · abgerufen am
    Quelle öffnen
Redaktioneller Hinweis

Dieser Beitrag wurde von der MindrAils Redaktion quellenbasiert eingeordnet. Er dient der allgemeinen Information und ersetzt keine Rechts-, Datenschutz- oder Fachberatung für einen konkreten Einzelfall.

Zurück zu allen Insights
Vom Wissen zur Anwendung

Wo kann KI in Ihrem Unternehmen konkret entlasten?

In der kostenlosen Business-Analyse betrachten wir Ihre Abläufe, Engpässe und realistischen Automatisierungspotenziale.