Zum Hauptinhalt springen
Alle Artikel

Claude Haiku 5.5: Wofür das günstigste Modell reicht

Von Manuel HedingerKI · 7 Min. Lesezeit
Kleine, schnelle Rakete neben einem Stapel Münzen und einer Waage mit drei Modellgrössen
Inhalt

Ein Support-Postfach mit 10'000 Anfragen im Monat, die nur sortiert und einem Team zugewiesen werden sollen, braucht kein Modell für 78 US-Dollar. Mit Claude Haiku 5.5 liegen dieselben Anfragen bei rund 4 US-Dollar. Anthropic hat das Modell am 7. Oktober 2026 veröffentlicht, und der Preisunterschied zu Sonnet 5.5 beträgt den Faktor 20.

Die Frage ist nicht, ob das kleinste Modell günstiger ist, sondern ab wann die Qualität nicht mehr reicht. Dieser Beitrag rechnet ein Beispiel durch, zeigt die Benchmark-Lücke zu Sonnet 5.5 und listet auf, was beim Wechsel von Haiku 4.5 im Code zu ändern ist.

Was Claude Haiku 5.5 kostet

Für Prompts bis 100'000 Tokens berechnet Anthropic 0.10 US-Dollar pro Million Input-Tokens und 0.50 US-Dollar pro Million Output-Tokens. Gelesene Cache-Inhalte kosten 0.01 US-Dollar pro Million Tokens, die Batch-API halbiert beide Grundpreise auf 0.05 und 0.25 US-Dollar.

Zum Vergleich die Listenpreise der aktuellen Modelle laut Preisdokumentation:

ModellInput pro Mio. TokensOutput pro Mio. Tokens
Haiku 5.5 (Prompt bis 100'000 Tokens)0.10 USD0.50 USD
Haiku 4.51 USD5 USD
Sonnet 5.52 USD10 USD
Opus 5.54 USD20 USD

Haiku 5.5 ist damit zehnmal günstiger als sein Vorgänger Haiku 4.5. Eine Einschränkung steht im Kleingedruckten: Haiku 5.5 hat zwar ein Kontextfenster von 1 Million Tokens, wird aber nach Prompt-Länge abgerechnet. Ab 100'000 Tokens Prompt steigt der Tarif auf 0.50 und 2.50 US-Dollar, also das Fünffache. Wer ganze Dokumentensammlungen in jede Anfrage packt, verliert einen Teil des Preisvorteils.

Rechenbeispiel: 10'000 Anfragen pro Monat

Angenommen, ein Betrieb lässt jeden Monat 10'000 eingehende Anfragen klassifizieren und zusammenfassen. Eine Anfrage umfasst 1'500 Input-Tokens (Systemanweisung, Kategorien, Nachricht) und 300 Output-Tokens. Auf dem neuen Tokenizer sind es für denselben Text rund 30 Prozent mehr, also etwa 1'950 und 390 Tokens.

ModellKosten pro Monat
Haiku 5.5rund 3.90 USD
Haiku 4.5 (alter Tokenizer)30 USD
Sonnet 5.5rund 78 USD
Opus 5.5rund 156 USD

Das ist eine Überschlagsrechnung mit den Listenpreisen, ohne Prompt Caching und ohne Thinking-Tokens. Thinking-Tokens werden als Output abgerechnet. Bei Klassifikation lohnt sich deshalb ein tiefer Effort-Wert, damit das Modell bei einfachen Anfragen gar nicht erst nachdenkt.

In absoluten Zahlen sind das bei diesem Volumen Unterschiede von wenigen Dutzend Franken im Monat. Relevant wird der Faktor 20 erst bei grossen Mengen: 500'000 Dokumente im Monat, ein Chat mit tausenden Gesprächen oder eine Automatisierung, die pro Vorgang mehrere Modellaufrufe auslöst. Für ein kleines Team mit ein paar hundert Anfragen spielt die Modellwahl beim Preis kaum eine Rolle, dort zählt die Qualität.

Wofür Haiku 5.5 reicht

Anthropic positioniert das Modell für Aufgaben mit hohem Volumen und kurzer Antwortzeit: Klassifikation, Extraktion, Routing, Zusammenfassungen, einfache Datenabfragen und Live-Kundenservice. Als Muster dient oft die Arbeitsteilung: Ein stärkeres Modell plant, Haiku erledigt die vielen kleinen Teilschritte.

Konkret passt das etwa zu diesen Aufgaben:

  • eingehende E-Mails nach Thema und Dringlichkeit sortieren
  • Rechnungsfelder wie Betrag, Datum und IBAN aus Dokumenten lesen und in ein Buchhaltungssystem übergeben
  • lange Gesprächsverläufe zusammenfassen, bevor ein stärkeres Modell antwortet
  • Produkttexte oder Tickets mit festen Vorgaben in Kategorien einteilen

Mehr dazu, wie sich solche Schritte in Abläufe einbauen lassen, steht im Beitrag zu KI-Agenten im Kundenservice.

Kunden von Anthropic nennen Messwerte aus eigenen Tests: Box misst bei etwa halber Latenz 11 Punkte mehr als mit Haiku 4.5, Asana eine um über 30 Prozent kürzere Dauer für Aufgaben. Das sind Herstellerangaben aus der Ankündigung, keine unabhängigen Tests. Ob das Modell für den eigenen Fall reicht, zeigt nur ein Test mit echten Daten.

Wo Sonnet 5.5 und Opus 5.5 vorne bleiben

Die Benchmark-Tabelle in der Ankündigung zeigt, wo der Preisunterschied herkommt:

Test (Angaben von Anthropic)Haiku 5.5Sonnet 5.5
Terminal-Bench 4.0 (technische Mehrschritt-Aufgaben)39.2 %70.6 %
OSWorld 2.1, Offline-Teilmenge (Computerbedienung)72.4 %83.9 %
Humanity's Last Exam, ohne Werkzeuge45.9 %56.9 %
GDPval-AA v2.1 (Wissensarbeit, Elo)16201840

Haiku 5.5 liegt klar vor Haiku 4.5, das auf Terminal-Bench 4.0 noch bei 0.0 Prozent stand. Für längere Programmieraufgaben oder Agenten, die viele Schritte selbständig verketten, bleibt der Abstand zu Sonnet 5.5 aber gross. Anthropic hält selbst fest, dass Sonnet 5.5 und Opus 5.5 für komplexe Agenten-Programmierung besser geeignet sind.

Eine pragmatische Faustregel: Wenn ein Fehler in der Ausgabe einen Menschen Zeit oder einen Kunden Geld kostet, Haiku an einem Muster von 100 bis 200 echten Fällen gegen Sonnet testen. Liegt die Trefferquote nah beieinander, reicht Haiku. Fällt sie sichtbar ab, lohnt sich ein gestuftes Vorgehen: Haiku sortiert, und nur die unsicheren Fälle gehen an Sonnet. Eine Einordnung der teureren Modelle liefern die Beiträge zu Claude Sonnet 5.5 und Claude Opus 5.5.

Migration von Haiku 4.5: Diese Änderungen brechen bestehenden Code

Wer Haiku 4.5 über die API nutzt, tauscht nicht einfach die Modell-ID aus. Die Migrationsanleitung von Anthropic nennt unter anderem diese Punkte:

  1. Tokenizer: Derselbe Text ergibt etwa 30 Prozent mehr Tokens. Budgets, max_tokens und Kostenschätzungen müssen neu gerechnet werden.
  2. Thinking: Manuelles Extended Thinking mit budget_tokens liefert einen 400-Fehler. Adaptives Thinking ist standardmässig an, Antworten können deshalb mit einem Thinking-Block beginnen. Wer die erste Textstelle der Antwort als Ergebnis liest, muss nach dem Typ des Blocks auswählen.
  3. Sampling-Parameter: temperature, top_p und top_k sollten weggelassen werden. Abweichende Werte führen zu Fehlern.
  4. Prefill: Ein abschliessender Assistant-Turn, mit dem das Modell eine Antwort fortsetzt, wird abgelehnt. Für feste Ausgabeformate sind strukturierte Ausgaben der vorgesehene Ersatz.
  5. Ablehnungen: Das Modell führt Sicherheitsklassifikatoren aus und kann Anfragen mit stop_reason: "refusal" ablehnen. Der Code muss diesen Fall behandeln.
  6. Priority Tier: Wird für Haiku 5.5 nicht unterstützt. Eine bestehende Kapazitätszusage für Haiku 4.5 gilt nicht automatisch weiter.

Zur Erleichterung gibt es in Claude Code den Befehl /claude-api migrate, der die gröbsten Änderungen vorschlägt. Eine Prüfung in einer Testumgebung bleibt trotzdem nötig, bevor eine produktive Automatisierung umgestellt wird.

Datenschutz und Hosting bleiben eigene Entscheidungen

Der günstigere Preis ändert nichts daran, wohin die Daten gehen. Haiku 5.5 läuft über die Claude API und über Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry. US-only-Inferenz kostet laut Preisdokumentation 10 Prozent Aufpreis, eine Verarbeitung in der Schweiz nennt die Dokumentation nicht.

Wer Personendaten von Kundinnen und Kunden an das Modell schickt, sollte vorher klären, ob das nach revDSG zulässig ist und ob die Daten vorab pseudonymisiert werden können. Bei reiner Sortierung lassen sich Namen und Kontaktdaten oft entfernen, bevor die Anfrage das Modell erreicht. Die Grundlagen dazu stehen im Beitrag zu Claude Datenresidenz und Geo-Pinning.

Anthropic sichert den Betrieb von Haiku 5.5 auf den eigenen Plattformen mindestens bis zum 7. Oktober 2027 zu. Für eine Automatisierung, die jahrelang laufen soll, ist damit ein Wechsel nach spätestens einem Jahr einzuplanen.

So lässt sich die Modellwahl in einem Betrieb prüfen

Die Entscheidung lässt sich in vier Schritten treffen:

  1. Alle bestehenden Modellaufrufe auflisten und pro Aufruf notieren, wie viele Anfragen pro Monat anfallen.
  2. Für die drei volumenstärksten Aufrufe 100 echte Fälle sammeln und von Hand die richtige Antwort festhalten.
  3. Dieselben Fälle durch Haiku 5.5 und Sonnet 5.5 laufen lassen und die Trefferquote vergleichen.
  4. Nur dort wechseln, wo Haiku mindestens gleich gut abschneidet, und den Rest bei Sonnet lassen.

Wer die Modellwahl für eine bestehende Automatisierung prüfen oder einen Ablauf mit gestuften Modellen aufbauen möchte, findet bei der KI-Integration von Hedinger-Digital die passende Unterstützung. Für typische Abläufe wie Rechnungseingang oder Anfragen-Sortierung eignet sich auch die Prozessautomatisierung. Eine erste Einschätzung gibt es über die Kontaktseite.

Häufige Fragen

Was kostet Claude Haiku 5.5?

Für Prompts bis 100'000 Tokens kostet Claude Haiku 5.5 laut Anthropic 0.10 US-Dollar pro Million Input-Tokens und 0.50 US-Dollar pro Million Output-Tokens. Cache-Zugriffe kosten 0.01 US-Dollar pro Million Tokens. Bei Prompts über 100'000 Tokens gilt ein höherer Tarif von 0.50 beziehungsweise 2.50 US-Dollar. Die Batch-API halbiert beide Preise.

Wie viel günstiger ist Haiku 5.5 als Sonnet 5.5?

Beim Listenpreis um den Faktor 20: Sonnet 5.5 kostet 2 US-Dollar Input und 10 US-Dollar Output pro Million Tokens, Haiku 5.5 bis 100'000 Tokens Prompt-Länge 0.10 und 0.50 US-Dollar. Im Beispiel mit 10'000 Anfragen à 1'500 Input- und 300 Output-Tokens ergibt das rund 3.90 gegenüber 78 US-Dollar, ohne Thinking-Tokens gerechnet.

Wofür eignet sich Haiku 5.5 und wofür nicht?

Anthropic empfiehlt es für Aufgaben mit hohem Volumen und tiefen Latenzanforderungen: Klassifikation, Extraktion, Routing, Zusammenfassungen und einfache Datenabfragen. Für komplexe Programmieraufgaben und mehrstufige Agenten bleiben Sonnet 5.5 und Opus 5.5 besser. Auf Terminal-Bench 4.0 erreicht Haiku 5.5 laut Anthropic 39.2 Prozent, Sonnet 5.5 70.6 Prozent.

Muss bestehender Code für den Wechsel von Haiku 4.5 angepasst werden?

Ja. Laut Migrationsanleitung führen manuelles Extended Thinking mit budget_tokens, die Parameter temperature, top_p und top_k mit abweichenden Werten sowie ein abschliessender Assistant-Turn (Prefill) zu 400-Fehlern. Zudem erzeugt der neue Tokenizer für denselben Text etwa 30 Prozent mehr Tokens, und Antworten können mit einem Thinking-Block beginnen.

Gibt es für Haiku 5.5 eine Garantie für Reaktionszeiten (Priority Tier)?

Nein. Laut Migrationsanleitung wird der Priority Tier für Claude Haiku 5.5 nicht unterstützt. Wer für Haiku 4.5 eine solche Kapazitätszusage hat, muss die Kapazität für Haiku 5.5 separat planen.

Wo läuft Haiku 5.5 und wie lange ist es verfügbar?

Das Modell ist über die Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud und Microsoft Foundry verfügbar, Modell-ID claude-haiku-5-5. Anthropic sichert den Betrieb auf eigenen Plattformen mindestens bis zum 7. Oktober 2027 zu. Bedrock und Google Cloud setzen eigene Lebenszyklusdaten.

Was ist beim Datenschutz zu beachten?

Haiku 5.5 verarbeitet Daten wie alle Claude-Modelle in der Cloud. Das globale Routing ist Standard. US-only-Inferenz kostet 10 Prozent Aufpreis, eine Verarbeitung in der Schweiz nennt die Preisdokumentation nicht. Personendaten gehören deshalb nur nach einer Prüfung nach revDSG in die Anfrage.

Quellen

  1. Introducing Claude Haiku 5.5anthropic.com · Anthropic · 2026-10-07
  2. Pricing — Claude Docsplatform.claude.com · Anthropic · 2026
  3. Models overview — Claude Docsplatform.claude.com · Anthropic · 2026
  4. Claude Haiku 5.5 migration guideplatform.claude.com · Anthropic · 2026-10-07
  5. Claude Platform release notesplatform.claude.com · Anthropic · 2026-10-07

Weitere Artikel

Alle Artikel

Was lässt sich bei Ihnen vereinfachen?

Im Erstgespräch klären Sie unverbindlich, welche Aufgaben sich eignen und was ein sinnvoller erster Schritt ist.

Ihre Angaben werden nur zur Beantwortung der Anfrage verwendet. Details in der Datenschutzerklärung.