Claude Sonnet 5: Preiserhöhung abgesagt – der Tokenizer bleibt
Anthropic hat die angekündigte Preiserhöhung per 1. September 2026 gestrichen. Was das für Schweizer KMU heisst – und warum der Tokenizer trotzdem zählt.
Update vom 11. August 2026: Dieser Beitrag erschien ursprünglich am 6. August 2026 und warnte vor einer für den 1. September 2026 angekündigten Preiserhöhung bei Claude Sonnet 5. Am 10. August 2026 hat Anthropic diese Erhöhung gestrichen: Die bisherigen Einführungspreise von 2 respektive 10 US-Dollar pro Million Tokens sind neu der Standardpreis. Der Beitrag wurde entsprechend korrigiert. Der zweite beschriebene Kosteneffekt – der neue Tokenizer – besteht unverändert weiter und ist der Grund, weshalb dieser Text weiterhin relevant ist.
Ein KMU, das im Juni 2026 auf Claude Sonnet 5 umgestiegen ist, hat sein Budget wahrscheinlich anhand der damals gültigen Einführungspreise kalkuliert: 2 US-Dollar pro Million Input-Tokens, 10 US-Dollar pro Million Output-Tokens. Diese Preise sollten am 1. September 2026 auf 3 respektive 15 US-Dollar steigen – ein Sprung von 50 Prozent. Am 10. August 2026 hat Anthropic diese Erhöhung abgesagt und die Einführungspreise zum Standardpreis erklärt.
Das ist eine gute Nachricht. Sie beantwortet die Kostenfrage aber nur zur Hälfte. Denn Claude Sonnet 5 verbraucht für denselben Text seit der Einführung rund 30 Prozent mehr Tokens als sein Vorgänger Sonnet 4.6 – wegen eines neuen Tokenizers, der im Hintergrund arbeitet und an der sichtbaren Preisliste nichts ändert.
Für Schweizer KMU, die Claude über die API, in Agenten-Workflows oder über Claude Code produktiv einsetzen, heisst das: Die dringende Frist ist weg, die eigentliche Rechenaufgabe bleibt. Und sie fällt anders aus, als die blosse Preisliste vermuten lässt.
Der Preisaufschlag ist abgesagt – der Tokenizer bleibt
Zwei Entwicklungen liefen bisher parallel. Eine davon ist erledigt, die andere nicht.
Erledigt: Die Einführungspreisphase endet nicht. Anthropic hat Claude Sonnet 5 am 30. Juni 2026 mit einem vergünstigten Einstiegspreis lanciert: 2 US-Dollar pro Million Input-Tokens, 10 US-Dollar pro Million Output-Tokens. Diese Phase sollte am 31. August 2026 enden. In der offiziellen Preisdokumentation hält Anthropic seit dem 10. August fest, dass diese Preise neu der Standardpreis sind und die geplante Erhöhung auf 3 respektive 15 US-Dollar nicht stattfindet. Dasselbe gilt für die Batch-API: Sie bleibt bei 1 respektive 5 US-Dollar pro Million Tokens, statt auf 1.50 und 7.50 zu steigen. Auch die Preise für Prompt Caching bleiben auf dem tieferen Niveau.
Nicht erledigt: Ein neuer Tokenizer verbraucht mehr Tokens für denselben Inhalt. Claude Sonnet 5 zerlegt Text anders in Tokens als Sonnet 4.6. Laut Anthropics eigener Dokumentation produziert derselbe Eingabetext dabei rund 30 Prozent mehr Tokens; der genaue Wert hängt von Inhalt und Anwendungsfall ab. Das ist keine Preisänderung im eigentlichen Sinn – der Preis pro Token bleibt bei diesem Effekt unverändert –, aber es bedeutet, dass eine identische Anfrage unter Sonnet 5 mehr Tokens kostet als unter Sonnet 4.6.
Interessant wird es, wenn beide Zahlen zusammenkommen. Sonnet 5 kostet pro Token rund einen Drittel weniger als Sonnet 4.6 (2 statt 3 US-Dollar beim Input, 10 statt 15 beim Output). Gleichzeitig fallen für denselben Text rund 30 Prozent mehr Tokens an. Rechnerisch bleiben davon etwa 13 Prozent tiefere Kosten für identischen Inhalt übrig – nicht die 33 Prozent, die ein Blick auf die Preisliste allein suggeriert.
Wer also mit dem Argument «ein Drittel günstiger» in die Budgetplanung geht, plant zu optimistisch. Wer den Tokenizer-Effekt mitrechnet, landet bei einer moderaten Ersparnis – die je nach Textsorte und Workload auch anders ausfallen kann.
Warum das für KMU keine Kleinigkeit ist
Laut der KMU-Arbeitsmarktstudie 2025 von Sotomo im Auftrag der AXA stieg der Anteil Schweizer KMU, die KI bewusst in ihre Arbeitsprozesse integrieren, von 22 Prozent im Jahr 2024 auf 34 Prozent im Jahr 2025. Eine auf kmu.admin.ch veröffentlichte Erhebung des SECO bestätigt dieselbe Entwicklung. Ein wachsender Teil dieser Betriebe nutzt Claude nicht mehr nur über die Chat-Oberfläche, sondern über die API, in Automatisierungen oder über Claude Code – also genau dort, wo Tokenkosten direkt auf der Rechnung erscheinen.
Für ein KMU mit einer fixen Software-Lizenz ist eine Preisänderung meist eine einzelne, klar sichtbare Zahl. Bei tokenbasierter Abrechnung überlagern sich Preisliste und technische Effizienzveränderung – und Letztere ist ohne aktive Messung unsichtbar. Genau deshalb ist die Absage der Erhöhung zwar eine Entlastung, aber kein Grund, die eigene Kostenbasis ungeprüft zu lassen.
Die Kostenkontrolle allein reicht hier nicht
Anthropic hat im Juli 2026 Budget-Warnschwellen, ein Analytics-Dashboard und Modell-Berechtigungen für Claude Team und Enterprise eingeführt – nützliche Werkzeuge, um Ausgaben generell im Griff zu behalten. Sie lösen das hier beschriebene Problem aber nur teilweise: Ein Spend Cap, der anhand von Sonnet-4.6-Tokenzahlen kalibriert wurde, passt nicht zum tatsächlichen Verbrauch unter Sonnet 5 – unabhängig davon, welcher Preis pro Token gilt. Wer solche Grenzwerte eingerichtet hat, sollte sie auf Basis gemessener Werte nachjustieren, statt sich auf die ursprüngliche Kalibrierung zu verlassen.
Checkliste: Was jetzt zu prüfen ist
Drei Punkte lassen sich innerhalb weniger Stunden durchgehen:
1. Tokenzahl typischer Anfragen neu messen. Alte Zählwerte aus der Zeit von Sonnet 4.6 gelten nicht mehr. Wer regelmässig wiederkehrende Prompts oder Dokumente verarbeitet, sollte deren Tokenverbrauch mit dem aktuellen Tokenizer neu erfassen, statt mit veralteten Schätzungen weiterzuplanen. Das ist der einzige Weg, den tatsächlichen Effekt für die eigenen Texte zu kennen – der Richtwert von 30 Prozent ist ein Durchschnitt, kein Versprechen.
2. max_tokens-Limiten überprüfen. Ausgabelimiten, die für den alten Tokenizer dimensioniert wurden, können Antworten von Sonnet 5 vorzeitig abschneiden, weil derselbe Inhalt nun mehr Tokens beansprucht. Das betrifft vor allem lange Zusammenfassungen, generierten Code oder mehrteilige Dokumente.
3. Modellwahl pro Aufgabe prüfen. Nicht jede Aufgabe benötigt Sonnet 5. Für strukturierte Routinearbeiten – einfache Kundenanfragen, Standardtexte, Datenklassifizierung – liefert das deutlich günstigere Claude Haiku 4.5 häufig ausreichende Qualität. Komplexere Agenten-Workflows und anspruchsvolle Recherche profitieren dagegen stärker von Sonnet- oder Opus-Modellen. Eine aufgabenbasierte statt pauschale Modellwahl senkt die Kosten spürbar, ohne dass an der eigentlichen Funktionalität etwas verloren geht.
Ein vierter Punkt stand ursprünglich in dieser Liste: Budget-Warnschwellen an die Septembererhöhung anpassen. Er ist mit der Absage hinfällig – die Neukalibrierung anhand gemessener Tokenzahlen (Punkt 1) bleibt aber sinnvoll.
Diese Schritte ersetzen keine umfassende KI-Kostenstrategie. Sie sorgen aber dafür, dass die Budgetplanung auf gemessenen Zahlen beruht statt auf einer Preisliste, die nur die halbe Geschichte erzählt.
Wer Claude-Workflows produktiv einsetzt und Klarheit über die tatsächliche Kostenwirkung haben möchte, findet bei der KI-Integration von Hedinger-Digital Unterstützung beim Audit bestehender Automatisierungen und bei der passenden Modellwahl pro Anwendungsfall. Für eine Einschätzung der eigenen Situation lohnt sich die Kontaktaufnahme.


