Zum Hauptinhalt springen
Alle Artikel

Claude Opus 5.5: Günstiger – lohnt sich der Wechsel?

Von Manuel HedingerKI · 7 Min. Lesezeit
Vergleich zweier Preistabellen und Codezeilen auf einem Bildschirm, symbolisch für den Modellwechsel zu Claude Opus 5.5
Inhalt

Sechs Monate nach Claude Opus 5 steht mit Opus 5.5 bereits das nächste Modell bereit. Wer gerade erst eine Automatisierung, einen Kundenservice-Agenten oder eine interne Recherchehilfe auf Opus 5 aufgebaut hat, stellt sich damit zwangsläufig dieselbe Frage wie bei jedem Anthropic-Release der letzten Monate: reicht die Zeit für einen Wechsel, oder handelt es sich nur um eine weitere Versionsnummer ohne spürbaren Unterschied im eigenen Betrieb?

Bei Opus 5.5 lohnt sich die Prüfung. Anthropic senkt den Grundpreis um 20 Prozent, den Preis für Cache-Zugriffe um 60 Prozent und meldet auf mehreren Benchmarks deutlich höhere Werte als beim Vorgänger. Gleichzeitig ändert sich der standardmässige Rechenaufwand pro Anfrage, und wer eine eigene Anbindung an die Claude API betreibt, muss vier konkrete technische Details im eigenen Code kontrollieren, bevor die Umstellung greift.

Dieser Beitrag trennt, was für welche Nutzergruppe tatsächlich relevant ist – und wo der Wechsel keine Eile hat.

Was Opus 5.5 vom Vorgänger unterscheidet

Anthropic positioniert Opus 5.5 für dieselbe Zielgruppe wie zuvor Opus 5: lang laufende Agenten-Programmierung und anspruchsvolle Wissensarbeit. Auf Terminal-Bench 4.0, einem Test für mehrstufige technische Aufgaben, erreicht Opus 5.5 laut Anthropic 66,4 Prozent gegenüber 52,3 Prozent bei Opus 5. Bei einem internen Testszenario zur Optimierung einer Web-Applikation gelang die Aufgabe mit Opus 5.5 in 39 von 40 Durchläufen.

Konkreter wird der Unterschied in einem Zitat, das Anthropic von GitHub übernimmt: Opus 5.5 löse mehr Terminal-Aufgaben als Opus 5, und das in weniger als der Hälfte der Arbeitsschritte. Das deckt sich mit der zweiten zentralen Änderung – der Geschwindigkeit. Anthropic gibt eine rund 30 Prozent schnellere Ausgabegenerierung an, was sich bei längeren Agenten-Läufen unmittelbar auf die Wartezeit auswirkt.

Ein dritter, weniger auffälliger Punkt betrifft die Antwortqualität selbst: Anthropic beschreibt Opus 5.5 als klarer strukturiert und weniger auf Fachjargon angewiesen als frühere Modelle. Für Betriebe, die Claude-Antworten direkt an Kundinnen und Kunden weiterreichen, etwa in einem Support-Chat, wirkt sich das stärker aus als jede Benchmark-Zahl.

Die neuen Preise: 4 statt 5 US-Dollar pro Million Tokens

Der Grundpreis sinkt von 5 auf 4 US-Dollar pro Million Input-Tokens und von 25 auf 20 US-Dollar pro Million Output-Tokens. Das allein entspricht einer Reduktion um 20 Prozent gegenüber Opus 5.

Deutlicher fällt der Effekt bei Prompt Caching aus. Wiederholt gelesene Cache-Inhalte kosten bei Opus 5.5 nur noch 5 Prozent des Grundpreises statt der bei den meisten Modellen üblichen 10 Prozent – konkret 0.20 statt 0.50 US-Dollar pro Million Tokens, ein Rückgang um 60 Prozent. Für Agenten-Workflows, die wiederholt auf denselben Systemprompt, dieselbe Dokumentensammlung oder denselben Codebestand zugreifen, addiert sich dieser Effekt zum niedrigeren Grundpreis.

Anthropic rechnet unter dem Strich mit rund 40 Prozent tieferen Gesamtkosten bei typischen Workloads. Dieser Wert stammt nicht allein aus der Preisliste, sondern setzt sich aus drei Faktoren zusammen: dem tieferen Grundpreis, den günstigeren Cache-Reads und einem niedrigeren Token-Verbrauch durch den geänderten Default-Effort – dazu im nächsten Abschnitt mehr. Wer die eigene Ersparnis genauer beziffern will, kommt an einer Messung der eigenen Cache-Trefferquote nicht vorbei; pauschale 40 Prozent gelten nicht für jede Anwendung gleichermassen.

Fast Mode, die beschleunigte Antwortvariante für die Claude API, kostet bei Opus 5.5 8 respektive 40 US-Dollar pro Million Tokens – ebenfalls günstiger als die 10 respektive 50 US-Dollar bei Opus 5, aber weiterhin nur über die Claude API direkt verfügbar, nicht über Amazon Bedrock oder Google Cloud.

Warum der Standard-Effort jetzt tiefer liegt

Eine Änderung geht in den Preiszahlen leicht unter, wirkt sich aber unmittelbar auf jede Anfrage aus, die ohne expliziten Parameter läuft: Der Standard-Effort sinkt von 'high' bei Opus 5 auf 'medium' bei Opus 5.5. Anthropic reduziert damit von sich aus den Rechenaufwand, den das Modell ohne weitere Angabe in eine Aufgabe investiert – ein Teil der eingangs erwähnten 40 Prozent Kostenersparnis entsteht genau hier.

Für die Mehrheit der Routineaufgaben – Klassifizieren von Anfragen, erste Entwürfe, einfache Datenabfragen – reicht der neue Standard aus, ohne dass jemand aktiv eingreifen muss. Anders sieht es bei Aufgaben aus, deren Ergebnis direkt kundenseitig sichtbar wird oder die mehrere Arbeitsschritte selbständig verketten, etwa eine komplexe Vertragsprüfung oder ein länger laufender Agenten-Auftrag. Wer solche Anwendungen bisher unter dem alten Standard 'high' betrieben hat, erhält nach einer Umstellung ohne Anpassung automatisch weniger Rechenaufwand pro Anfrage – nicht, weil das Modell schwächer wäre, sondern weil der Ausgangspunkt ein anderer ist. Eine ausführliche Einordnung der Effort-Stufen selbst und wann sich welche Stufe lohnt, liefert der frühere Beitrag zum Effort-Regler.

Breaking Changes: Was bei einer bestehenden API-Integration zu prüfen ist

Wer Opus 5 über die Claude API, Amazon Bedrock oder eine andere Cloud-Plattform direkt anspricht, sollte vor der Umstellung vier technische Details im eigenen Code kontrollieren.

Erstens lässt sich das Nachdenken des Modells bei Opus 5.5 nicht mehr deaktivieren – es läuft grundsätzlich mit. Wer bisher bewusst ohne Thinking gearbeitet hat, etwa um Antwortzeiten kurz zu halten, muss diese Erwartung anpassen.

Zweitens liefert eine erzwungene Werkzeugnutzung über die Parameter 'any' oder 'tool' bei Opus 5.5 einen Fehler statt einer Antwort. Betroffen sind Integrationen, die das Modell fest auf ein bestimmtes Werkzeug festlegen, statt ihm die Wahl über 'auto' zu überlassen.

Drittens sind Thinking-Blöcke – also die internen Zwischenschritte des Modells – fest an das erzeugende Modell und die jeweilige Konversation gebunden. Bei mehrstufigen Agenten-Abläufen, die solche Zwischenergebnisse zwischenspeichern und in einer späteren Anfrage wiederverwenden, kann das zu Fehlern führen, wenn die Umstellung ungetestet erfolgt.

Viertens akzeptieren die Claude API und Google Cloud das ältere Computer-Use-Werkzeug 'computer_20251124' bei Opus 5.5 nicht mehr. Wer eine Browser- oder Desktop-Automatisierung über dieses Werkzeug betreibt, muss vor dem Wechsel auf die aktuelle Toolset-Version migrieren.

Keiner dieser vier Punkte ist auf den ersten Blick offensichtlich, wenn lediglich die Modell-ID in einer Konfigurationsdatei ausgetauscht wird. Ein Testlauf in einer Staging-Umgebung, bevor eine produktive Automatisierung umgestellt wird, bleibt deshalb Pflicht – unabhängig davon, wie klein die Änderung auf dem Papier wirkt.

Wer den Wechsel jetzt prüfen sollte – und wer abwarten kann

Für reine claude.ai-Nutzerinnen und -Nutzer mit einem Pro-, Max-, Team- oder Enterprise-Abo ändert sich technisch nichts: Der Wechsel läuft im Hintergrund, ohne dass eine Konfiguration angepasst werden muss. Höchstens die Antwortqualität fällt auf – klarer strukturiert, laut Anthropic weniger auf Fachjargon angewiesen.

Relevant wird die Frage für Betriebe mit einer eigenen Anbindung an die Claude API, an Amazon Bedrock, Google Cloud oder Microsoft Foundry – sei es über ein selbst entwickeltes Skript, ein n8n- oder Make-Szenario oder eine massgeschneiderte Software-Lösung. Hier lohnt sich der Wechsel besonders dort, wo Kosten pro Anfrage bereits ein Thema sind oder wo die bisherige Automatisierung an eine Qualitätsgrenze von Opus 5 stösst.

Ebenso ehrlich gehört dazu: Wer mit Opus 5 zufrieden ist und keine unmittelbaren Kosten- oder Qualitätsprobleme hat, muss nicht wechseln, nur weil ein neues Modell verfügbar ist. Anthropic garantiert für Opus 5 laut eigener Lebenszyklus-Dokumentation weiterhin Betrieb, bis ein Ablösetermin angekündigt wird – ein sofortiger Wechseldruck besteht nicht. Und für sehr zeitkritische Anwendungen, etwa einen live geschalteten Chat mit Millisekunden-Anspruch, bleibt das durchgehend aktive Thinking von Opus 5.5 ein Kompromiss: schnellere Ausgabe pro Token bei gleichzeitig grundsätzlich aktivem Denkschritt, den Modelle wie Claude Sonnet 5 in dieser Form nicht erzwingen.

Was die Governance-Lücke bei Schweizer KMU mit dieser Entscheidung zu tun hat

Ein Modellwechsel wird selten von einer einzelnen Person getroffen, sondern betrifft ein ganzes Team – und genau hier zeigt sich eine Lücke, die grösser ist als jede Preisdifferenz zwischen zwei Modellversionen. Laut einer auf kmu.admin.ch veröffentlichten Erhebung des SECO stieg der Anteil der KMU in der Schweiz, die KI zur Optimierung von Arbeitsschritten einsetzen, von 22 Prozent im Jahr 2024 auf 34 Prozent im Jahr 2025. Gleichzeitig haben laut derselben Erhebung nur 34 Prozent der Unternehmen klare interne Regeln festgelegt, welche Daten Mitarbeitende in KI-Tools eingeben dürfen.

Diese Lücke wirkt sich auch auf Entscheidungen wie einen Modellwechsel aus. Ohne festgelegte Zuständigkeit prüft oft niemand systematisch, ob eine neue Preisliste oder ein neuer Effort-Standard tatsächlich zur eigenen Nutzung passt – die Umstellung erfolgt entweder gar nicht, obwohl sie sich lohnen würde, oder unüberlegt, ohne die vier oben beschriebenen technischen Punkte zu prüfen. Eine klare interne Zuständigkeit für KI-Tools, einschliesslich der Frage, wer Modellwechsel prüft und freigibt, verhindert beide Fehler gleichzeitig.

Wer eine bestehende Automatisierung auf Claude Opus 5.5 prüfen möchte – von der technischen Migration bis zur Frage, welcher Effort-Level für welchen Anwendungsfall angemessen ist – findet bei der KI-Integration von Hedinger-Digital Unterstützung. Für eine erste Einschätzung der eigenen Situation lohnt sich die Kontaktaufnahme.

Häufige Fragen

Was ist neu an Claude Opus 5.5?

Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht. Das Modell kostet laut Anthropic rund 40 Prozent weniger im typischen Betrieb als der Vorgänger Opus 5, generiert Ausgaben etwa 30 Prozent schneller und erzielt auf Anthropics eigenen Benchmarks wie Terminal-Bench 4.0 deutlich höhere Werte (66,4 statt 52,3 Prozent). Gleichzeitig senkt Anthropic den standardmässigen Effort-Level von 'high' auf 'medium' und ändert vier technische Details, die bestehende API-Integrationen betreffen können.

Wie viel günstiger ist Claude Opus 5.5 wirklich?

Der Grundpreis sinkt von 5 auf 4 US-Dollar pro Million Input-Tokens und von 25 auf 20 US-Dollar pro Million Output-Tokens. Cache-Zugriffe kosten neu 0.20 statt 0.50 US-Dollar pro Million Tokens, ein Rückgang um 60 Prozent, weil der Cache-Multiplikator bei Opus 5.5 bei 5 statt 10 Prozent des Grundpreises liegt. Anthropic beziffert die Gesamtersparnis bei typischen Workloads auf rund 40 Prozent – dieser Wert setzt sich aus dem niedrigeren Grundpreis, den günstigeren Cache-Reads und einem tieferen Token-Verbrauch durch den neuen Default-Effort zusammen.

Was bedeutet der neue Default-Effort 'medium' konkret?

Der Effort-Parameter steuert, wie viel Rechenaufwand ein Modell in eine Anfrage steckt. Bei Opus 5 und Claude Fable 5.1 liegt der Standardwert bei 'high', bei Opus 5.5 neu bei 'medium'. Wer Opus 5.5 ohne expliziten Effort-Parameter aufruft, erhält also automatisch eine sparsamere, schnellere Antwort als bei den Vorgängermodellen. Für die meisten Routineaufgaben reicht das aus; bei geschäftskritischen Anfragen – etwa einer komplexen Vertragsprüfung oder einem mehrstufigen Agenten-Workflow – lohnt sich ein bewusstes Hochsetzen auf 'high' oder 'xhigh', da sonst stillschweigend weniger Rechenaufwand investiert wird als bisher gewohnt.

Welche Breaking Changes betreffen bestehende Integrationen?

Vier Änderungen wirken sich laut Anthropics Modelldokumentation auf produktiven Code aus, der bisher mit Opus 5 lief: Erstens lässt sich das Nachdenken (Thinking) nicht mehr deaktivieren. Zweitens liefert eine erzwungene Werkzeugnutzung über die Parameter 'any' oder 'tool' einen Fehler statt einer Antwort. Drittens sind Thinking-Blöcke fest an das erzeugende Modell und die jeweilige Konversation gebunden und lassen sich nicht mehr in eine andere Sitzung übertragen. Viertens akzeptieren die Claude API und Google Cloud das ältere Computer-Use-Werkzeug 'computer_20251124' nicht mehr. Wer eine eigene Integration betreibt, sollte diese vier Punkte vor der Umstellung im eigenen Code prüfen.

Muss ich als reiner claude.ai-Nutzer etwas tun?

Nein. Wer Claude ausschliesslich über die Weboberfläche oder die App im Pro-, Max-, Team- oder Enterprise-Abo nutzt, bemerkt den Modellwechsel höchstens an saubereren, klarer strukturierten Antworten. Die vier Breaking Changes betreffen ausschliesslich eigene Integrationen über die Claude API, Amazon Bedrock, Google Cloud oder Microsoft Foundry – also Fälle, in denen jemand im eigenen Betrieb oder ein Dienstleister eine Automatisierung direkt gegen die Schnittstelle programmiert hat.

Ersetzt Claude Opus 5.5 das Modell Claude Fable 5.1?

Nein, beide Modelle bestehen nebeneinander weiter. Fable 5.1 bleibt laut Anthropic für besonders langwieriges Schlussfolgern und Forschungsaufgaben positioniert und kostet mit 10 respektive 50 US-Dollar pro Million Tokens weiterhin deutlich mehr. Opus 5.5 übernimmt die Rolle des Alltagsmodells für Agenten-Programmierung und Wissensarbeit, die zuvor Opus 5 innehatte – zu einem tieferen Preis und mit höherer Punktzahl auf den meisten Benchmarks.

Wo ist Claude Opus 5.5 verfügbar?

Über die Claude API unter der Modell-ID 'claude-opus-5-5', über Amazon Bedrock, Google Cloud, Microsoft Foundry sowie für Claude-Nutzer mit einem Pro-, Max-, Team- oder Enterprise-Abo. Eine Besonderheit für Betriebe mit Datenresidenz-Anforderungen: US-only Inferencing bleibt optional verfügbar, kostet aber weiterhin einen Aufpreis von 10 Prozent gegenüber dem globalen Routing.

Quellen

  1. Claude Opus 5.5anthropic.com · Anthropic · 2026-09-22
  2. Claude Opus 5.5 – Model Overviewplatform.claude.com · Anthropic · 2026-09-22
  3. Pricing — Claude Docsplatform.claude.com · Anthropic · 2026
  4. KI in Schweizer KMU auf dem Vormarschkmu.admin.ch · kmu.admin.ch (SECO) · 2025

Weitere Artikel

Alle Artikel

Was lässt sich bei Ihnen vereinfachen?

Im Erstgespräch klären Sie unverbindlich, welche Aufgaben sich eignen und was ein sinnvoller erster Schritt ist.

Ihre Angaben werden nur zur Beantwortung der Anfrage verwendet. Details in der Datenschutzerklärung.