Claude Opus 5.5: Wann lohnt sich der Aufpreis?
Was Claude Opus 5.5 für Coding und KI-Agenten kostet, welche Limits gelten und wann sich der Aufpreis gegenüber Sonnet, Haiku oder Fable tatsächlich lohnt.
Veröffentlicht am

Claude Opus 5.5 lohnt sich für anspruchsvolle Programmieraufgaben und KI-Agenten, wenn weniger Fehlversuche oder ein geringerer menschlicher Prüfaufwand die Kosten von $4 pro Million Eingabetokens und $20 pro Million Ausgabetokens rechtfertigen. Für alltägliche Programmieraufgaben ist Claude Sonnet 5.5 der Ausgangspunkt, für einfache Aufgaben mit hohem Volumen Claude Haiku 5.5. Claude Fable 5.1 bleibt den Aufgaben vorbehalten, bei denen es einen nachweisbaren Vorteil gegenüber Opus bietet.
Was ist Claude Opus 5.5?
Claude Opus 5.5 ist Anthropics Modell für länger laufende Programmieraufgaben und Wissensarbeit. Dazu gehören auch Agenten: Software, die mithilfe eines Modells Aktionen auswählt, Tools aufruft und eine Aufgabe Schritt für Schritt bearbeitet. In der Praxis kommt Opus vor allem für schwierige Aufgaben infrage, die sonst immer wieder einen neuen Anlauf brauchen — etwa Änderungen an mehreren Teilen eines Repositorys oder eine Untersuchung mit widersprüchlichen Befunden.
Anthropic hat das Modell am 22. September 2026 veröffentlicht. Nach Angaben des Unternehmens erreicht es bei den meisten Aufgaben ein mit Claude Fable 5.1 vergleichbares Leistungsniveau. Zugleich meldet Anthropic 40% niedrigere Kosten als bei Claude Opus 5 für typische Arbeitslasten mit Standardeinstellungen sowie eine um mehr als 30% schnellere Textausgabe. Diese Angaben stammen von Anthropic; für diesen Artikel wurde kein eigener Vergleichstest durchgeführt. Anthropics Ankündigung.
Die Modell-ID für die Claude API lautet claude-opus-5-5. Über diese Entwicklerschnittstelle lässt sich das Modell in eigene Anwendungen einbinden. Opus nutzt adaptives Denken und passt damit den Denkaufwand an die Aufgabe an. Diese Funktion ist immer aktiv; die Standardeinstellung für den Denkaufwand lautet medium. Dokumentation zu Opus 5.5.
Für Gründer zählt, ob dieser zusätzliche Denkaufwand mit weniger Eingriffen zu einem brauchbaren Ergebnis führt. Eine günstigere Antwort kann am Ende teurer sein, wenn ein Entwickler sie nachbessern muss. Umgekehrt lässt sich der Einsatz von Opus zur Einordnung eines einfachen Supporttickets kaum rechtfertigen, wenn eine günstigere Lösung bereits alle Prüfungen besteht.
Welches Claude-Modell passt zu welcher Aufgabe?
Sonnet ist der Ausgangspunkt für alltägliche Programmieraufgaben, Opus für anspruchsvolle Arbeit und Haiku für klar eingegrenzte Aufgaben mit hohem Volumen. Diese Empfehlungen beruhen auf den Preisen und den dokumentierten Einsatzbereichen. Sie bedeuten nicht, dass jedes Modell bei jeder Aufgabe seiner Kategorie überlegen ist.
Die folgenden Preise wurden am 11. Oktober 2026 mit der aktuellen Preisseite von Anthropic abgeglichen. Alle Beträge sind Standardpreise der API in USD pro Million Tokens, also den Texteinheiten, nach denen abgerechnet wird. Eingabetokens sind das übermittelte Material, Ausgabetokens der vom Modell erzeugte Text. Aktuelle API-Preise.
Für Haikus Preisschwelle zählt der gesamte Prompt, einschließlich zwischengespeicherter Eingaben. Wird sie überschritten, ändern sich die Preise für die gesamte Anfrage, nicht nur für die zusätzlichen Tokens. Diese Grenze gehört in die Kostenplanung, wenn ein Agent einen immer längeren Verlauf ansammelt. Der Leitfaden zu Claude Haiku 5.5 erläutert diesen Einsatz genauer.
Claude Sonnet 5.5 liegt preislich in der Mitte und eignet sich für Programmierung und Agentenaufgaben. Bevor mehr Denkaufwand eingekauft wird, braucht das Modell eine konkrete Aufgabenbeschreibung, die relevanten Dateien und einen klaren Abnahmetest. Einrichtung und Wahl des Denkaufwands behandelt der Workflow-Leitfaden zu Sonnet 5.5.
Claude Fable 5.1 ist die teurere Option für anspruchsvolle Denkaufgaben und Arbeit über längere Abläufe hinweg. Die Standardpreise für Eingabe und Ausgabe liegen bei $10 / $50 pro Million Tokens, gegenüber $4 / $20 bei Opus. Diesen Aufpreis muss eine beobachtbare Verbesserung bei den eigenen schwierigen Aufgaben rechtfertigen. Der Modellname allein reicht dafür nicht aus. Anthropics Modellpreise.
Was kostet Opus 5.5 in einem Agenten-Workflow?
Bei gleichem Tokenverbrauch kostet Opus doppelt so viel wie Sonnet. Trotzdem können schon wenige eingesparte Sekunden bei der menschlichen Prüfung den Aufpreis ausgleichen.
Als Rechenbeispiel dient eine Aufgabe, die über alle Aufrufe hinweg 100,000 nicht zwischengespeicherte Eingabetokens und 10,000 abgerechnete Ausgabetokens verbraucht. Das sind angenommene Verbrauchswerte, keine Messwerte aus einer Programmiersitzung. Caching, Toolgebühren, Infrastruktur, Rabatte und Wiederholungsversuche bleiben außen vor, damit der reine Modellaufpreis sichtbar wird.
Mit den oben genannten Preisen ergibt sich:
- Sonnet kostet
(0.1 × $2) + (0.01 × $10) = $0.30. - Opus kostet
(0.1 × $4) + (0.01 × $20) = $0.60. - Fable kostet
(0.1 × $10) + (0.01 × $50) = $1.50.
Bei 10,000 solchen Aufgaben pro Monat ergeben sich Tokenbudgets von $3,000, $6,000 beziehungsweise $15,000. Tatsächlich können die Modelle für dieselbe Aufgabe unterschiedlich viele Tokens benötigen. Die Rechnung stellt deshalb die Preise gegenüber; sie sagt keine spätere Rechnung voraus.
Beim älteren Opus 5 kostet derselbe angenommene Verbrauch $0.75 pro Aufgabe oder $7,500 im Monat. Wird dieser unveränderte Verbrauch auf Opus 5.5 umgestellt, sinken die Kosten um $1,500, also um 20%. Anthropics separate Angabe von 40% Einsparung bei typischen Arbeitslasten berücksichtigt auch einen veränderten Tokenverbrauch. Sie ist kein pauschaler Rabatt, der sich auf jede bisherige Rechnung anwenden lässt. Der Vergleich von Opus 5.5 und Opus 5 behandelt die Upgrade-Entscheidung und die Prüfungen vor einer Migration.

Für Fable liegt die Hürde in diesem Beispiel höher: Der zusätzliche Aufpreis von $0.90 gegenüber Opus erfordert bei denselben Stundensätzen 21.6 Sekunden weniger Prüfzeit. Fable könnte den Aufpreis auch dadurch rechtfertigen, dass es eine wertvolle Aufgabe löst, an der Opus vollständig scheitert. Diese beiden Gründe sollten getrennt betrachtet werden: weniger Prüfung bei abgenommenen Ergebnissen und mehr Aufgaben, die überhaupt erfolgreich abgeschlossen werden.
Caching verändert die Rechnung erneut. Beim Lesen aus dem Cache werden geeignete Prompt-Inhalte wiederverwendet; Opus berechnet dafür $0.20 pro Million gelesener Tokens. Das erstmalige Anlegen eines Cache-Eintrags wird separat abgerechnet. Nicht zwischengespeicherte Eingaben, Cache-Schreibvorgänge, Cache-Lesevorgänge und Ausgaben gehören deshalb als eigene Posten ins Budget. Hinzu kommen Tool- und Infrastrukturkosten. Der Leitfaden zu den Preisen der Claude API enthält die vollständige Kalkulation samt Zu- und Abschlägen.
Was sich für Entwicklung, Betrieb und Einkauf ändert
Entwicklung: Schwierige Aufgaben gezielt an Opus geben
Wer als Gründer mit gesicherter Finanzierung einen Programmieragenten entwickelt, sollte ermitteln, bei welchen Aufgabentypen regelmäßig menschliches Eingreifen nötig ist. Änderungen quer durch ein Repository sind sinnvolle Kandidaten für Opus. Kleine, präzise beschriebene Anpassungen können bei Sonnet bleiben, solange sie Tests und Reviews bestehen.
Wer allein entwickelt, kann nach derselben Regel von Hand vorgehen: Bei einer klar begrenzten Aufgabe zunächst das günstigere Modell einsetzen und dann zum stärkeren wechseln, wenn das erste den Fehler weder erklären noch eine gültige Änderung liefern kann. Einen unveränderten Prompt endlos zu wiederholen, ist keine Strategie zur Kostenkontrolle.
Betrieb: Festlegen, wann eine Aufgabe als erledigt gilt
Für erfahrene Betriebsverantwortliche ist eine beeindruckende Antwort noch kein abgeschlossener Arbeitsablauf. Eine Recherche gilt als abgenommen, wenn ihre Belege die Schlussfolgerung tragen. Eine Extraktion ist erfolgreich, wenn die geforderten Felder mit der Quelle übereinstimmen. Eine Programmieraufgabe ist abgeschlossen, wenn die relevanten Tests bestehen und ein Reviewer Verhalten und Umfang der Änderung freigibt.
Erst solche Prüfungen schaffen eine Grundlage für die Modellwahl. Ohne sie kann eine kürzere Sitzung bessere Ausführung bedeuten — oder bloß eine unvollständige Antwort, die früher geliefert wurde.
Einkauf: Erfolgreich abgeschlossene Arbeit finanzieren
Ein CTO im Mittelstand sollte die Kosten je abgenommener Aufgabe verlangen, einschließlich Fehlversuchen und Prüfzeit. Eine höhere Tokenrechnung kann die Gesamtkosten der Umsetzung trotzdem senken. Umgekehrt helfen niedrigere Listenpreise wenig, wenn die Integration nicht mehr funktioniert.
Opus 5.5 weist Anfragen mit deaktiviertem Denken oder erzwungener Toolauswahl zurück. Außerdem hat sich das Format der Fortschrittsmeldungen zwischen Toolaufrufen geändert. Dadurch kann eine bestehende Oberfläche stumm bleiben, obwohl im Hintergrund weitergearbeitet wird. Diese Abläufe müssen vor dem Produktiveinsatz geprüft werden. Dokumentierte Kompatibilitätsänderungen.
Kontextfenster, Tarife und Nutzungslimits
Das API-Kontextfenster von Opus 5.5 umfasst 1 Million Tokens; die maximale Ausgabe liegt standardmäßig bei 128,000 Tokens. Das Kontextfenster begrenzt das Material, das innerhalb einer Anfrage zur Verfügung steht. Seine Größe sagt nichts darüber aus, ob das Mitsenden sämtlicher Dateien das Ergebnis verbessert. Vorrang haben der relevante Code, die Anforderungen und die Testergebnisse. Modellgrenzen der API.
Für die Claude-App nennt die aktuelle Preisseite Opus-Zugang in Pro, Max, Team und Enterprise, jedoch nicht in Free. Pro kostet $20 bei monatlicher Abrechnung oder $200 bei jährlicher Vorauszahlung; Max beginnt bei $100 im Monat. Das Kontextfenster der App wird mit bis zu 1M angegeben und variiert je nach Modell. Claude-Tarife.
Ein Abonnement ist für Menschen gedacht, die in Claude arbeiten; für eine eigene Anwendung wird die API-Nutzung budgetiert. Die aktuellen Tarife werben zusätzlich mit monatlichen API-Guthaben: $100 bei Max 5x, $200 bei Max 20x und bis zu $500 als gemeinsames Guthaben bei Team, jeweils gemäß den geltenden Bedingungen. Bevor diese Guthaben vom Produktionsbudget abgezogen werden, muss der Anspruch darauf geklärt sein. Aktuell enthaltene Leistungen.
Mit der Ankündigung im September wurden die Nutzungslimits pro Fünf-Stunden-Zeitraum für Pro, Max, Team und Enterprise mit Abrechnung pro Nutzerplatz angehoben. Zusätzlich wurde Abonnenten ein Zurücksetzen des Limits angeboten, das sie für später aufheben konnten. Die Ankündigung nannte weder einen Multiplikator noch eine feste Zahl erlaubter Nachrichten. Daraus lassen sich weder unbegrenzte Agentenläufe noch eine garantierte Erhöhung des Wochenlimits ableiten. Einzelheiten der Ankündigung.
Wo die Erwartungen zu hoch sind
Überzogen ist die Vorstellung, niedrigere Preise allein würden die Einsatzentscheidung klären. Sie betreffen lediglich einen Faktor.
Die Einsparung von 40% bei typischen Arbeitslasten ist kein allgemeines Versprechen für die nächste Rechnung. Ebenso bedeutet eine schnellere Textausgabe nicht, dass ein Agent seine gesamte Aufgabe entsprechend früher beendet: Toolausführung, Wartezeiten, Wiederholungsversuche und Prüfung kosten weiterhin Zeit. Ein Agent, der schnell schreibt, aber unnötige Aktionen aneinanderreiht, kann insgesamt langsam bleiben.
Auch die Aussage, bei den meisten Aufgaben nahe an Fable zu liegen, lässt Unterschiede bei den eigenen Aufgaben zu. Anspruchsvolle Arbeit kann Fable weiterhin rechtfertigen; einfache Aufgaben brauchen womöglich nie Opus. Verglichen werden sollte das tatsächlich benötigte Ergebnis, mit denselben Tools und denselben Abnahmekriterien.
Ein großes Kontextfenster ersetzt außerdem keine klare Aufgabenabgrenzung. Eine definierte Änderung mit ausdrücklicher Prüfung lässt sich leichter beurteilen als der Auftrag, ein ganzes Unternehmenssystem ohne festgelegtes Ziel zu verbessern.
Jetzt einführen, abwarten oder beim bisherigen Modell bleiben?
Opus lohnt sich jetzt für eine klar abgegrenzte Klasse schwieriger Aufgaben, wenn es bei den abgenommenen Ergebnissen, beim Prüfaufwand oder bei beidem besser abschneidet. Während Fehler und Kosten beobachtet werden, sollte der bisherige, bewährte Ablauf verfügbar bleiben.
Abwarten ist sinnvoll, wenn Abnahmekriterien fehlen, die Kompatibilität der Anfragen ungeklärt ist oder Fehler des neuen Modells mehr menschliche Nacharbeit verursachen. Ein niedrigerer Tokenpreis reicht als Beleg nicht aus, um einen stabilen Dienst umzustellen.
Für Routineaufgaben kann die bisherige Modellwahl bestehen bleiben, wenn Sonnet oder Haiku die Prüfungen bereits bei geringeren Gesamtkosten erfüllen. Ein neues Release verpflichtet nicht dazu, jedes Modell in der Anwendung auszutauschen.
Ein sinnvoller Ansatz: zuerst Sonnet, Opus erst nach einer fehlgeschlagenen Prüfung. Im vorherigen Beispiel mit festem Tokenverbrauch kostet das pro Aufgabe $0.30 + Anteil der an Opus weitergegebenen Aufgaben × $0.60. Werden angenommene 20% der Aufgaben weitergegeben, beträgt der Durchschnitt $0.42 oder $4,200 für 10,000 Aufgaben. Würde jede Aufgabe direkt an Opus gehen, wären es $6,000.

Bei einer Weitergabequote von 50% sind die Tokenkosten gleich hoch: Wenn die Hälfte der Aufgaben beide Versuche bezahlt, kostet dieser Ablauf genauso viel wie der ausschließliche Einsatz von Opus. Liegt die Quote darüber, ist es unter diesen Annahmen günstiger, diese Aufgabenklasse direkt an Opus zu schicken.
Das ist eine Berechnung zur Aufgabenverteilung, keine Vorhersage der Modellgenauigkeit. Sie setzt die genannten Kosten je Versuch voraus und berücksichtigt keine weiteren Wiederholungen. Zusätzlicher Kontext, Kosten für Prüfungen und Wartezeiten durch aufeinanderfolgende Aufrufe können den Schnittpunkt verschieben. Vor allem gilt: Übersieht eine Prüfung falsche Antworten, ist die scheinbare Ersparnis wertlos.
Der nächste Schritt für Montag
Zunächst eine Aufgabenklasse auswählen und vor dem Vergleich festlegen, welches Ergebnis den Aufpreis für Opus rechtfertigen würde. Eine Entwicklungsleitung könnte dafür wiederkehrende Fehlerbehebungen wählen, die bisher viel Prüfaufwand verursachen.
Das Ziel festlegen
Repräsentative Aufgaben mit bekannten Anforderungen auswählen. Tests, zulässigen Umfang und Prüfkriterien festhalten. Dazu gehören sowohl Fälle, mit denen das bisherige Modell Schwierigkeiten hat, als auch gewöhnliche Aufgaben, die es bereits bewältigt.
Die gesamte Aufgabe vergleichen
Den bisherigen Ablauf und Opus mit demselben Aufgabenmaterial und denselben Tools ausführen. Einstellungen zum Denkaufwand, Tokenkategorien, Toolkosten, Gesamtdauer, Wiederholungsversuche, Abnahme und menschliche Prüfzeit erfassen. Opus zunächst mit medium starten und den Denkaufwand gezielt ändern, wenn ein Fehlschlag dies nahelegt.
Nur die Aufgabenklasse mit nachgewiesenem Vorteil umstellen
Aufgaben verlagern, wenn die Qualität gleich bleibt oder steigt und sich die Gesamtkosten rechtfertigen lassen. Sonnet und Haiku dort beibehalten, wo sie die Prüfungen günstig bestehen. Fable zunächst mit denselben Prüfungen auf weiterhin ungelöste, wertvolle Aufgaben ansetzen, bevor sein Einsatz ausgeweitet wird.
Wofür eignet sich Claude Opus?
Opus kommt für schwierige Programmieraufgaben, mehrstufige Untersuchungen und Wissensarbeit infrage, bei denen Urteilsvermögen und Ausdauer zählen. Es lohnt sich, wenn es Fehlschläge oder menschliche Korrekturen so weit reduziert, dass der Aufpreis gerechtfertigt ist. Einfache Klassifikation und routinemäßige Programmieraufgaben, die bereits die Abnahmekriterien erfüllen, benötigen es nicht automatisch.
Für praxisnahe Entscheidungen zur Modellwahl und zum Budget von KI-Agenten: den Newsletter abonnieren.
- Veröffentlicht
- Kategorie
- AI
- Sprache







