{"content_id":"7eujffjzrh","slug":"claude-opus-5-5-pricing-performance-comparison","locale":"de","schema_type":"Article","category":"ai_data","category_name":"KI-Daten","title":"Claude Opus 5.5: Preise und Leistung im Vergleich","summary":"Die Standardpreise für Eingabe- und Ausgabetoken bei Claude Opus 5.5 liegen 20 % unter denen von Opus 5. Die Einsparung von 40 % bei den Kosten pro Aufgabe ist ein Ergebnis der Bewertung von Anthropic. Die tatsächlichen Kosten hängen von der Tokenanzahl und der Cachenutzung ab.","sponsorship_disclosure":null,"affiliate_disclosure":null,"commerce_disclosure":null,"author":{"name":"injoys","url":"https://injoys.com/ko/about"},"key_points":["Die Standardpreise von Claude Opus 5.5 betragen pro 1 Million Token 4 Dollar für die Eingabe und 20 Dollar für die Ausgabe.","Der Preis für Cache-Lesezugriffe liegt bei 0.20 Dollar pro 1 Million Token und damit 60 % unter dem von Opus 5.","Der Wert bei Terminal-Bench 4.0 stieg laut Angaben von Anthropic von 52.3% auf 66.4%.","Der Rückgang der Versuche, Grenzen zu umgehen, um etwa 85 % wurde in einer bestimmten Sicherheitsbewertung festgestellt.","Wenn Sie eine bestehende API umstellen möchten, prüfen Sie neben dem Modellnamen auch die Einstellungen für Inferenz und Tool-Aufrufe."],"content_markdown":"Claude Opus 5.5 ist ein Modell mit um 20 % gesenkten regulären Tokenpreisen. Auch die Bewertungen für Programmierung und Computerbedienung sind gestiegen. Die Einsparung von 40 % bei den Kosten pro Aufgabe ist ein Testergebnis von Anthropic.\n\nDie Preise und Bewertungen entsprechen der Ankündigung von Anthropic vom 22. September 2026.\n\n## Preisvergleich für Claude Opus 5.5\n\nDie regulären API-Preise betragen 4 Dollar für die Eingabe und 20 Dollar für die Ausgabe pro 1 Million Token. Token sind die Einheiten, in denen das Modell Texte und andere Inhalte verarbeitet. Eingabe bezeichnet die Inhalte, die an das Modell gesendet werden, Ausgabe die Inhalte, die das Modell erzeugt.\n\n| Abrechnungsposten | Opus 5 | Opus 5.5 | Preissenkung |\n| --- | ---: | ---: | ---: |\n| Reguläre Eingabe, 1 Million Token | 5 Dollar | 4 Dollar | 20 % |\n| Ausgabe, 1 Million Token | 25 Dollar | 20 Dollar | 20 % |\n| Cache-Lesevorgänge, 1 Million Token | 0,50 Dollar | 0,20 Dollar | 60 % |\n\nDie Beträge sind in US-Dollar angegeben. Der Cache speichert wiederholt verwendete Eingaben, damit sie erneut genutzt werden können. Die Kosten für das Anlegen eines Caches werden getrennt von den Lesekosten berechnet.\n\n## Bedingungen für 40 % geringere Kosten pro Aufgabe\n\nDie 40 % sind kein Rabatt, der für jede Anfrage gilt. Es handelt sich um eine von Anthropic für typische Aufgaben mit Standardeinstellungen ermittelte Einsparung. Sie berücksichtigt sowohl die niedrigeren Tokenpreise als auch den geringeren Tokenverbrauch pro Aufgabe.\n\n| Nutzungsbedingungen | Kostenbestimmende Posten | Zu prüfen |\n| --- | --- | --- |\n| Jedes Mal neue Inhalte eingeben | Verbrauch für reguläre Eingabe und Ausgabe | Tatsächliche Tokenzahl für beide Posten |\n| Dieselben Dokumente oder Anweisungen wiederholt verwenden | Verbrauch für das Anlegen und Lesen des Caches | Ob der Cache tatsächlich wiederverwendet wurde |\n| Programmieragent mit mehreren Arbeitsschritten | Wiederholte Aufrufe und erneute Versuche | Gesamtkosten bis zum Abschluss der Aufgabe |\n| Abonnement mit Monatsgebühr | Abonnementpreis und Nutzungslimit | Unterschied zwischen Tokenpreis und Abonnementgebühr |\n\nEine Senkung der API-Tokenpreise bedeutet nicht automatisch eine Senkung der monatlichen Abonnementgebühr. Um die Einsparung beim eigenen Dienst zu ermitteln, vergleichen Sie den Verbrauch für dieselbe Aufgabe. Auch in den [Informationen von Anthropic zu Opus](https://www.anthropic.com/claude/opus) werden die 40 % als Schätzung für Aufgaben mit tokenbasierter Abrechnung beschrieben.\n\n## Berechnungsbeispiel\n\nBei jeweils 1 Million Token für Eingabe und Ausgabe betragen die regulären Kosten 24 Dollar. Für den Vergleich wird angenommen, dass der Verbrauch bei beiden Modellen gleich ist. Cache und separate Kosten für Tools sind nicht berücksichtigt.\n\n| Berechnungsposten | Opus 5 | Opus 5.5 |\n| --- | ---: | ---: |\n| Reguläre Eingabe, 1 Million Token | 5 Dollar | 4 Dollar |\n| Ausgabe, 1 Million Token | 25 Dollar | 20 Dollar |\n| Summe | 30 Dollar | 24 Dollar |\n\nDie Differenz beträgt 6 Dollar, die Einsparung 20 %. Ein geringerer Tokenverbrauch pro Aufgabe ist in dieser Berechnung nicht berücksichtigt. Deshalb weicht das Ergebnis, das nur die Tokenpreise berücksichtigt, von den angekündigten 40 % ab.\n\nBei 1 Million Cache-Lese-Token beträgt die Differenz 0,30 Dollar. Dieser Betrag ergibt sich jedoch allein aus dem Vergleich der Lesekosten. Für die Gesamtrechnung müssen auch die Kosten für das Anlegen des Caches und für andere Token berücksichtigt werden.\n\n## Leistung bei agentenbasiertem Programmieren und Computerbedienung\n\nLaut der Ankündigung von Anthropic sind die Bewertungen sowohl für Programmierung als auch für Computerbedienung gestiegen. Beim agentenbasierten Programmieren werden Tools eingesetzt, um Entwicklungsaufgaben in mehreren Schritten zu erledigen. Computerbedienung bezeichnet die Fähigkeit, den Bildschirm zu erfassen und die Benutzeroberfläche zu bedienen.\n\n| Bewertung | Opus 5 | Opus 5.5 | Punktedifferenz |\n| --- | ---: | ---: | ---: |\n| Terminal-Bench 4.0 | 52,3 % | 66,4 % | 14,1 Prozentpunkte |\n| CursorBench 4.0 | 46,6 % | 57,8 % | 11,2 Prozentpunkte |\n| OSWorld 2.1 | 74,0 % | 81,8 % | 7,8 Prozentpunkte |\n\nDie Bewertung heißt in der offiziellen Ankündigung OSWorld 2.1. Das Ergebnis ist mit `partial` gekennzeichnet. Version und Bewertungskennzeichnung sollten zusammen angegeben werden, damit es nicht mit anderen Ergebnissen verwechselt wird.\n\nDas Ergebnis von Opus 5.5 bei Terminal-Bench 4.0 wurde mit der Einstellung `xhigh` erzielt. Die Bedingungen dieser Bewertung entsprechen nicht denen der veröffentlichten Kostenschätzung mit Standardeinstellungen. Aus dem höheren Punktwert allein lässt sich die Erfolgsquote in einem tatsächlichen Projekt nicht berechnen.\n\n## Änderungen bei Geschwindigkeit und Textqualität\n\nAnthropic gab bekannt, dass die Ausgabegenerierung gegenüber Opus 5 um mehr als 30 % schneller geworden ist. Dieser Wert bezieht sich auf die Geschwindigkeit, mit der Text erzeugt wird. Wie stark sich die Dauer einer gesamten Aufgabe einschließlich Recherche und Tests verkürzt, muss gesondert gemessen werden.\n\nBeim Schreiben soll das Modell verbessert worden sein, indem es den Kernpunkt voranstellt und verständlich erklärt. Eine Steigerung der Qualität koreanischer Dokumente wurde jedoch nicht gesondert beziffert. Prüfen Sie anhand der in Ihrem Team verwendeten Dokumente Folgendes:\n\n- Ob Schlussfolgerung und Begründung unterscheidbar sind\n- Ob der gewünschte Stil und das gewünschte Format eingehalten werden\n- Ob sich Zahlen und Zitate anhand des Originals überprüfen lassen\n- Ob die Gründe für Codeänderungen so erklärt werden, dass sie überprüft werden können\n\n## Was die Verringerung um etwa 85 % bei der Sicherheitsbewertung bedeutet\n\nDie Verringerung um etwa 85 % bezieht sich auf Versuche, Isolationsgrenzen zu umgehen. Der Vergleich erfolgt mit Opus 5 oder Claude Mythos 5.1. Das bedeutet nicht, dass die Zahl der Vorfälle im tatsächlichen Betrieb im selben Verhältnis gesunken ist.\n\nEine Sandbox ist eine Ausführungsumgebung, die den Zugriffsbereich eines Programms begrenzt. Die Sicherheitsbewertung des Modells und die Zugriffsbeschränkungen dieser Umgebung sind voneinander zu unterscheiden. Auch eine bessere Bewertung ist kein Grund, die Berechtigungen im Betrieb automatisch auszuweiten.\n\nAnthropic erklärt, dass es weiterhin schwierig ist, vor der Bereitstellung alle Fehler durch Bewertungen aufzudecken. Worauf sich die Zahlen beziehen, lässt sich im [Abschnitt zur Sicherheit in der Ankündigung von Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) nachlesen. Prüfen Sie im Betrieb sowohl die Dateizugriffsrechte als auch die Ausführungsprotokolle.\n\n## Einstellungen für die API-Umstellung\n\nBei bestehenden API-Integrationen müssen neben dem Modellnamen auch andere Einstellungen geprüft werden. Die Modellkennung für die Claude API lautet `claude-opus-5-5`. Andere Cloud-Plattformen verwenden jeweils eigene Modellkennungen.\n\nDie offizielle Migrationsanleitung beschreibt die Änderung an den Thinking-Einstellungen wie folgt:\n\n\u003e Thinking can't be disabled\n\nQuelle ist [Migrating to Claude Opus 5.5](https://platform.claude.com/docs/en/models/opus-5-5/migration-guide) von Anthropic. Das bedeutet, dass eine Einstellung zum Deaktivieren von Thinking nicht unterstützt wird.\n\n1. Prüfen Sie, ob in bestehenden Anfragen eine Einstellung zum Deaktivieren von Thinking verwendet wird. Opus 5.5 lehnt diese Einstellung ab.\n2. Geben Sie die Thinking-Intensität mit `effort` ausdrücklich an. Der Standardwert bei Opus 5.5 ist `medium`.\n3. Prüfen Sie Einstellungen, die bestimmte Tool-Aufrufe erzwingen. Nicht unterstützte Einstellungen führen zu Anfragefehlern.\n4. Unterscheiden und verarbeiten Sie Antwortblöcke anhand ihres `type`. Der erste Block enthält nicht immer den Antworttext.\n5. Messen Sie Kosten und Bearbeitungszeit für dieselbe Aufgabe erneut. Thinking-Token werden ebenfalls zum Ausgabepreis berechnet.\n\nZum Zeitpunkt der Veröffentlichung wurde auch die Unterstützung durch AWS, Google Cloud und Microsoft Azure angekündigt. Modellkennungen und Bedingungen für die Tool-Unterstützung können je nach Plattform unterschiedlich sein. Prüfen Sie die Migrationsanleitung für das Modell, das Sie in Ihrer bisherigen Integration verwenden.\n\n## Häufige Fehler\n\nBei Preis- und Leistungsangaben muss klar sein, was jeweils gemessen wurde. Tokenpreis, Kosten pro Aufgabe und Bewertungsergebnis sind unterschiedliche Kennzahlen. Die folgende Unterscheidung hilft, die Vergleichsbedingungen im Blick zu behalten.\n\n| Naheliegende Fehlinterpretation | Bestätigte Bedeutung |\n| --- | --- |\n| Jede Rechnung fällt um 40 % niedriger aus | Schätzung für typische Aufgaben mit Standardeinstellungen |\n| Mit Cache sinken die Gesamtkosten um 60 % | Nur der Preis für Cache-Lesevorgänge wurde um 60 % gesenkt |\n| Die Leistung ist um 14,1 % gestiegen | Das Ergebnis bei Terminal-Bench ist um 14,1 Prozentpunkte gestiegen |\n| Jede Aufgabe ist 30 % schneller erledigt | Die Ausgabegenerierung ist um mehr als 30 % schneller geworden |\n| Tatsächliche Vorfälle sind um 85 % zurückgegangen | Versuche, Grenzen in einer bestimmten Bewertung zu umgehen, sind um etwa 85 % zurückgegangen |\n\n## Kostenvergleich pro abgeschlossener Aufgabe\n\nVergleichen Sie bei der Modellwahl die Kosten pro Aufgabe, die die Überprüfung bestanden hat. Am Tokenpreis allein lässt sich der Aufwand für erneute Versuche und Korrekturen nur schwer erkennen. So lassen sich die veröffentlichten Zahlen mit der tatsächlichen Arbeit vergleichen.\n\nDazu werden die gesamten Ausführungskosten durch die Zahl der Aufgaben geteilt, die die Überprüfung bestanden haben. Beziehen Sie auch die Kosten fehlgeschlagener Versuche in die gesamten Ausführungskosten ein. Für den Vergleich ist es hilfreich, die Zeit für die menschliche Überprüfung als eigenen Posten zu erfassen.\n\n- Dieselbe Aufgabenliste und dieselben Abschlusskriterien verwenden\n- Kosten für reguläre Eingabe, Cache und Ausgabe getrennt erfassen\n- Gesamtkosten einschließlich fehlgeschlagener und erneuter Versuche erfassen\n- Festhalten, ob die abschließende Überprüfung bestanden wurde\n- Ausführungszeit und Zeit für menschliche Korrekturen getrennt erfassen","content_html":"\u003cp\u003eClaude Opus 5.5 ist ein Modell mit um 20 % gesenkten regulären Tokenpreisen. Auch die Bewertungen für Programmierung und Computerbedienung sind gestiegen. Die Einsparung von 40 % bei den Kosten pro Aufgabe ist ein Testergebnis von Anthropic.\u003c/p\u003e\n\u003cp\u003eDie Preise und Bewertungen entsprechen der Ankündigung von Anthropic vom 22. September 2026.\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#preisvergleich-f%C3%BCr-claude-opus-55\" class=\"anchor\" id=\"preisvergleich-für-claude-opus-55\"\u003e\u003c/a\u003ePreisvergleich für Claude Opus 5.5\u003c/h2\u003e\n\u003cp\u003eDie regulären API-Preise betragen 4 Dollar für die Eingabe und 20 Dollar für die Ausgabe pro 1 Million Token. Token sind die Einheiten, in denen das Modell Texte und andere Inhalte verarbeitet. Eingabe bezeichnet die Inhalte, die an das Modell gesendet werden, Ausgabe die Inhalte, die das Modell erzeugt.\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003eAbrechnungsposten\u003c/th\u003e\n\u003cth\u003eOpus 5\u003c/th\u003e\n\u003cth\u003eOpus 5.5\u003c/th\u003e\n\u003cth\u003ePreissenkung\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Abrechnungsposten\"\u003eReguläre Eingabe, 1 Million Token\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e5 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e4 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Preissenkung\"\u003e20 %\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Abrechnungsposten\"\u003eAusgabe, 1 Million Token\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e25 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e20 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Preissenkung\"\u003e20 %\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Abrechnungsposten\"\u003eCache-Lesevorgänge, 1 Million Token\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e0,50 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e0,20 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Preissenkung\"\u003e60 %\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003eDie Beträge sind in US-Dollar angegeben. Der Cache speichert wiederholt verwendete Eingaben, damit sie erneut genutzt werden können. Die Kosten für das Anlegen eines Caches werden getrennt von den Lesekosten berechnet.\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#bedingungen-f%C3%BCr-40--geringere-kosten-pro-aufgabe\" class=\"anchor\" id=\"bedingungen-für-40--geringere-kosten-pro-aufgabe\"\u003e\u003c/a\u003eBedingungen für 40 % geringere Kosten pro Aufgabe\u003c/h2\u003e\n\u003cp\u003eDie 40 % sind kein Rabatt, der für jede Anfrage gilt. Es handelt sich um eine von Anthropic für typische Aufgaben mit Standardeinstellungen ermittelte Einsparung. Sie berücksichtigt sowohl die niedrigeren Tokenpreise als auch den geringeren Tokenverbrauch pro Aufgabe.\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003eNutzungsbedingungen\u003c/th\u003e\n\u003cth\u003eKostenbestimmende Posten\u003c/th\u003e\n\u003cth\u003eZu prüfen\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Nutzungsbedingungen\"\u003eJedes Mal neue Inhalte eingeben\u003c/td\u003e\n\u003ctd data-label=\"Kostenbestimmende Posten\"\u003eVerbrauch für reguläre Eingabe und Ausgabe\u003c/td\u003e\n\u003ctd data-label=\"Zu prüfen\"\u003eTatsächliche Tokenzahl für beide Posten\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Nutzungsbedingungen\"\u003eDieselben Dokumente oder Anweisungen wiederholt verwenden\u003c/td\u003e\n\u003ctd data-label=\"Kostenbestimmende Posten\"\u003eVerbrauch für das Anlegen und Lesen des Caches\u003c/td\u003e\n\u003ctd data-label=\"Zu prüfen\"\u003eOb der Cache tatsächlich wiederverwendet wurde\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Nutzungsbedingungen\"\u003eProgrammieragent mit mehreren Arbeitsschritten\u003c/td\u003e\n\u003ctd data-label=\"Kostenbestimmende Posten\"\u003eWiederholte Aufrufe und erneute Versuche\u003c/td\u003e\n\u003ctd data-label=\"Zu prüfen\"\u003eGesamtkosten bis zum Abschluss der Aufgabe\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Nutzungsbedingungen\"\u003eAbonnement mit Monatsgebühr\u003c/td\u003e\n\u003ctd data-label=\"Kostenbestimmende Posten\"\u003eAbonnementpreis und Nutzungslimit\u003c/td\u003e\n\u003ctd data-label=\"Zu prüfen\"\u003eUnterschied zwischen Tokenpreis und Abonnementgebühr\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003eEine Senkung der API-Tokenpreise bedeutet nicht automatisch eine Senkung der monatlichen Abonnementgebühr. Um die Einsparung beim eigenen Dienst zu ermitteln, vergleichen Sie den Verbrauch für dieselbe Aufgabe. Auch in den \u003ca href=\"https://www.anthropic.com/claude/opus\"\u003eInformationen von Anthropic zu Opus\u003c/a\u003e werden die 40 % als Schätzung für Aufgaben mit tokenbasierter Abrechnung beschrieben.\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#berechnungsbeispiel\" class=\"anchor\" id=\"berechnungsbeispiel\"\u003e\u003c/a\u003eBerechnungsbeispiel\u003c/h2\u003e\n\u003cp\u003eBei jeweils 1 Million Token für Eingabe und Ausgabe betragen die regulären Kosten 24 Dollar. Für den Vergleich wird angenommen, dass der Verbrauch bei beiden Modellen gleich ist. Cache und separate Kosten für Tools sind nicht berücksichtigt.\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003eBerechnungsposten\u003c/th\u003e\n\u003cth\u003eOpus 5\u003c/th\u003e\n\u003cth\u003eOpus 5.5\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Berechnungsposten\"\u003eReguläre Eingabe, 1 Million Token\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e5 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e4 Dollar\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Berechnungsposten\"\u003eAusgabe, 1 Million Token\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e25 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e20 Dollar\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Berechnungsposten\"\u003eSumme\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e30 Dollar\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e24 Dollar\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003eDie Differenz beträgt 6 Dollar, die Einsparung 20 %. Ein geringerer Tokenverbrauch pro Aufgabe ist in dieser Berechnung nicht berücksichtigt. Deshalb weicht das Ergebnis, das nur die Tokenpreise berücksichtigt, von den angekündigten 40 % ab.\u003c/p\u003e\n\u003cp\u003eBei 1 Million Cache-Lese-Token beträgt die Differenz 0,30 Dollar. Dieser Betrag ergibt sich jedoch allein aus dem Vergleich der Lesekosten. Für die Gesamtrechnung müssen auch die Kosten für das Anlegen des Caches und für andere Token berücksichtigt werden.\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#leistung-bei-agentenbasiertem-programmieren-und-computerbedienung\" class=\"anchor\" id=\"leistung-bei-agentenbasiertem-programmieren-und-computerbedienung\"\u003e\u003c/a\u003eLeistung bei agentenbasiertem Programmieren und Computerbedienung\u003c/h2\u003e\n\u003cp\u003eLaut der Ankündigung von Anthropic sind die Bewertungen sowohl für Programmierung als auch für Computerbedienung gestiegen. Beim agentenbasierten Programmieren werden Tools eingesetzt, um Entwicklungsaufgaben in mehreren Schritten zu erledigen. Computerbedienung bezeichnet die Fähigkeit, den Bildschirm zu erfassen und die Benutzeroberfläche zu bedienen.\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003eBewertung\u003c/th\u003e\n\u003cth\u003eOpus 5\u003c/th\u003e\n\u003cth\u003eOpus 5.5\u003c/th\u003e\n\u003cth\u003ePunktedifferenz\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Bewertung\"\u003eTerminal-Bench 4.0\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e52,3 %\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e66,4 %\u003c/td\u003e\n\u003ctd data-label=\"Punktedifferenz\"\u003e14,1 Prozentpunkte\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Bewertung\"\u003eCursorBench 4.0\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e46,6 %\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e57,8 %\u003c/td\u003e\n\u003ctd data-label=\"Punktedifferenz\"\u003e11,2 Prozentpunkte\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Bewertung\"\u003eOSWorld 2.1\u003c/td\u003e\n\u003ctd data-label=\"Opus 5\"\u003e74,0 %\u003c/td\u003e\n\u003ctd data-label=\"Opus 5.5\"\u003e81,8 %\u003c/td\u003e\n\u003ctd data-label=\"Punktedifferenz\"\u003e7,8 Prozentpunkte\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003cp\u003eDie Bewertung heißt in der offiziellen Ankündigung OSWorld 2.1. Das Ergebnis ist mit \u003ccode\u003epartial\u003c/code\u003e gekennzeichnet. Version und Bewertungskennzeichnung sollten zusammen angegeben werden, damit es nicht mit anderen Ergebnissen verwechselt wird.\u003c/p\u003e\n\u003cp\u003eDas Ergebnis von Opus 5.5 bei Terminal-Bench 4.0 wurde mit der Einstellung \u003ccode\u003exhigh\u003c/code\u003e erzielt. Die Bedingungen dieser Bewertung entsprechen nicht denen der veröffentlichten Kostenschätzung mit Standardeinstellungen. Aus dem höheren Punktwert allein lässt sich die Erfolgsquote in einem tatsächlichen Projekt nicht berechnen.\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#%C3%A4nderungen-bei-geschwindigkeit-und-textqualit%C3%A4t\" class=\"anchor\" id=\"änderungen-bei-geschwindigkeit-und-textqualität\"\u003e\u003c/a\u003eÄnderungen bei Geschwindigkeit und Textqualität\u003c/h2\u003e\n\u003cp\u003eAnthropic gab bekannt, dass die Ausgabegenerierung gegenüber Opus 5 um mehr als 30 % schneller geworden ist. Dieser Wert bezieht sich auf die Geschwindigkeit, mit der Text erzeugt wird. Wie stark sich die Dauer einer gesamten Aufgabe einschließlich Recherche und Tests verkürzt, muss gesondert gemessen werden.\u003c/p\u003e\n\u003cp\u003eBeim Schreiben soll das Modell verbessert worden sein, indem es den Kernpunkt voranstellt und verständlich erklärt. Eine Steigerung der Qualität koreanischer Dokumente wurde jedoch nicht gesondert beziffert. Prüfen Sie anhand der in Ihrem Team verwendeten Dokumente Folgendes:\u003c/p\u003e\n\u003cul\u003e\n\u003cli\u003eOb Schlussfolgerung und Begründung unterscheidbar sind\u003c/li\u003e\n\u003cli\u003eOb der gewünschte Stil und das gewünschte Format eingehalten werden\u003c/li\u003e\n\u003cli\u003eOb sich Zahlen und Zitate anhand des Originals überprüfen lassen\u003c/li\u003e\n\u003cli\u003eOb die Gründe für Codeänderungen so erklärt werden, dass sie überprüft werden können\u003c/li\u003e\n\u003c/ul\u003e\n\u003ch2\u003e\n\u003ca href=\"#was-die-verringerung-um-etwa-85--bei-der-sicherheitsbewertung-bedeutet\" class=\"anchor\" id=\"was-die-verringerung-um-etwa-85--bei-der-sicherheitsbewertung-bedeutet\"\u003e\u003c/a\u003eWas die Verringerung um etwa 85 % bei der Sicherheitsbewertung bedeutet\u003c/h2\u003e\n\u003cp\u003eDie Verringerung um etwa 85 % bezieht sich auf Versuche, Isolationsgrenzen zu umgehen. Der Vergleich erfolgt mit Opus 5 oder Claude Mythos 5.1. Das bedeutet nicht, dass die Zahl der Vorfälle im tatsächlichen Betrieb im selben Verhältnis gesunken ist.\u003c/p\u003e\n\u003cp\u003eEine Sandbox ist eine Ausführungsumgebung, die den Zugriffsbereich eines Programms begrenzt. Die Sicherheitsbewertung des Modells und die Zugriffsbeschränkungen dieser Umgebung sind voneinander zu unterscheiden. Auch eine bessere Bewertung ist kein Grund, die Berechtigungen im Betrieb automatisch auszuweiten.\u003c/p\u003e\n\u003cp\u003eAnthropic erklärt, dass es weiterhin schwierig ist, vor der Bereitstellung alle Fehler durch Bewertungen aufzudecken. Worauf sich die Zahlen beziehen, lässt sich im \u003ca href=\"https://www.anthropic.com/claude-opus-5-5\"\u003eAbschnitt zur Sicherheit in der Ankündigung von Claude Opus 5.5\u003c/a\u003e nachlesen. Prüfen Sie im Betrieb sowohl die Dateizugriffsrechte als auch die Ausführungsprotokolle.\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#einstellungen-f%C3%BCr-die-api-umstellung\" class=\"anchor\" id=\"einstellungen-für-die-api-umstellung\"\u003e\u003c/a\u003eEinstellungen für die API-Umstellung\u003c/h2\u003e\n\u003cp\u003eBei bestehenden API-Integrationen müssen neben dem Modellnamen auch andere Einstellungen geprüft werden. Die Modellkennung für die Claude API lautet \u003ccode\u003eclaude-opus-5-5\u003c/code\u003e. Andere Cloud-Plattformen verwenden jeweils eigene Modellkennungen.\u003c/p\u003e\n\u003cp\u003eDie offizielle Migrationsanleitung beschreibt die Änderung an den Thinking-Einstellungen wie folgt:\u003c/p\u003e\n\u003cblockquote\u003e\n\u003cp\u003eThinking can't be disabled\u003c/p\u003e\n\u003c/blockquote\u003e\n\u003cp\u003eQuelle ist \u003ca href=\"https://platform.claude.com/docs/en/models/opus-5-5/migration-guide\"\u003eMigrating to Claude Opus 5.5\u003c/a\u003e von Anthropic. Das bedeutet, dass eine Einstellung zum Deaktivieren von Thinking nicht unterstützt wird.\u003c/p\u003e\n\u003col\u003e\n\u003cli\u003ePrüfen Sie, ob in bestehenden Anfragen eine Einstellung zum Deaktivieren von Thinking verwendet wird. Opus 5.5 lehnt diese Einstellung ab.\u003c/li\u003e\n\u003cli\u003eGeben Sie die Thinking-Intensität mit \u003ccode\u003eeffort\u003c/code\u003e ausdrücklich an. Der Standardwert bei Opus 5.5 ist \u003ccode\u003emedium\u003c/code\u003e.\u003c/li\u003e\n\u003cli\u003ePrüfen Sie Einstellungen, die bestimmte Tool-Aufrufe erzwingen. Nicht unterstützte Einstellungen führen zu Anfragefehlern.\u003c/li\u003e\n\u003cli\u003eUnterscheiden und verarbeiten Sie Antwortblöcke anhand ihres \u003ccode\u003etype\u003c/code\u003e. Der erste Block enthält nicht immer den Antworttext.\u003c/li\u003e\n\u003cli\u003eMessen Sie Kosten und Bearbeitungszeit für dieselbe Aufgabe erneut. Thinking-Token werden ebenfalls zum Ausgabepreis berechnet.\u003c/li\u003e\n\u003c/ol\u003e\n\u003cp\u003eZum Zeitpunkt der Veröffentlichung wurde auch die Unterstützung durch AWS, Google Cloud und Microsoft Azure angekündigt. Modellkennungen und Bedingungen für die Tool-Unterstützung können je nach Plattform unterschiedlich sein. Prüfen Sie die Migrationsanleitung für das Modell, das Sie in Ihrer bisherigen Integration verwenden.\u003c/p\u003e\n\u003ch2\u003e\n\u003ca href=\"#h%C3%A4ufige-fehler\" class=\"anchor\" id=\"häufige-fehler\"\u003e\u003c/a\u003eHäufige Fehler\u003c/h2\u003e\n\u003cp\u003eBei Preis- und Leistungsangaben muss klar sein, was jeweils gemessen wurde. Tokenpreis, Kosten pro Aufgabe und Bewertungsergebnis sind unterschiedliche Kennzahlen. Die folgende Unterscheidung hilft, die Vergleichsbedingungen im Blick zu behalten.\u003c/p\u003e\n\u003cdiv class=\"overflow-x-auto\"\u003e\u003ctable\u003e\n\u003cthead\u003e\n\u003ctr\u003e\n\u003cth\u003eNaheliegende Fehlinterpretation\u003c/th\u003e\n\u003cth\u003eBestätigte Bedeutung\u003c/th\u003e\n\u003c/tr\u003e\n\u003c/thead\u003e\n\u003ctbody\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Naheliegende Fehlinterpretation\"\u003eJede Rechnung fällt um 40 % niedriger aus\u003c/td\u003e\n\u003ctd data-label=\"Bestätigte Bedeutung\"\u003eSchätzung für typische Aufgaben mit Standardeinstellungen\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Naheliegende Fehlinterpretation\"\u003eMit Cache sinken die Gesamtkosten um 60 %\u003c/td\u003e\n\u003ctd data-label=\"Bestätigte Bedeutung\"\u003eNur der Preis für Cache-Lesevorgänge wurde um 60 % gesenkt\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Naheliegende Fehlinterpretation\"\u003eDie Leistung ist um 14,1 % gestiegen\u003c/td\u003e\n\u003ctd data-label=\"Bestätigte Bedeutung\"\u003eDas Ergebnis bei Terminal-Bench ist um 14,1 Prozentpunkte gestiegen\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Naheliegende Fehlinterpretation\"\u003eJede Aufgabe ist 30 % schneller erledigt\u003c/td\u003e\n\u003ctd data-label=\"Bestätigte Bedeutung\"\u003eDie Ausgabegenerierung ist um mehr als 30 % schneller geworden\u003c/td\u003e\n\u003c/tr\u003e\n\u003ctr\u003e\n\u003ctd data-label=\"Naheliegende Fehlinterpretation\"\u003eTatsächliche Vorfälle sind um 85 % zurückgegangen\u003c/td\u003e\n\u003ctd data-label=\"Bestätigte Bedeutung\"\u003eVersuche, Grenzen in einer bestimmten Bewertung zu umgehen, sind um etwa 85 % zurückgegangen\u003c/td\u003e\n\u003c/tr\u003e\n\u003c/tbody\u003e\n\u003c/table\u003e\u003c/div\u003e\n\u003ch2\u003e\n\u003ca href=\"#kostenvergleich-pro-abgeschlossener-aufgabe\" class=\"anchor\" id=\"kostenvergleich-pro-abgeschlossener-aufgabe\"\u003e\u003c/a\u003eKostenvergleich pro abgeschlossener Aufgabe\u003c/h2\u003e\n\u003cp\u003eVergleichen Sie bei der Modellwahl die Kosten pro Aufgabe, die die Überprüfung bestanden hat. Am Tokenpreis allein lässt sich der Aufwand für erneute Versuche und Korrekturen nur schwer erkennen. So lassen sich die veröffentlichten Zahlen mit der tatsächlichen Arbeit vergleichen.\u003c/p\u003e\n\u003cp\u003eDazu werden die gesamten Ausführungskosten durch die Zahl der Aufgaben geteilt, die die Überprüfung bestanden haben. Beziehen Sie auch die Kosten fehlgeschlagener Versuche in die gesamten Ausführungskosten ein. Für den Vergleich ist es hilfreich, die Zeit für die menschliche Überprüfung als eigenen Posten zu erfassen.\u003c/p\u003e\n\u003cul\u003e\n\u003cli\u003eDieselbe Aufgabenliste und dieselben Abschlusskriterien verwenden\u003c/li\u003e\n\u003cli\u003eKosten für reguläre Eingabe, Cache und Ausgabe getrennt erfassen\u003c/li\u003e\n\u003cli\u003eGesamtkosten einschließlich fehlgeschlagener und erneuter Versuche erfassen\u003c/li\u003e\n\u003cli\u003eFesthalten, ob die abschließende Überprüfung bestanden wurde\u003c/li\u003e\n\u003cli\u003eAusführungszeit und Zeit für menschliche Korrekturen getrennt erfassen\u003c/li\u003e\n\u003c/ul\u003e\n","tags":["KI-Agent","Anthropic","KI Entwicklung","Claude","Programmieragent"],"faqs":[{"question":"Wann wurde Claude Opus 5.5 veröffentlicht?","answer":"Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht."},{"question":"Wie hoch sind die regulären API-Preise für Claude Opus 5.5?","answer":"Zum Zeitpunkt der Veröffentlichung kosteten 1 Million Eingabe-Token 4 Dollar und 1 Million Ausgabe-Token 20 Dollar. Beide Preise sind jeweils 20 % niedriger als bei Opus 5."},{"question":"Sinken die Kosten immer um 40 %?","answer":"Die 40 % sind eine Schätzung von Anthropic für typische Aufgaben. Die tatsächliche Ersparnis hängt von der Token-Nutzung und der Cache-Nutzung ab."},{"question":"Wie stark ist der Preis für Cache-Lesezugriffe gesunken?","answer":"Er ist von 0,50 Dollar auf 0,20 Dollar pro 1 Million Token gesunken. Das entspricht einer Senkung des Preises für Lesezugriffe um 60 %. Die Kosten für die Cache-Erstellung müssen gesondert geprüft werden."},{"question":"Wie lautet der genaue Name der Bewertung für die Computernutzung?","answer":"Die Bewertung heißt in der offiziellen Ankündigung OSWorld 2.1. Opus 5.5 erreichte 81,8 % und ist mit „partial“ gekennzeichnet."},{"question":"Bedeuten die 85 % bei der Sicherheit, dass die Zahl der Vorfälle gesunken ist?","answer":"Es bedeutet, dass Versuche, Isolationsgrenzen zu umgehen, in einer bestimmten Bewertung um etwa 85 % zurückgegangen sind. Es bezeichnet keine Verringerung der Vorfälle im tatsächlichen Betrieb."},{"question":"Reicht es, in der bestehenden API nur den Modellnamen zu ändern?","answer":"Je nach den bisherigen Anfrageeinstellungen sind weitere Anpassungen nötig. Prüfen Sie in der Migrationsdokumentation die Reasoning-Einstellungen, erzwungene Tool-Aufrufe und die Verarbeitung von Antwortblöcken."},{"question":"Ist es auch über AWS und Google Cloud verfügbar?","answer":"In der Ankündigung zur Veröffentlichung wurde die Unterstützung für AWS, Google Cloud und Microsoft Azure genannt. Prüfen Sie die Modellkennungen und die Bedingungen für die Funktionsunterstützung auf der jeweiligen Plattform."},{"question":"Bedeuten eine höhere Ausgabegeschwindigkeit und eine kürzere Bearbeitungszeit dasselbe?","answer":"Das sind unterschiedliche Kennzahlen. Wenn neben der Ausgabegenerierung auch die Ausführung von Tools und Tests einbezogen wird, kann sich die gesamte Bearbeitungszeit unterscheiden."}],"sources":[{"url":"https://www.anthropic.com/claude-opus-5-5","title":"Anthropic, Introducing Claude Opus 5.5, 22. September 2026","type":"source"},{"url":"https://www.anthropic.com/claude/opus","title":"Anthropic, Informationen zum Claude Opus Modell und zu den Preisen","type":"source"},{"url":"https://platform.claude.com/docs/en/models/opus-5-5/migration-guide","title":"Claude Platform Docs, Migrating to Claude Opus 5.5","type":"source"},{"url":"https://platform.claude.com/docs/en/build-with-claude/prompt-caching","title":"Claude Platform Docs, Prompt caching","type":"source"}],"images":[{"id":1595,"url":"https://injoys.com/rails/active_storage/blobs/proxy/eyJfcmFpbHMiOnsiZGF0YSI6MjM5MjIsInB1ciI6ImJsb2JfaWQifX0=--9ab6a9e985c76b07acd43a43425994585ce87958/ai-15b093c3.webp","is_representative":true,"generation_method":"ai_photo","license":"ai_generated","mime_type":"image/webp","width":1536,"height":1024,"translations":{"ko":{"alt":"서버실에서 태블릿을 들고 열린 서버 랙을 살펴보는 엔지니어","caption":"실제 운영 비용은 토큰 사용량과 캐시 활용에 따라 달라집니다.","description":null},"en":{"alt":"Engineer holding a tablet and inspecting an open server rack in a server hall","caption":"Actual operating costs depend on token usage and cache use.","description":null},"ja":{"alt":"サーバールームでタブレットを持ち、開いたサーバーラックを確認するエンジニア","caption":"実際の運用コストはトークン使用量とキャッシュの活用次第で変わります。","description":null},"es":{"alt":"Ingeniero con una tableta inspecciona un rack de servidores abierto en una sala de servidores","caption":"El coste operativo real depende del uso de tokens y de la caché.","description":null},"id":{"alt":"Teknisi memegang tablet sambil memeriksa rak server terbuka di ruang server","caption":"Biaya operasional sebenarnya bergantung pada penggunaan token dan cache.","description":null},"pt":{"alt":"Engenheiro com um tablet inspeciona um rack de servidores aberto numa sala de servidores","caption":"O custo operacional real depende do uso de tokens e do aproveitamento do cache.","description":null},"zh-hant":{"alt":"工程師在伺服器機房手持平板，檢查開啟的伺服器機櫃","caption":"實際營運成本會隨權杖用量與快取使用情況而變動。","description":null},"de":{"alt":"Ingenieur hält ein Tablet und prüft ein offenes Serverrack in einem Serverraum","caption":"Die tatsächlichen Betriebskosten hängen von der Token-Nutzung und dem Cache-Einsatz ab.","description":null}}},{"id":1596,"url":"https://injoys.com/rails/active_storage/blobs/proxy/eyJfcmFpbHMiOnsiZGF0YSI6MjM5MjgsInB1ciI6ImJsb2JfaWQifX0=--677963acf29b560200099cc3de29dd3eebb74a30/ai-8bc52f98.webp","is_representative":false,"generation_method":"ai_semi","license":"ai_generated","mime_type":"image/webp","width":1536,"height":1024,"translations":{"ko":{"alt":"개발자가 테스트실에서 연결된 스마트폰 여러 대 앞에 앉아 태블릿을 확인한다.","caption":"기존 API를 전환할 때는 모델명과 함께 추론·도구 호출 설정을 점검해야 합니다.","description":null},"en":{"alt":"A developer checks a tablet at a test bench lined with connected phones.","caption":"When switching an existing API, check reasoning and tool-call settings as well as the model name.","description":null},"ja":{"alt":"開発者がテスト室で、接続された複数のスマートフォンを前にタブレットを確認している。","caption":"既存のAPIを切り替える際は、モデル名に加えて推論とツール呼び出しの設定も確認しましょう。","description":null},"es":{"alt":"Un desarrollador revisa una tableta ante una fila de teléfonos conectados en un laboratorio de pruebas.","caption":"Al cambiar una API existente, hay que revisar el nombre del modelo y los ajustes de razonamiento y llamadas a herramientas.","description":null},"id":{"alt":"Seorang pengembang memeriksa tablet di depan deretan ponsel yang terhubung di ruang pengujian.","caption":"Saat beralih dari API yang ada, periksa nama model serta pengaturan penalaran dan pemanggilan alat.","description":null},"pt":{"alt":"Um desenvolvedor verifica um tablet diante de uma fileira de celulares conectados em um laboratório de testes.","caption":"Ao migrar uma API existente, verifique o nome do modelo e as configurações de raciocínio e de chamadas de ferramentas.","description":null},"zh-hant":{"alt":"開發者在測試室裡，坐在一排已連接的手機前查看平板電腦。","caption":"轉換現有 API 時，除了模型名稱，也要檢查推理與工具呼叫設定。","description":null},"de":{"alt":"Ein Entwickler prüft ein Tablet vor einer Reihe angeschlossener Smartphones in einem Testlabor.","caption":"Bei der Umstellung einer bestehenden API sollten neben dem Modellnamen auch die Einstellungen für Schlussfolgerungen und Werkzeugaufrufe geprüft werden.","description":null}}}],"published_at":"2026-10-02T10:07:05+09:00","updated_at":"2026-10-02T10:07:05+09:00","license":"cc_by","translation_status":"reviewed","available_locales":["ko","en","ja","es"],"data_locales":["ko","en","ja","es","id","pt","zh-hant","de"],"url":"https://injoys.com/en/articles/claude-opus-5-5-pricing-performance-comparison"}