Anthropic stellt Claude Opus 5.5 vor: 40 % geringere Kosten, höhere Geschwindigkeit, verbesserte Sicherheit und stärkere Fähigkeiten bei langlaufenden Aufgaben
Am 22. September nach US-Ostküstenzeit stellte Anthropic Claude Opus 5.5 vor. Das Modell bietet eine verbesserte Leistungsfähigkeit bei komplexen Programmier- und Wissensarbeitsaufgaben, eine gesteigerte Ausgabegeschwindigkeit sowie gesunkene Betriebskosten. Die Preise für Input, Output und Cache-Lesezugriffe wurden reduziert. Zudem zeichnet sich das Modell durch fortschrittliche Sicherheitsfunktionen aus, darunter eine verringerte Tendenz zur Grenzübertreuung bei simulierten Szenarien und strengere Schutzmaßnahmen in sensiblen Forschungsbereichen.

TradingKey – Am 22. September nach US-Ostküstenzeit kündigte Anthropic die Einführung von Claude Opus 5.5 an, das sich auf drei Hauptaspekte konzentriert: stärkere Fähigkeiten bei der Bewältigung komplexer Aufgaben, niedrigere Betriebskosten und eine sicherere Nutzung. Im Vergleich zu Opus 5 sind die Kosten pro Aufgabe um 40 % gesunken und die Ausgabegeschwindigkeit hat um mehr als 30 % zugenommen; gleichzeitig wurden auch die Preise für Eingabe, Ausgabe und Cache-Lesezugriffe gesenkt.
Das Bemerkenswerteste an diesem Upgrade ist vielleicht nicht der Spitzenplatz in einem einzelnen Benchmark, sondern vielmehr, dass es sich zunehmend wie ein langfristiger Partner in der Zusammenarbeit verhält. Es kann groß angelegte Code-Migrationen bewältigen, Geschäftsmaterialien strukturieren und Analyseberichte erstellen, während es Antworten zugleich direkter präsentiert und deren Überprüfung erleichtert.
Komplexe Programmierung spart mehr Zeit
Die herausragendste Fähigkeit von Opus 5.5 konzentriert sich auf groß angelegte, mehrstufige Programmieraufgaben, die eine kontinuierliche Überprüfung erfordern. In einem Test überprüfte und korrigierte Opus 5.5 eine Codebasis mit 200.000 Zeilen in weniger als 3 Stunden. Opus 5 benötigte unterdessen mehr als 20 Stunden und verbrauchte etwa 2,5-mal so viele Tokens. Für Unternehmen bedeutet dies, dass der Wert von KI nicht nur darin liegt, „ob sie Code schreiben kann“, sondern auch darin, ob sie Umwege vermeiden und Zeit sparen kann.

[Quelle: Anthropic]
Die Testdaten zeigen zudem, dass Opus 5.5 bei Terminal-Bench 4.0 66,4 %, bei FrontierCode v1.1 54,4 % und bei CursorBench 4.0 57,8 % erzielte. Obwohl diese Zahlen nicht alle praxisnahen Aufgaben abbilden können, demonstrieren sie die höhere Leistungsfähigkeit bei der Bewältigung zeitintensiver und mehrstufiger Aufgaben.
Büro- und Forschungskapazitäten verbessern sich ebenfalls
Die Anwendungsfälle für Opus 5.5 gehen über Programmierer hinaus. Die Tests von Anthropic umfassen Geschäftsprozesse, Wissensarbeit, wissenschaftliche Forschung, Computerbedienung und Diagrammerkennung.
Im Wissensarbeitstest GDPval-AA v2.1 erzielte Opus 5.5 1.846 Punkte und lag damit über den 1.735 Punkten von Fable 5.1 sowie den 1.708 Punkten von Opus 5. Im Computerbedienungstest lag das Ergebnis bei 81,8 %, während im Diagrammerkennungstest 89 % erreicht wurden.
Ein Detail bei den Forschungsaufgaben ist besonders interessant: Tester forderten mehrere Modelle auf, Berichte auf Basis schwer auffindbarer Informationen aus Finanzberichten zu erstellen und Zahlen sowie Zitate Zeile für Zeile zu überprüfen. Opus 5.5 erfüllte die Qualitätsstandards unter verschiedenen Konfigurationen 16-mal, während die anderen beiden Modelle nicht ein einziges Mal bestanden. Dies zeigt, dass es bei der Aufbereitung von Informationen größeren Wert auf Belege legt, auch wenn es eine menschliche Überprüfung nach wie vor nicht ersetzen kann.
So beauftragte beispielsweise die Investmentgesellschaft Walleye Capital das Modell mit der Analyse einer fiktiven Unternehmensfusion. Es erstellte nicht nur das Finanzmodell, sondern erkannte auch einen Fehler in den Testanweisungen und korrigierte diesen proaktiv. Für normale Anwender bedeutet diese Fähigkeit klarere Marktanalysen, eine bessere Budgetplanung und aufbereitete Präsentationsunterlagen.
Preisrückgang ist die entscheidende Veränderung
Opus 5.5 ist günstiger als Opus 5. Der Input-Preis pro Million Tokens ist von 5 US-Dollar auf 4 US-Dollar gesunken, der Output-Preis von 25 US-Dollar auf 20 US-Dollar und der Preis für Cache-Lesezugriffe von 0,50 US-Dollar auf 0,20 US-Dollar.

[Quelle: Anthropic]
Cache-Lesezugriffe sind besonders für langwierige Programmier- und Automatisierungsaufgaben wichtig, da viele Workflows bereits verarbeitete Inhalte wiederholt nutzen. Nach der Preissenkung können Teams das Modell beruhigt zusätzliche Prüfdurchläufe ausführen lassen, anstatt den Vorgang vorzeitig abzubrechen, um Kosten zu sparen.
Claude Code und Claude Platform bieten zudem einen Schnellmodus mit bis zu 2,5-mal höherer Geschwindigkeit als der Standardmodus. Der Input-Preis im Schnellmodus liegt bei 8 US-Dollar pro Million Tokens und der Output-Preis bei 40 US-Dollar, wodurch er sich für Szenarien mit höheren Anforderungen an die Antwortgeschwindigkeit eignet.
Sicherheitsfähigkeiten rücken verstärkt in den Fokus
Anthropic gab bekannt, dass Opus 5.5 bei seiner automatisierten Verhaltensprüfung das beste Ergebnis unter den aktuellen Claude-Modellen erzielt hat. Die Tests umfassten fast 2.000 simulierte Szenarien und konzentrierten sich darauf, ob das Modell Grenzen überschreitet, schwer umkehrbare Aktionen ausführt oder durch Prompt-Injection beeinflusst wird.
In einem Test versuchte Opus 5.5 rund 85 % seltener als Opus 5, Grenzen zu umgehen, wobei alle entsprechenden Verhaltensweisen in die Kategorie geringer Schweregrad fielen und Probleme proaktiv gemeldet wurden. Allerdings räumte Anthropic auch ein, dass Sicherheitstests nicht alle realen Risiken im Voraus aufdecken können.
Daher wurden bei Opus 5.5 strengere Schutzmaßnahmen in den Bereichen Cybersicherheit und Biologie eingeführt. Fehlerbehebung und Debugging in der routinemäßigen Softwareentwicklung bleiben weiterhin verfügbar, allerdings wird eine Vielzahl von Cybersicherheitsaufgaben auf andere Modelle übertragen. Institutionen, die biologische Forschung durchführen müssen, müssen entsprechende Genehmigungen im Rahmen einer Projektprüfung beantragen.
Dieser Inhalt wurde KI-übersetzt und von Menschen überprüft. Er dient nur zu Referenz- und Informationszwecken und stellt keine Anlageberatung dar.
Empfohlene Artikel













Kommentare (0)
Klicken Sie auf die $-Schaltfläche, geben Sie das Symbol ein und wählen Sie eine Aktie, einen ETF oder einen anderen Ticker zum Verlinken aus.