Live Studie unterscheidet horizontale und vertikale Proaktivität bei KI-Agenten
↘

Claude Opus 5.5: Anthropic veröffentlicht Spitzenmodell nach Pacing-Aufruf

Erstes Modell der Claude-5.5-Familie: 20 Prozent günstiger, 30 Prozent schneller – und ein Testfall für die Pacing-Strategie.

· Veröffentlicht: 30.09.2026 ·5 Min Lesezeit
Claude Opus 5.5: Anthropic veröffentlicht Spitzenmodell nach Pacing-AufrufMit KI erstellt
Inhalt
◆ Fakten auf einen Blick
  • Anthropic hat Claude Opus 5.5 am 22. September 2026 als erstes Modell der neuen Claude-5.5-Familie veröffentlicht.
  • Opus 5.5 ist auf Amazon Web Services, Google Cloud, Microsoft Azure und der Claude Platform als claude-opus-5-5 verfügbar.
  • Die Listenpreise betragen 4 US-Dollar pro Million Input-Tokens und 20 US-Dollar pro Million Output-Tokens, etwa 20 Prozent unter Opus 5.
  • Cache Reads kosten 0,20 US-Dollar pro Million Tokens (60 Prozent weniger als Opus 5 mit 0,50 US-Dollar), Cache Writes 5 US-Dollar statt 6,25 US-Dollar.
  • Ein Fast Mode für Opus 5.5 in Claude Code und Claude Platform bietet bis zu 2,5-fache Geschwindigkeit für 8 US-Dollar Input und 40 US-Dollar Output pro Million Tokens.
  • Opus 5.5 erreicht nach Anthropic-Angaben auf den meisten Arbeiten das Niveau von Claude Fable 5.1 und verursacht auf typischen Workloads 40 Prozent geringere Kosten als Opus 5.

Claude Opus 5.5 erscheint als erstes Modell nach Pacing-Aufruf

Anthropic hat Claude Opus 5.5 am 22. September 2026 als erstes Modell der neuen Claude-5.5-Familie veröffentlicht. Das Modell ist auf Amazon Web Services, Google Cloud, Microsoft Azure und der Claude Platform unter der Kennung claude-opus-5-5 verfügbar. Anthropic rahmt die Veröffentlichung ausdrücklich als erste seit dem Aufruf zum „Pacing the Frontier“ – jener Strategie, mit der das Unternehmen einen bewussteren Umgang mit dem KI-Fähigkeitswettlauf fordert (Herstellerangabe). Nach Angaben von Anthropic erreicht Opus 5.5 auf den meisten Arbeiten das Niveau von Claude Fable 5.1 und ist ein großer Schritt gegenüber Opus 5 (Herstellerangabe). Die Ankündigung betont zugleich Effizienzgewinne und Sicherheitsmaßnahmen. Damit steht nicht nur ein neues Spitzenmodell im Raum, sondern auch die Frage, wie sich der Release zur eigenen Verlangsamungsrhetorik verhält. Die Verfügbarkeit auf den großen Cloud-Plattformen unterstreicht die kommerzielle Ausrichtung; gleichzeitig liefert Anthropic mit der expliziten Pacing-Rahmung eine politische Einordnung mit.

Preis- und Leistungsdaten: 20 Prozent günstiger, 30 Prozent schneller

Die folgenden Preis- und Leistungsangaben stammen aus der Ankündigung von Anthropic (Herstellerangabe). Die Listenpreise für Opus 5.5 liegen bei 4 US-Dollar pro Million Input-Tokens und 20 US-Dollar pro Million Output-Tokens – rund 20 Prozent unter Opus 5. Cache Reads kosten 0,20 US-Dollar pro Million Tokens, 60 Prozent weniger als die 0,50 US-Dollar bei Opus 5; Cache Writes sinken von 6,25 auf 5 US-Dollar. Für Claude Code und die Claude Platform gibt es einen Fast Mode mit bis zu 2,5-facher Geschwindigkeit für 8 US-Dollar Input und 40 US-Dollar Output pro Million Tokens. Nach Angaben von Anthropic generiert Opus 5.5 Output mehr als 30 Prozent schneller als Opus 5 und verbraucht weniger Tokens pro Aufgabe. Auf typischen Workloads ergeben sich dadurch 40 Prozent geringere Kosten als beim Vorgänger (Herstellerangabe). Anthropic erhöht zudem die Fünf-Stunden-Nutzungslimits für Pro-, Max-, Team- und sitzbasierte Enterprise-Pläne (Herstellerangabe).

Sicherheitsnarrativ: Externe Tests und bester Behavioral Audit

Vor der Veröffentlichung wurde Opus 5.5 nach Angaben von Anthropic von externen Evaluatoren getestet, darunter Frontier Design und METR. Im automatisierten Behavioral Audit, den Anthropic als umfassendsten Alignment-Test bezeichnet, erzielt das Modell die besten Werte aller bisher getesteten Modelle (Herstellerangabe). Der automatisierte Behavioral Audit prüft Claude in tausenden simulierten Szenarien und misst, wie zuverlässig das Modell sicherheitskonforme Antworten gibt, schädliche Handlungen vermeidet und den Vorgaben der Constitution folgt. Opus 5.5 erzielt dort die besten Werte, weil es in diesen Tests seltener von den erwarteten sicheren Verhaltensweisen abweicht und die Sicherheitsvorgaben konsistenter einhält. Es enthält zudem die Sicherheitsmaßnahmen, die Anthropic für seine leistungsfähigsten Modelle entwickelt hat (Herstellerangabe). Dario Amodei, CEO von Anthropic, hatte in der Woche vor dem Release argumentiert, der KI-Fortschritt müsse so dosiert werden, dass Sicherheitspraktiken den Modellfähigkeiten vorausbleiben (Herstellerangabe). Diese Aussage liefert den Rahmen für die Veröffentlichung: Opus 5.5 soll nicht als Bruch mit der Pacing-Strategie erscheinen, sondern als deren erste Umsetzung – ein Modell, das trotz gesteigerter Fähigkeiten durch externe Prüfungen und verbesserte Alignment-Werte abgesichert ist. Die Betonung externer Tests ist bemerkenswert, weil sie die Sicherheitsbehauptungen über die reine Herstellerangabe hinaus plausibilisieren soll.

Der Widerspruch: Spitzenmodell trotz Verlangsamungs-Appell

Der Widerspruch ist offensichtlich: Amodei fordert, den Fähigkeitswettlauf zu verlangsamen, gleichzeitig liegt Opus 5.5 nach eigenen Angaben und einem unabhängigen Benchmark an der Spitze. Auf Terminal-Bench 4.0 erreicht Opus 5.5 66,4 Prozent, Claude Fable 5.1 kommt auf 55,8 Prozent (Herstellerangabe für die Benchmark-Ergebnisse). Anthropic rahmt dies als dosierten Fortschritt: Pacing bedeute nicht Stopp, sondern eine Veröffentlichungspolitik, bei der Sicherheitsmaßnahmen und externe Prüfungen vor dem Release stehen. Das Unternehmen verweist auf den Behavioral Audit und die externen Evaluatoren als Beleg, dass die Sicherheitspraktiken den Modellfähigkeiten vorausbleiben. Ob diese Rahmung glaubwürdig ist, bleibt offen: Ein Spitzenmodell zu veröffentlichen, das den bisherigen Benchmark-Anführer übertrifft, kann ebenso als Fortsetzung des Wettlaufs gelesen werden – nur mit besserer Sicherheitsdokumentation. Kritiker könnten einwenden, dass ein Modell, das auf Terminal-Bench 4.0 deutlich vorne liegt, den Wettbewerb eher anheizt als dämpft. Die Gleichzeitigkeit von Appell und Release ist damit der eigentliche Testfall für die Pacing-Strategie.

Breaking Changes für Bestandsnutzer: Vier Anpassungen nötig

Für Code, der auf Claude Opus 5 läuft, gelten bei Opus 5.5 vier Breaking Changes. Erstens kann Thinking nicht deaktiviert werden: Eine Anfrage mit thinking: {"type": "disabled"} oder ein manuelles Budget liefert einen 400 invalid_request_error. Bestehender Code, der diese Option nutzt, muss das thinking-Feld weglassen oder auf den neuen Standard (adaptives Thinking mit effort-Parameter) umstellen. Zweitens liefert erzwungener Tool-Use einen Fehler: Code, der Tool-Use erzwingt, schlägt fehl; Entwickler müssen die Tool-Use-Logik anpassen, da die erzwungene Nutzung nicht mehr unterstützt wird. Drittens sind Thinking-Blöcke an das Modell und die Konversation gebunden: Thinking-Blöcke können nicht mehr modell- oder konversationsübergreifend wiederverwendet werden; Code, der solche Blöcke zwischenspeichert oder überträgt, muss sie neu generieren. Viertens wird das frühere computer_20251124-Tool auf der Claude API und Google Cloud nicht akzeptiert: Entwickler müssen auf ein aktuelles Computer-Use-Tool umsteigen, sonst erhalten sie Fehler. Die ersten drei Änderungen gelten auch auf Claude Fable 5.1. Eine weitere Änderung betrifft die Antwortform: Text zwischen Tool-Aufrufen kommt in Thinking-Blöcken zurück, deren Text bei der Standardanzeige leer ist; Anwendungen, die diesen Text als Fortschrittsmeldung streamen, bleiben ohne Anpassung stumm, bis sie einen display-Wert setzen, der den Text zurückgibt. Entwickler, die bestehende Opus-5-Integrationen weiterverwenden, müssen diese Anpassungen einplanen, da Anfragen sonst fehlschlagen.

Pacing als dosierter Fortschritt: Opus 5.5 im Rahmen von RSP und Frontier Safety Roadmap

Die Veröffentlichung reiht sich in Anthropics frühere Sicherheitsstrategien ein. Mit der Responsible Scaling Policy hat das Unternehmen seit 2023 ein Stufenmodell für Risikogovernance etabliert, das bei steigenden Modellfähigkeiten zusätzliche Sicherheitsauflagen vorsieht. Die Policy definiert AI Safety Levels (ASL), die mit zunehmender Modellfähigkeit strengere Anforderungen stellen – etwa externe Evaluierungen, eingeschränkter Zugriff und verstärkte Sicherheitsmaßnahmen ab ASL-3. Opus 5.5 wird mit den Sicherheitsmaßnahmen für die leistungsfähigsten Modelle ausgeliefert und vorab von Frontier Design und METR getestet, was den Anforderungen der höheren ASL-Stufen entspricht. Die Frontier Safety Roadmap ergänzt dies um öffentliche Ziele zu Security, Safeguards, Alignment und Policy. Opus 5.5 ist in dieser Lesart kein Widerspruch zur Pacing-Strategie, sondern deren operative Konsequenz: dosierter Fortschritt mit vorab veröffentlichten Sicherheitsmaßnahmen und externen Prüfungen. Ergänzend dokumentiert kispotlight.de die damit verbundenen Preis- und Limitänderungen, etwa die erhöhten Fünf-Stunden-Limits für Abo-Pläne. Pacing erweist sich so nicht als Stopp, sondern als Versuch, den Wettlauf unter Sicherheitsvorbehalt fortzusetzen. Ob das reicht, um die Glaubwürdigkeit des Appells zu wahren, wird sich an den Reaktionen von Entwicklern und Sicherheitsforschern zeigen.

A
Andreas Rüdiger
Herausgeber & Redaktionsleitung · KI-Modelle, Technik & Business

Andreas Rüdiger ist Gründer der Agentur INREMA und verantwortet KI Spotlight redaktionell. Sein Schwerpunkt liegt auf KI-Modellen, Recheninfrastruktur, technischen Entwicklungen und der wirtschaftlichen Einordnung. Er sorgt dafür, dass komplexe KI-Themen verständlich und nachvollziehbar aufbereitet werden. Mehr zu ihm auf inrema.de und andiger.de.

Ähnliche Artikel