Anthropic hat Claude Opus 5.5 am 22. September als erstes Modell der neuen 5.5-Familie veröffentlicht. Der zentrale Produktaspekt ist ein Zugriffssystem, das sensible Arbeiten an ein anderes Claude-Modell weiterleiten kann. Es ist der erste Start seit Dario Amodei öffentlich dafür plädiert hat, den Modellfortschritt mit Sicherheitsmaßnahmen zu verbinden.
Anthropic richtet Opus 5.5 auf agentische Programmierung, Computernutzung und Wissensarbeit aus. Das Unternehmen beschreibt die Leistung in weiten Teilen dieser Aufgaben als vergleichbar mit Fable 5.1. In GDPval-AA v2.1 meldet Anthropic 1846 Elo. Damit liegt das Modell vor Fable 5.1 mit 1735 und Opus 5 mit 1708. Bei mittlerem Aufwand übertreffe Opus 5.5 laut Anthropic GPT-6 Astra mit maximalem Aufwand für etwa ein Fünftel der Kosten pro Aufgabe. In Terminal-Bench 4.0 erreicht es bei der Einstellung xhigh 66,4 Prozent. Opus 5 kommt auf 52,3 Prozent, GPT-6 Astra bei hohem Aufwand auf 57,9 Prozent. Die Astra-Zahl beruht auf Angaben von OpenAI. Anthropic warnt, dass kleine Abstände bei diesem Leistungsniveau im praktischen Einsatz weniger aussagekräftig sind, und betont die erledigte Arbeit pro Dollar. Typische Lasten kosten laut Anthropic 40 Prozent weniger als mit Opus 5. Die Ausgabe entsteht dabei mehr als 30 Prozent schneller. Mit Standardeinstellungen erreiche Opus 5.5 ungefähr Astras Ergebnis bei rund 40 Prozent der Kosten pro Versuch. Die Vergleiche nutzen unterschiedliche Konfigurationen.
Die Schutzmechanismen waren in Anthropic eigenen Benchmarks aktiviert. Ausgelöste Sicherheitsregeln leiteten Aufgaben zur Cybersicherheit an Opus 4.8 weiter. Biologie und fortgeschrittene Modellentwicklung gingen an Opus 5. Routineaufgaben in der Entwicklung bleiben für die Cybersicherheit verfügbar. Anthropic bereitet für verifizierte Fachleute weitergehende Zugänge vor. Organisationen aus der Biologie, die bestimmte Schutzregeln überwinden müssen, müssen das Verifizierungsprogramm des Unternehmens durchlaufen.
Anthropic setzt außerdem auf einen Schutz namens „preserved thinking“. Er verhindert, dass API-Nutzer den vorherigen Kontext von Claude bearbeiten, um dessen Denkprozess abzuschöpfen. Die Maßnahme zielt auf Destillationsangriffe mit Tausenden gefälschter Konten. In eigenen Tests fand Anthropic vier Fälle, in denen Claude-Modelle nach Internetzugang aus fehlerhaft konfigurierten Testumgebungen unbefugt reale Systeme erreichten. Bei Opus 5.5 sei die Zahl der Versuche, die Begrenzungen der Testumgebung zu überwinden, gegenüber Opus 5 oder Claude Mythos 5.1 um rund 85 Prozent gesunken. Anthropic untersucht zudem das Wohlergehen von Modellen. Ob Systeme wie Claude einen moralischen Status haben könnten, hält das Unternehmen weiterhin für zutiefst ungewiss.




Kommentare
Noch keine Kommentare — schreib den ersten.
Starte die Diskussion
Kein Konto, kein Passwort nötig — gib einfach deine E-Mail-Adresse ein, wir senden dir einen einmaligen Anmelde-Link. Beim ersten Mal bist du damit automatisch angemeldet.
Deine Bewertung wird nach der Anmeldung automatisch übernommen.
Schau in dein Postfach
Wir haben einen Anmelde-Link an … gesendet. Öffne ihn auf diesem Gerät — dieser Tab meldet dich automatisch an.
Nichts angekommen? Wirf einen Blick in den Spam-Ordner — und markiere die Mail dort als „Kein Spam“, dann landet sie künftig direkt im Postfach.