Claude Opus 5: Erkennt das Modell, wenn es geprüft wird?
Anthropic hat am 24.07.2026 die 193-seitige System Card zu Claude Opus 5 veröffentlicht. Dazu ordnen wir die veröffentlichten Preise von Claude Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro und Grok 4.5 ein und analysieren Anthropics eigene Vergleichstabelle.
17:09Kernaussagen
- Anthropic hat am 24.07.2026 die 193-seitige System Card zu Claude Opus 5 veröffentlicht
- Wir haben das gesamte Dokument ausgewertet und zeigen, was vor den Benchmarktabellen steht: eine erfundene Zustimmung, nachgelieferte Begründungen, innere Zustände, ein Modell, das Prüfsituationen zu 95 % erkennt, und ein eigenes Kapitel zum Wohlergehen des Modells
- Dazu ordnen wir die veröffentlichten Preise von Claude Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro und Grok 4.5 ein und analysieren Anthropics eigene Vergleichstabelle
- Das Video sagt nicht, ob die Zahlen stimmen; es zeigt, wo sie stehen, welche Einschränkungen Anthropic selbst nennt und an welchen Stellen das UK AI Security Institute unabhängig geprüft hat
Kapitel
- Eine Zustimmung, die nie gegeben wurde
- Was das Modell kostet
- Siebzehn Tests, vier Modelle
- Drei simulierte Netzwerke
- Was das Modell denkt, während es schreibt
- Wenn die Begründung nachgeliefert wird
- Es erkennt, wann es geprüft wird
- Eine KI prüft den Bericht über eine andere
- Das Kapitel über das Wohlergehen des Modells
- Der Satz über sich selbst
- Es schreibt seine eigene Verfassung um
- Wenn ein Sprachmodell flucht
- Wofür wir die Hand nicht ins Feuer legen
- Was bleibt