Künstliche Intelligenz28.07.202617:09

Claude Opus 5: Erkennt das Modell, wenn es geprüft wird?

Anthropic hat am 24.07.2026 die 193-seitige System Card zu Claude Opus 5 veröffentlicht. Dazu ordnen wir die veröffentlichten Preise von Claude Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro und Grok 4.5 ein und analysieren Anthropics eigene Vergleichstabelle.

17:09
Video abspielen

Kernaussagen

  • Anthropic hat am 24.07.2026 die 193-seitige System Card zu Claude Opus 5 veröffentlicht
  • Wir haben das gesamte Dokument ausgewertet und zeigen, was vor den Benchmarktabellen steht: eine erfundene Zustimmung, nachgelieferte Begründungen, innere Zustände, ein Modell, das Prüfsituationen zu 95 % erkennt, und ein eigenes Kapitel zum Wohlergehen des Modells
  • Dazu ordnen wir die veröffentlichten Preise von Claude Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro und Grok 4.5 ein und analysieren Anthropics eigene Vergleichstabelle
  • Das Video sagt nicht, ob die Zahlen stimmen; es zeigt, wo sie stehen, welche Einschränkungen Anthropic selbst nennt und an welchen Stellen das UK AI Security Institute unabhängig geprüft hat

Kapitel

  1. Eine Zustimmung, die nie gegeben wurde
  2. Was das Modell kostet
  3. Siebzehn Tests, vier Modelle
  4. Drei simulierte Netzwerke
  5. Was das Modell denkt, während es schreibt
  6. Wenn die Begründung nachgeliefert wird
  7. Es erkennt, wann es geprüft wird
  8. Eine KI prüft den Bericht über eine andere
  9. Das Kapitel über das Wohlergehen des Modells
  10. Der Satz über sich selbst
  11. Es schreibt seine eigene Verfassung um
  12. Wenn ein Sprachmodell flucht
  13. Wofür wir die Hand nicht ins Feuer legen
  14. Was bleibt

Quellen und weiterführende Links