Article

Claude Code's Extended Thinking ist eine Zusammenfassung, kein authentisches Denken

Claude Anthropic Coding Agents AI Safety

Ein Sicherheitsforscher hat eine kritische Entdeckung über Claude Code gemacht: Die “Extended Thinking”-Logs, die für Audit-Trails gedacht sind, enthalten nicht das tatsächliche Denken des Modells.

Patrick McCanna inspizierte die lokalen Claude Code Logs und fand nur verschlüsselte Signaturen statt lesbarem Text. Die Dokumentation von Anthropic offenbart danach die wahre Natur: Claude verschlüsselt sein Reasoning in eine 600-Zeichen-Signatur, deren Schlüssel nur Anthropic besitzt. Was Nutzer erhalten ist eine Zusammenfassung des Denkprozesses, nicht das originale Reasoning.

Die wichtigsten Punkte:

  • Kein echter Audit-Trail: Die Logs auf deinem System sind für dich nicht zugänglich. Du kannst das Reasoning nicht lesen.
  • Enterprise-only Zugriff: Nur mit Enterprise-Vertrag erhältst du das vollständige Thinking.
  • Strg+O Output ist zusammengefasst: Der Output aus dem Extended Thinking Panel ist eine Zusammenfassung - wie eine JPEG als BMP gespeichert und bearbeitet. Daten gehen verloren.

Wer eine echte Audit-Spur für seine AI-Agenten braucht, muss auf Open-Source-Modelle setzen. Die Entwicklung zeigt wieder einmal, warum Open-Source-Modelle schneller Fortschritte machen müssen - Transparenz ist essentiell für vertrauenswürdige AI-Systeme.

Original-Artikel