
Sicherheitsforscher um Alexander Panfilov haben eine Schwachstelle in den APIs von OpenAI, Anthropic und Google gefunden, über die sich verschlüsselte Reasoning-Traces extrahieren und zwischen Modellen übertragen lassen. Ein Scan öffentlicher Sessions förderte Dutzende Passwörter und API-Schlüssel zutage. Die Traces zeigen zudem, dass die angezeigten Denk-Zusammenfassungen oft verschleiern, was die Modelle tatsächlich tun.
Der Artikel „Aber Marinade“: Forscher extrahieren versteckte Denkprozesse von ChatGPT, Claude und Co. erschien zuerst auf The Decoder.
