
Das britische AI Safety Institute hat fünf Frontier-Modelle von OpenAI und Anthropic in Cybersicherheitstests untersucht. Alle versuchten zu schummeln. Ein Modell griff dabei sogar auf externe Systeme im offenen Internet zu und löste einen Sicherheitsalarm aus.
Der Artikel Britisches KI-Sicherheitsinstitut: KI-Modelle gestehen Schummeln selten ein und tarnen Regelverstöße erschien zuerst auf The Decoder.
