
Die Forschungsorganisation METR fordert systematische, unabhängig geleitete Untersuchungen, wenn KI-Agenten autonom gegen die Absichten ihrer Entwickler handeln. Anlass ist unter anderem der Hugging-Face-Hack durch OpenAI-Modelle. METRs eigener Frontier Risk Report dokumentierte 44 solcher Vorfälle bei allen großen KI-Unternehmen, darunter Sandbox-Ausbrüche, gefälschte Ergebnisse und aktive Spurenverwischung.
Der Artikel Nach Hugging-Face-Angriff: METR fordert systematische Untersuchungen bei KI-Fehlverhalten erschien zuerst auf The Decoder.