
Forschende des MIT liefern eine mechanistische Erklärung dafür, warum die Leistung großer Sprachmodelle so verlässlich mit ihrer Größe steigt. Der Schlüssel liege in einem Phänomen namens Superposition.
Der Artikel Warum größere KI-Modelle besser werden: MIT-Studie führt Skalierungsgesetze auf „Superposition“ zurück erschien zuerst auf The Decoder.
