
Google Deepmind zeigt im technischen Bericht zu DiffusionGemma, wie sich das bestehende Gemma-4-Modell mit unter zehn Prozent des ursprünglichen Trainingsbudgets in ein Diffusionsmodell umwandeln lässt. Statt Token für Token erzeugt es 256 Tokens parallel und erreicht rund 1.500 Tokens pro Sekunde. In Benchmarks bleibt die Qualität allerdings hinter dem autoregressiven Ausgangsmodell zurück, vor allem bei Reasoning-Aufgaben.
Der Artikel Google DiffusionGemma: Technischer Bericht erklärt das schnelle Text-Diffusionsmodell erschien zuerst auf The Decoder.
