Microsoft Research zeigt mit Lens, wie sich Bildmodelle effizienter trainieren lassen

Stilisiertes Render eines schwebenden Kameraobjektivs über einer leuchtenden Plattform vor Bergpanorama mit See, holografischen UI-Elementen und Schriftzug „Microsoft Lens" unten rechts.

Microsoft Research stellt mit Lens ein Text-zu-Bild-Modell mit nur 3,8 Milliarden Parametern vor. In Benchmarks schlägt es deutlich größere Konkurrenten mit 80 Milliarden Parametern, bei einem Fünftel des Trainingsaufwands. Entscheidend sind 800 Millionen von GPT-4.1 erzeugte, ausführliche Bildunterschriften statt vager Web-Alt-Texte. Code und Gewichte sind unter MIT-Lizenz offen verfügbar.

Der Artikel Microsoft Research zeigt mit Lens, wie sich Bildmodelle effizienter trainieren lassen erschien zuerst auf The Decoder.

Leser:innen sagen:

„Wie Black Mirror, nur philosophischer und näher an der Wirklichkeit.“, Lisa M.
„Jede Geschichte ist ein Gedankensprung in eine andere Zukunft.“, Stefan K.
„Beunruhigend schön. Eine literarische Simulation unserer nahen Zukunft.“, Albert B.

TRAUMWELT.exe ist kein gewöhnliches Buch. Es ist ein Blick durch den Spalt einer Tür, die sich längst geöffnet hat – in eine Welt, in der Maschinen träumen, Städte flüstern und Ethik verhandelbar geworden ist. Eine Sammlung visionärer Geschichten, die an der Schwelle zwischen Fiktion und Realität tanzen – so plausibel erzählt, dass du dich unweigerlich fragst: Ist das noch Zukunft oder schon Gegenwart?