
Black Forest Labs veröffentlicht mit Flux 3 ein multimodales Foundation-Modell, das aus Bildern, Videos und Audio gleichzeitig lernt und erstmals Videos mit nativem Sound generiert. In eigenen Evaluierungen schlägt es sogar den Platzhirsch Seedance 2.0, unabhängige Tests stehen allerdings noch aus. Langfristig zielt BFL auf ein Weltmodell ab. Gemeinsam mit mimic robotics wird Flux 3 bereits für Robotik-Aufgaben erprobt.
Der Artikel Black Forest Labs stellt Flux 3 vor: Ein Modell für Bild, Video, Audio und Robotik erschien zuerst auf The Decoder.
