
ProactiveBench testet, ob multimodale Sprachmodelle bei unzureichenden visuellen Informationen um Hilfe bitten. 22 getestete Modelle zeigen kaum proaktives Verhalten. Ein einfaches Reinforcement-Learning-Training weist jedoch einen möglichen Ausweg.
Der Artikel Benchmark zeigt: Wenn KI-Modellen visuelle Daten fehlen, wird einfach geraten erschien zuerst auf The Decoder.
