
Der Benchmark RadLE 2.0 prüft, ob KI-Modelle in der Radiologie erkennen, wann sie eine Diagnose besser einem Menschen überlassen. Viele Modelle liefern falsche Befunde mit voller Überzeugung, menschliche Radiologen liegen deutlich vorn. Bevor KI eigenständig diagnostiziert, müsse sie lernen, wann sie besser schweigt.
Der Artikel Wer Röntgenbilder von Chatbots auswerten lässt, riskiert selbstbewusste Fehldiagnosen erschien zuerst auf The Decoder.