Shieldstral: Mistrals kleines Open-Weight-Modell schlägt deutlich rechenintensivere Safety-Klassifikatoren

Mistrals neues 3B-Modell Shieldstral prüft KI-Eingaben und -Ausgaben auf Sicherheitsverstöße und ersetzt dabei feste Kategorien durch einfache Ja/Nein-Fragen in natürlicher Sprache. Mit nur drei Milliarden Parametern erreicht es in Benchmarks teils die Leistung von siebenmal größeren Modellen. Betreiber können zudem Prüfkriterien zur Laufzeit selbst formulieren, statt einem fremden Kategoriensystem ausgeliefert zu sein, und der lokale Betrieb ist möglich.

Der Artikel Shieldstral: Mistrals kleines Open-Weight-Modell schlägt deutlich rechenintensivere Safety-Klassifikatoren erschien zuerst auf The Decoder.

Leser:innen sagen:

„Wie Black Mirror, nur philosophischer und näher an der Wirklichkeit.“, Lisa M.
„Jede Geschichte ist ein Gedankensprung in eine andere Zukunft.“, Stefan K.
„Beunruhigend schön. Eine literarische Simulation unserer nahen Zukunft.“, Albert B.

TRAUMWELT.exe ist kein gewöhnliches Buch. Es ist ein Blick durch den Spalt einer Tür, die sich längst geöffnet hat – in eine Welt, in der Maschinen träumen, Städte flüstern und Ethik verhandelbar geworden ist. Eine Sammlung visionärer Geschichten, die an der Schwelle zwischen Fiktion und Realität tanzen – so plausibel erzählt, dass du dich unweigerlich fragst: Ist das noch Zukunft oder schon Gegenwart?