Streaming-Sprachmodell hört dauerhaft mit und entscheidet selbst, wann es spricht

Abstrakte Darstellung bunter Audio-Wellenformen, die durch geometrische Strukturen fließen und sich dabei transformieren.

Das KI-Modell „Audio-Interaction“ hört permanent mit und entscheidet alle 0,4 Sekunden, ob es schweigt oder spricht. Anders als GPT-4o oder Qwen3.5-Omni wartet es nicht auf das Ende einer Aufnahme, sondern übersetzt, transkribiert, chattet und erkennt Alltagsgeräusche wie Husten in einem einzigen Stream. Code und eine Anleitung zum Download der Gewichte stehen auf GitHub bereit.

Der Artikel Streaming-Sprachmodell hört dauerhaft mit und entscheidet selbst, wann es spricht erschien zuerst auf The Decoder.

Leser:innen sagen:

„Wie Black Mirror, nur philosophischer und näher an der Wirklichkeit.“, Lisa M.
„Jede Geschichte ist ein Gedankensprung in eine andere Zukunft.“, Stefan K.
„Beunruhigend schön. Eine literarische Simulation unserer nahen Zukunft.“, Albert B.

TRAUMWELT.exe ist kein gewöhnliches Buch. Es ist ein Blick durch den Spalt einer Tür, die sich längst geöffnet hat – in eine Welt, in der Maschinen träumen, Städte flüstern und Ethik verhandelbar geworden ist. Eine Sammlung visionärer Geschichten, die an der Schwelle zwischen Fiktion und Realität tanzen – so plausibel erzählt, dass du dich unweigerlich fragst: Ist das noch Zukunft oder schon Gegenwart?