DeepSeek folgt OpenAI mit neuem Budget Modell

Ein Deepseek Wal

GPT-Images-2.0

Kurzfassung

Quellen

DeepSeek hat die stark verbesserte Version 0731 seines Budget-Modells V4 Flash veröffentlicht.
Das Modell erreicht durch Optimierungen fast das Leistungsniveau von OpenAIs GPT-5.6 Luna, ist aber rund 60 Prozent günstiger.
Dank eines extremen Rabatts von 98 Prozent auf zwischengespeicherte Anfragen lassen sich komplexe, wiederkehrende KI-Aufgaben nun massiv verbilligen.

Artificial Analysis – DeepSeek v4 Flash scores 50 on the Artificial Analysis Intelligence Index
X – DeepSeek Official API is now LIVE
X – Chubby über DeepSeek V4 Flash 0731

DeepSeek hat sein Budget-Modell V4 Flash mit dem Update auf die Version »0731« deutlich aufgewertet. Es schließt qualitativ fast zu OpenAIs GPT-5.6 Luna auf und kostet pro Aufgabe rund 60 Prozent weniger. Leistungssprung durch Post-Training Die neue Version erreicht im Artificial-Analysis-Index 50 Punkte. Damit verbessert sie sich im Vergleich zum April-Release um zehn Zähler und liegt nur noch einen Punkt hinter OpenAIs Budget-Modell GPT-5.6 Luna. Dieser Sprung gelang ausschließlich durch Optimierungen im Post-Training. + Quelle: artificialanalysis Die zugrundeliegende Architektur bleibt unverändert. Das Modell greift weiterhin auf 284 Milliarden Parameter zurück, von denen während der Inferenz 13 Milliarden aktiv sind. Das Kontextfenster fasst eine Million Token. Fokus auf komplexe Büroaufgaben Besonders bei agentenbasierten Arbeitsabläufen hat das Modell stark zugelegt. Im GDPval-Benchmark kletterte der Wert von 1.189 auf 1.559 Elo-Punkte. Es halluziniert seltener und benötigt für die gleichen Aufgaben zwölf Prozent weniger Token als sein Vorgänger. Über die offizielle API unterstützt DeepSeek V4 Flash »0731« nun nativ das Responses-API-Format und ist vollständig an Codex angepasst. Anzeige Aggressiver Rabatt im Cache OpenAI hatte die Preise für GPT-5.6 Luna kürzlich um 80 Prozent gesenkt. Dennoch bleiben Aufgaben mit DeepSeeks neuer Version nochmals deutlich günstiger laut Artificialanalysis. Ausschlaggebend dafür ist ein ungewöhnlich hoher Cache-Rabatt von 98 Prozent. Eine Million zwischengespeicherte Eingabe-Token kosten Entwickler dadurch nur noch 0,0028 US-Dollar. Wiederkehrende Agenten mit umfangreichen System-Prompts, großen Codebasen oder Dokumenten lassen sich so extrem günstig betreiben. Luna bleibt trotz des Preisvorteils von DeepSeek eine starke Konkurrenz. Es arbeitet schneller, unterstützt multimodale Eingaben und benötigt insgesamt weniger Token für die Antwortgenerierung.

Leser:innen sagen:

„Wie Black Mirror, nur philosophischer und näher an der Wirklichkeit.“, Lisa M.
„Jede Geschichte ist ein Gedankensprung in eine andere Zukunft.“, Stefan K.
„Beunruhigend schön. Eine literarische Simulation unserer nahen Zukunft.“, Albert B.

TRAUMWELT.exe ist kein gewöhnliches Buch. Es ist ein Blick durch den Spalt einer Tür, die sich längst geöffnet hat – in eine Welt, in der Maschinen träumen, Städte flüstern und Ethik verhandelbar geworden ist. Eine Sammlung visionärer Geschichten, die an der Schwelle zwischen Fiktion und Realität tanzen – so plausibel erzählt, dass du dich unweigerlich fragst: Ist das noch Zukunft oder schon Gegenwart?