
OpenAI startet mit „Ultrafast“ einen neuen Inferenz-Modus, der GPT-5.6 Sol mit bis zu 750 Output-Tokens pro Sekunde ausliefert, angetrieben von Cerebras-Hardware aus der Zehn-Milliarden-Dollar-Kooperation. Zusammen mit Standard und Fast baut OpenAI damit eine dreistufige Preisarchitektur auf, die Geschwindigkeit zum eigenständigen Produkt macht.
Der Artikel 14x schneller: OpenAI launcht neuen „Ultrafast“-Modus für GPT-5.6 Sol erschien zuerst auf The Decoder.
