Schlagwort: OpenRouter

  • OpenAI Modelle GPT-5.6 zum halben Preis bei OpenRouter

    Die Erde und der Mond mit günstigen Preisen

    GPT-Images-2.0

    Kurzfassung

    Quellen

    OpenRouter bietet die KI-Modelle GPT-5.6 Terra und Luna derzeit zum halben Preis an.
    Die zeitlich befristete Rabattaktion entstand durch eine offizielle Partnerschaft mit OpenAI.
    Der Preisnachlass von 50 Prozent gilt für alle API-Kostenpunkte und schließt die Pro-Versionen der Modelle ein.
    Voraussetzung für die Ersparnis ist das direkte Routing über OpenAI als First-Party-Provider.

    X / Ankündigung von OpenRouter

    Entwickler können die OpenAI-Modelle GPT-5.6 Terra und Luna derzeit zum halben Preis nutzen. Die Plattform OpenRouter hat in Partnerschaft mit OpenAI eine zeitlich begrenzte Rabattaktion gestartet, die exklusiv für den direkten Provider-Zugriff gilt.

    Twitter Beitrag – Cookies links unten aktivieren.

    GPT-5.6 Terra & Luna are 50% off exclusively on OpenRouter! pic.twitter.com/ZboYlpvP6k — OpenRouter (@OpenRouter) July 27, 2026 Günstigere Schnittstellen-Nutzung Die Preisreduzierung umfasst sämtliche anfallenden Kosten bei der API-Nutzung. Nutzer zahlen nur die Hälfte für die Verarbeitung von Eingabe- und Ausgabetokens sowie für das Caching. Auch die erweiterten Pro-Versionen der beiden Modelle sind Teil der Aktion. OpenRouter weist darauf hin, dass der Preisnachlass ausschließlich für den direkten Zugriff über OpenAI als Provider greift. Werden Anfragen über alternative Cloud-Anbieter geroutet, berechnen diese weiterhin ihre regulären Tarife. Wie lange die vergünstigten Konditionen für Terra und Luna gelten, ließ OpenRouter offen. Anzeige

  • OpenRouter wählt automatisch das beste Modell

    Eine Slot Maschine mit KI-Modellen

    GPT-Images-2.0

    Kurzfassung

    Quellen

    OpenRouter hat den Auto Router Beta veröffentlicht, der fähige KI-Modelle für Entwickler völlig automatisch auswählt.
    Das System analysiert eingehende Prompts und leitet sie an jene Modelle weiter, für die die Community aktuell das meiste Geld ausgibt.
    Nutzer können über einen simplen Regler das gewünschte Verhältnis von Qualität und Kosten steuern.
    Dieser dynamische Ansatz erzielt in Tests deutlich bessere Ergebnisse als bisherige Router und passt sich dem Markt fortlaufend an.

    OpenRouter Documentation – Auto Router Beta

    OpenRouter hat den Auto Router (Beta) veröffentlicht. Das System nimmt Entwicklern die Wahl des passenden KI-Modells ab. Statt auf theoretische Benchmarks zu setzen, wertet der Router das reale Ausgabeverhalten der Community aus und leitet Anfragen dynamisch weiter. Ausgaben bestimmen die Weiterleitung Der Auto Router klassifiziert jeden eingehenden Prompt in einen von etwa 30 Aufgabentypen. Dazu gehören Felder wie Fehlersuche in Code, komplexe Mathematik oder Forschungsberichte. Für die erkannte Aufgabe ermittelt er, auf welche Modelle die OpenRouter-Community in den vergangenen sieben Tagen das meiste Geld verwendet hat. Die Anfrage geht dann automatisch an das Modell mit dem höchsten Ausgabenanteil. OpenRouter geht davon aus, dass reale Zahlungsbereitschaft ein verlässlicherer Indikator für Leistung ist als statische Tests. Zu den so ermittelten und häufig genutzten Modellen gehören derzeit etwa GLM 5.2 oder DeepSeek V4 Flash. Wechseln Entwickler für eine bestimmte Anforderung zu einem neuen Modell, passt der Router seine Auswahl innerhalb weniger Tage von selbst an. Anzeige Kosten und Qualität im Gleichgewicht Nutzer steuern über einen Parameter, wie stark der Router auf den Preis achten soll. Die Skala für dieses Kosten-Qualitäts-Verhältnis reicht von 0 bis 10. Der Standardwert 7 schränkt die Auswahl so ein, dass nur das günstigste Drittel der passenden Modelle berücksichtigt wird. Bei einer Einstellung von 0 entscheidet der Router ungeachtet der Kosten rein nach Qualität und Beliebtheit. In internen Benchmarks schlägt der neue Router seinen Vorgänger deutlich. Beim anspruchsvollen Wissenschaftstest GPQA Diamond erreicht er in der Qualitätseinstellung 83,8 Prozent. Er liegt damit nur knapp hinter dem fest vorgegebenen Spitzenreiter Claude Opus 4.8 mit 86,9 Prozent. + Quelle: OpenRouter Nahtloser Wechsel und Session-Bindung Die Integration in bestehende Anwendungen erfordert lediglich eine angepasste Basis-URL und den Modellnamen »openrouter/auto-beta«. Wer möchte, kann die Auswahl über Filter auf bestimmte Modellfamilien oder Anbieter beschränken. Für zusammenhängende Konversationen nutzt der Router eine Session-Bindung. Er leitet Folgeanfragen innerhalb von fünf Minuten an denselben Anbieter weiter. Das stellt konsistente Antworten sicher und optimiert die Nutzung des Prompt Caches.

  • Alibaba dominiert OpenRouter mit neuem Token-Rekord

    Ein Pandabaer mit Krabbenelementen und Feuerwerk

    Nano Banana

    Kurzfassung

    Quellen

    Das KI-Modell Qwen 3.6 Plus hat auf OpenRouter einen historischen Meilenstein erreicht.
    Es verarbeitete als erstes Modell über 1,4 Billionen Token an einem einzigen Tag.
    Dies markiert den stärksten Start eines neuen Systems im laufenden Jahr.

    OpenRouter auf X: Qwen 3.6 Plus Token Milestone

    Das KI-Modell Qwen 3.6 Plus von Alibaba stellt auf der Plattform OpenRouter einen neuen Nutzungsrekord auf. Als erstes Modell überschritt es die Marke von einer Billion verarbeiteten Token innerhalb eines einzigen Tages.

    Twitter Beitrag – Cookies links unten aktivieren.

    Qwen 3.6 Plus from @Alibaba_Qwen is officially the first model on OpenRouter to break 1 Trillion tokens processed in a single day! At ~1,400,000,000,000 tokens, it’s the strongest full day performance of any new model dropped this year. Congrats to the Qwen team! pic.twitter.com/uo5ElnhzUn — OpenRouter (@OpenRouter) April 4, 2026 Stärkster Tagesstart des Jahres Mit exakt 1,4 Billionen abgerufenen Token übertrifft die neue Version die bisherigen Spitzenwerte deutlich. OpenRouter bestätigt diese Zahlen und ordnet die Leistung als den erfolgreichsten 24-Stunden-Start aller in diesem Jahr veröffentlichten KI-Modelle ein. Das System von Alibaba zeigt damit eine extrem hohe Stabilität bei enormer Auslastung. Anzeige Die enorme Auslastung resultiert offensichtlich aus komplexen Entwicklungsaufgaben. Qwen 3.6 Plus agiert als eigenständiger Agent für die Programmierung und überschaut ein Kontextfenster von einer Million Token. Die Architektur bearbeitet selbstständig Aufgaben, die von der Erstellung einzelner Frontend-Komponenten bis zur gezielten Fehlersuche in großen Code-Repositories reichen. Die hohe Token-Anzahl unterstreicht die wachsende Bedeutung offener Modelle für rechenintensive Aufgaben. Die Entwickler-Community adaptiert die neue Version außergewöhnlich schnell. OpenRouter festigt durch dieses Volumen gleichzeitig seine Position als relevanter Knotenpunkt für den Zugriff auf modernste KI-Modelle.

    Top News
    Qwen3.6-Plus dominiert Programmier-Benchmarks
    Die Architektur bietet ein Kontextfenster von einer Million Token und löst komplexe Entwicklungsaufgaben autonom.