OpenAI launcht neuen “Ultrafast”-Modus für GPT-5.6 Sol


OpenAI startet eine Vorschau des neuen “Ultrafast”-Modus, der das Spitzenmodell GPT-5.6 Sol mit bis zu 750 Output-Tokens pro Sekunde ausliefert.

Die Inferenz-Beschleunigung stammt von Cerebras, mit dem OpenAI Anfang des Jahres eine Zehn-Milliarden-Zusammenarbeit einging. Der Dienst startet zunächst ausschließlich über die OpenAI-API für GPT-5.6 Sol für ausgewählte Kunden. OpenAI will den Zugang schrittweise erweitern, sobald die Kapazität wächst. Interessierte Unternehmen können sich über ein Formular für Updates registrieren.

Geschwindigkeit soll neue Anwendungsfälle erschließen

Ultrafast soll laut OpenAI die Geschwindigkeitsvorteile kleinerer Modelle mit den vollen Fähigkeiten eines großen Reasoning-Modells verknüpfen, für “mehr nützliche Arbeit” pro Sekunde. Bei der Incident Response etwa könnten Ingenieure während eines laufenden Systemausfalls Logs, Code-Änderungen und Berichte analysieren lassen, um die Ursache zu identifizieren und einen Fix vorzubereiten, noch während der Ausfall andauert. OpenAI nutzt den Modus nach eigenen Angaben bereits intern für diesen Zweck.

Im Finanzbereich soll Ultrafast Marktsignale auswerten und verdächtige Transaktionen erkennen können, solange sich die Bedingungen noch ändern. Im Kundensupport könnten komplexe Anfragen in Echtzeit gelöst werden, auch wenn die Antwortfindung mehrere Schritte oder Systeme erfordert. Im E-Commerce soll das Modell Produktfragen beantworten, Lagerbestände prüfen und Empfehlungen personalisieren, bevor ein zögernder Käufer den Warenkorb aufgibt.

Video: Generierung eines 3D-Warenhaus-Simulators, links im Ultrafast-Mode

Auch die Forschung könne profitieren: Experimente, die bisher über Nacht als Batch liefen, könnten mit Ultrafast zu interaktiven Arbeitssitzungen werden, bei denen Teams eine Idee testen, Ergebnisse prüfen, ihren Ansatz anpassen und einen weiteren Durchlauf starten, ohne ihren Arbeitsfluss zu unterbrechen.

Geschwindigkeit als Preishebel

OpenAI monetarisiert Inferenzgeschwindigkeit bereits in Stufen: Über die API bietet es einen “Fast Mode” an, der für GPT-5.6 Sol bis zu 2,5-fach höhere Geschwindigkeit bei niedrigerer Latenz als die Standardverarbeitung verspricht, zu etwa doppelt so hohen Preisen. Mit Ultrafast kommt nun eine dritte Stufe hinzu, die nochmals deutlich schneller und wahrscheinlich auch teurer sein soll.

Das Prinzip dahinter ist dasselbe, das Cloud-Anbieter seit Jahren nutzen: Für denselben Dienst werden je nach Leistungsklasse unterschiedliche Preise verlangt. Bei OpenAI heißt das: Standard für kostensensible Anwendungen, Fast für produktionsreife Dienste mit planbarer Latenz, Ultrafast für Szenarien, in denen jede Sekunde zählt. Wird KI zum Wettbewerbsvorteil und Geschwindigkeit zum Engpass in der Produktion von Gütern und Dienstleistungen, sitzt OpenAI mit diesem Stufenmodell an einem Hebel, an dem Kunden kaum sparen können.

KI-News ohne Hype – von Menschen kuratiert

Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den “KI Radar”‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.



Source link

Leave a Comment