Wenn Sie schon einmal auf Ihren Bildschirm gestarrt, mit dem Fuß getippt und gemurmelt haben: „Komm schon, ChatGPT, ich habe nicht den ganzen Tag Zeit“, dann hat OpenAI genau das Richtige für Sie – denn offenbar war die Geschwindigkeit, mit der ein Chatbot antwortet, der eigentliche Engpass in unserem Leben.
Das KI-Labor hat einen neuen Modus namens Ultrafast eingeführt, der laut eigenen Angaben das Tempo, mit dem sein neuestes und leistungsstärkstes Modell GPT-5.6 Sol seine Arbeit erledigt, erheblich beschleunigen soll. Ja, richtig gehört: Das Modell heißt Sol, als ob es mehr wie eine Science-Fiction-Figur klingen müsste.
Das Unternehmen behauptet, dass Ultrafast mit der 14-fachen Geschwindigkeit der Standardverarbeitung arbeiten und bis zu 750 Ausgabe-Token pro Sekunde liefern kann. Diese Token sind für Uneingeweihte die einzelnen Textstücke, die ein LLM bei der Interaktion mit einem Menschen erzeugt – also im Wesentlichen der Unterschied zwischen einem Gespräch mit einem schnell redenden Auktionator und einem kontemplativen Philosophen.
„Bisher bedeutete Echtzeit-Geschwindigkeit in der Regel, ein kleineres oder spezialisierteres Modell zu wählen“, sagte das Unternehmen in seinem Blogbeitrag am Donnerstag. „Ultrafast zeigt Fortschritte in eine neue Richtung: mehr nützliche Arbeit pro Sekunde.“ Denn wer möchte Nützlichkeit nicht in rohem Durchsatz quantifizieren?
OpenAI-Konkurrenten wie Anthropic haben ähnlich beschleunigte Versionen ihrer Modelle auf den Markt gebracht. Claude hat einen Schnellmodus, obwohl er nicht die Geschwindigkeit bietet, die OpenAI hier anbietet. Falls Sie also befürchtet haben, dass Claude GPT überholt, seien Sie beruhigt: OpenAI hat den Fehdehandschuh hingeworfen, und er besteht aus Silizium und Überheblichkeit.
OpenAI schlägt vor, dass diese Hochgeschwindigkeitsversion von GPT-5.6 Sol in verschiedenen Unternehmensworkflows eingesetzt werden kann, insbesondere bei Incident Response, Kundenservice und Support, Finanzmarktanalyse und E-Commerce, neben anderen relevanten Bereichen. Denn nichts sagt „Ruhe bewahren“ wie ein Chatbot, der auf einen Serverausfall mit Lichtgeschwindigkeit reagiert.
Ultrafast, das derzeit als Vorschau veröffentlicht wird, wird durch die Partnerschaft von OpenAI mit dem Chip-Hersteller Cerebras unterstützt. Derzeit wird die Vorschau nur einer kleinen Gruppe von Kunden zur Verfügung gestellt, obwohl OpenAI sagt, dass es den Zugang zu der Funktion erweitern wird, sobald „die Kapazität wächst“. Für die meisten von uns heißt das also: Wir müssen weiterhin die quälenden Millisekunden abwarten, die GPT-5.6 Sol für eine Antwort benötigt. Wir werden versuchen, damit klarzukommen.