Si vous avez déjà fixé votre écran, tapoté du pied et marmonné : « Allez, ChatGPT, je n'ai pas que ça à faire », alors OpenAI a exactement ce qu'il vous faut — parce qu'apparemment, la vitesse à laquelle un chatbot répondait était le vrai goulot d'étranglement dans nos vies.

Le laboratoire d'IA a déployé un nouveau mode appelé Ultrarapide, qui, selon lui, est conçu pour accélérer sérieusement le rythme auquel son modèle le plus récent et le plus puissant, GPT-5.6 Sol, accomplit son travail. Oui, c'est bien ça : le modèle s'appelle Sol, comme s'il avait besoin de ressembler davantage à un personnage de science-fiction.

L'entreprise affirme qu'Ultrarapide peut fonctionner à 14 fois la vitesse du traitement standard, délivrant jusqu'à 750 jetons de sortie par seconde. Ces jetons, pour les non-initiés, sont les morceaux de texte distincts générés par un LLM lorsqu'il interagit avec un humain — donc essentiellement, c'est la différence entre une conversation avec un commissaire-priseur qui parle vite et un philosophe contemplatif.

« Jusqu'à présent, obtenir une vitesse en temps réel signifiait généralement choisir un modèle plus petit ou plus spécialisé », a déclaré l'entreprise dans le billet de blog jeudi. « Ultrarapide indique un progrès dans une nouvelle direction : plus de travail utile par seconde. » Parce que qui ne veut pas quantifier l'utilité en termes de débit brut ?

Les concurrents d'OpenAI, comme Anthropic, ont également lancé des versions accélérées de leurs modèles. Claude a un mode rapide, bien qu'il n'offre pas le genre de vitesse qu'OpenAI propose ici. Donc, si vous craigniez que Claude ne dépasse GPT, rassurez-vous : OpenAI a jeté le gant, et il est fait de silicium et d'arrogance.

OpenAI suggère que cette version survitaminée de GPT-5.6 Sol peut être déployée dans un certain nombre de flux de travail d'entreprise différents, notamment la réponse aux incidents, le service client et l'assistance, l'analyse des marchés financiers et le commerce électronique, entre autres domaines pertinents. Parce que rien ne dit « calme sous pression » comme un chatbot qui répond à une panne de serveur à la vitesse de la lumière.

Ultrarapide, actuellement disponible en aperçu, est alimenté par le partenariat d'OpenAI avec le fabricant de puces Cerebras. Actuellement, cet aperçu n'est proposé qu'à un petit groupe de clients, bien qu'OpenAI affirme qu'il élargira l'accès à la fonctionnalité « à mesure que la capacité augmentera ». Donc pour l'instant, la plupart d'entre nous devront continuer à attendre les millisecondes agonisantes qu'il faut à GPT-5.6 Sol pour répondre. Nous essaierons de nous en remettre.