OpenAI Ultrafast : une IA 14 fois plus rapide, ce que ça change

OpenAI dévoile le mode Ultrafast : GPT-5.6 Sol jusqu’à 14 fois plus rapide grâce aux puces Cerebras

Le 14 août 2026, OpenAI a présenté Ultrafast, un nouveau mode d’exécution de son modèle GPT-5.6 Sol qui répond jusqu’à 14 fois plus vite que le mode standard, avec un débit de 750 tokens par seconde, sans baisse de qualité annoncée. Il tourne sur les puces géantes de Cerebras et n’est pour l’instant accessible qu’à quelques clients via l’API. Après la guerre des prix et l’essor des modèles locaux, c’est un troisième front qui s’ouvre : celui de la vitesse — et il concerne directement la façon dont une entreprise peut utiliser l’IA au quotidien.

Ce qu’OpenAI a annoncé exactement

Dans son billet officiel, OpenAI décrit Ultrafast comme un « aperçu » (preview) réservé à un groupe restreint de clients, lancé d’abord dans l’API. Les points à retenir, confirmés par Help Net Security et The Next Web :

  • jusqu’à 14 fois plus rapide que le mode standard de GPT-5.6 Sol, soit jusqu’à 750 tokens générés par seconde — quand le mode standard tourne autour d’une cinquantaine ;
  • même modèle, même qualité : ce n’est pas une version allégée, c’est le même GPT-5.6 Sol servi sur un autre matériel ;
  • propulsé par Cerebras, dans le cadre du partenariat sur l’inférence à très faible latence signé plus tôt cette année ;
  • disponibilité limitée : accès sur demande, extension progressive « au fil de la capacité disponible » ;
  • tarif non publié : OpenAI parle d’une option haut de gamme, sans donner de prix. Le mode « Fast » existant, environ 2,5 fois plus rapide, coûte déjà à peu près le double du standard, rappelle The Decoder.

OpenAI cite des clients qui testent déjà Ultrafast en production : la société de trading Jane Street, ainsi que Podium, Basis et Rogo. John Crepezzi, de Jane Street, résume l’effet dans le billet d’OpenAI : « le gain de vitesse apporté par Cerebras est impressionnant. Il permet d’utiliser les modèles autrement » (traduction).

Infographie : le mode Ultrafast d’OpenAI en quatre chiffres — jusqu’à 14 fois plus rapide, 750 tokens par seconde, un mode Fast intermédiaire 2,5 fois plus rapide, et un aperçu limité lancé le 14 août 2026 via l’API
Trois vitesses pour un même modèle : standard, Fast et désormais Ultrafast.

Pourquoi la vitesse devient un produit à part entière

Jusqu’ici, les éditeurs vendaient surtout de l’intelligence : un modèle plus « fort » coûtait plus cher. OpenAI vend maintenant aussi du temps. Le même modèle est proposé à trois vitesses — standard, Fast, Ultrafast — avec des tarifs croissants, un peu comme un opérateur cloud facture plus cher les serveurs les plus performants. C’est possible grâce aux puces de Cerebras : d’après The Next Web, chacune a la taille d’une assiette et peut contenir un modèle entier, ce qui supprime les allers-retours entre serveurs qui ralentissent les cartes Nvidia classiques. Au passage, OpenAI diversifie ses fournisseurs de calcul, un enjeu stratégique dans un secteur où la puissance de calcul manque.

Ce que ça change concrètement pour vous

Les agents IA deviennent utilisables en temps réel

Un agent d’IA ne répond pas en une fois : il réfléchit, appelle un outil, lit le résultat, recommence — parfois des dizaines de fois pour une seule tâche. À 50 tokens par seconde, une chaîne de dix étapes prend plusieurs minutes ; à 750, elle tient en quelques secondes. Les cas d’usage cités par OpenAI vont dans ce sens : support client et assistants vocaux, où une seconde de silence est déjà trop longue ; recommandations e-commerce ; surveillance de transactions financières ; réponse aux incidents informatiques, où l’IA lit les journaux et les traces pendant que la panne dure encore.

Itérer dans la journée au lieu de lancer un traitement la nuit

OpenAI décrit un usage interne parlant : ses équipes de recherche, qui lançaient certaines analyses le soir pour lire les résultats le lendemain, enchaînent maintenant plusieurs itérations dans la même journée. Transposé à une PME, c’est la différence entre « on verra le rapport demain » et « on ajuste tout de suite ». Analyse d’un fichier de milliers de lignes, tri d’un stock de courriers, génération de dizaines de variantes d’un document : la vitesse change moins le résultat que le rythme de travail.

Infographie : quatre usages où la vitesse de l’IA change tout — agents multi-étapes, support client et voix, surveillance et réponse aux incidents, analyses répétées dans la journée
La vitesse compte peu pour rédiger un e-mail, énormément dès que l’IA enchaîne des actions.

Mais pas pour tout le monde, ni tout de suite

Trois réserves. D’abord, Ultrafast est un aperçu limité, accessible sur demande via l’API : un utilisateur de ChatGPT n’en verra rien pour l’instant. Ensuite, le prix n’est pas connu, et tout indique qu’il sera nettement supérieur au standard — la vitesse se paie. Enfin, pour la majorité des usages de bureau (rédiger, résumer, traduire, préparer une réunion), le mode standard est déjà bien assez rapide. La question à se poser n’est pas « voulons-nous plus vite ? » mais « quel processus, chez nous, est bloqué par le temps de réponse de l’IA ? ». Pour la plupart des PME, la réponse honnête est : pas encore beaucoup — mais ceux qui construisent des agents ou des assistants clients doivent suivre ce sujet de près.

Ultrafast est-il disponible dans ChatGPT ?

Non. Au 17 août 2026, Ultrafast n’existe que dans l’API d’OpenAI, en aperçu limité pour des clients sélectionnés. OpenAI annonce une ouverture progressive à mesure que la capacité de calcul de Cerebras augmente, sans calendrier ni tarif public.

Un mode plus rapide donne-t-il des réponses moins bonnes ?

Non selon OpenAI : Ultrafast sert exactement le même modèle GPT-5.6 Sol, sur un matériel différent, sans réduction de qualité annoncée. Ce n’est pas un modèle « mini » ou distillé. Comme toujours, ces affirmations méritent d’être vérifiées sur vos propres cas d’usage avant tout engagement.

Savoir quand la vitesse d’un modèle compte vraiment, comprendre ce qu’est un agent qui enchaîne des étapes, et choisir le bon mode pour le bon processus : c’est exactement le genre de discernement que Vincent Lévi et son équipe transmettent dans leurs formations IA, de la prise en main personnelle (IA Académie) à l’automatisation des équipes (Business IA). Si vous vous demandez quels processus de votre entreprise gagneraient à être confiés à un agent, écrivez à l’équipe : réponse sous 48 heures.

Examine more articles