Photo : Jakub Pabis / Pexels
IAIntelligence artificielle· 3 min

OpenAI accélère GPT-5.6 Sol de 14 fois avec le mode Ultrafast

Par Stéphane Larue · 14 août 2026

OpenAI a présenté le 13 août 2026 « Ultrafast », un nouveau mode qui fait tourner son modèle GPT-5.6 Sol jusqu’à 14 fois plus vite que la version standard. La prouesse repose sur un partenariat avec le fabricant de puces Cerebras, capable de générer jusqu’à 750 tokens par seconde. Pour l’instant, l’accès reste réservé à un groupe restreint de clients via l’API.

Publicite

L’essentiel

  • OpenAI lance Ultrafast, un mode 14 fois plus rapide pour GPT-5.6 Sol
  • Jusqu’à 750 tokens générés par seconde, grâce aux puces du partenaire Cerebras
  • Disponible uniquement en preview via l’API, pour un petit groupe de clients triés sur le volet
  • Pas encore intégré à ChatGPT ni annoncé pour la France

Une vitesse inédite portée par les puces de Cerebras

Le principe d’Ultrafast tient en une promesse : traiter les requêtes bien plus vite sans changer le modèle utilisé.

GPT-5.6 Sol reste le même système, mais son exécution s’appuie désormais sur l’infrastructure du spécialiste américain des puces Cerebras, taillée pour l’inférence à très haute vitesse.

Résultat annoncé par OpenAI : des réponses jusqu’à 14 fois plus rapides qu’en mode standard, avec un débit pouvant atteindre 750 tokens par seconde.

Chez Rogo, une des entreprises qui testent déjà l’outil, la vitesse n’est pas qu’un confort. « La vitesse ne rend pas seulement le produit plus agréable à utiliser. Elle change ce que les gens peuvent réellement en faire », a résumé son cofondateur Alex Wang, cité par TechCrunch.

Réservé à une poignée de clients, pour l’instant

Ultrafast n’est accessible qu’en version de test, et uniquement via l’API OpenAI — pas dans l’interface grand public de ChatGPT.

Quatre entreprises font partie des premiers testeurs officiels : Jane Street, Podium, Basis et Rogo.

Publicite

Chez Podium, spécialiste du service client par la voix, le responsable Courtland Lykins évoque un changement radical d’expérience : « La vitesse transforme complètement l’expérience d’appel pour les tâches les plus complexes. »

OpenAI évoque plusieurs usages prioritaires pour ce mode accéléré : réponse aux incidents, recherche financière, support client vocal et e-commerce, notamment pour répondre en temps réel aux questions sur les stocks ou les recommandations produits.

Aucune tarification n’a été communiquée. L’entreprise promet seulement d’élargir l’accès « à mesure que la capacité augmente », sans calendrier précis ni mention d’une disponibilité en France ou en Europe.

Face à Claude et Gemini, la course à la vitesse s’accélère

OpenAI n’est pas seul sur ce terrain. Anthropic propose déjà un mode rapide pour Claude, mais TechCrunch souligne qu’il n’atteint pas les performances annoncées par Ultrafast.

Le sujet s’inscrit dans une bataille plus large entre les grands éditeurs d’IA, où comparatif IA rime de plus en plus avec rapidité d’exécution autant qu’avec qualité des réponses.

Google avait de son côté rappelé début août que Gemini a dépassé le milliard d’utilisateurs actifs dans le monde, signe que la concurrence se joue aussi sur le volume d’adoption.

OpenAI, de son côté, multiplie les annonces ces derniers jours : l’entreprise a par ailleurs confirmé le rachat de NextSlide pour concurrencer PowerPoint, signe d’une stratégie tous azimuts autour de ChatGPT.

Pour les utilisateurs français, la question reste entière : sans date ni tarif communiqués, Ultrafast restera pour l’instant l’apanage de quelques grandes entreprises américaines testant les usages de demain.

Publicite