01 Ce qui s’est passé
Dans sa documentation, OpenAI décrit Ultrafast comme le niveau de service le plus rapide de l’API OpenAI. Il est actuellement accessible à tous les utilisateurs de l’API pour GPT-6 Astra, sous réserve de limites basses. GPT-5.6 Sol est disponible en avant-première.
02 Les points essentiels
- Les limites par défaut de GPT-6 Astra sont de 500 000 jetons par minute pour les niveaux d’utilisation de l’API 1 à 3, de 1 000 000 pour le niveau 4 et de 5 000 000 pour le niveau 5.
- Dans chaque événement response.create, définissez model sur gpt-6-astra et service_tier sur ultrafast. OpenAI recommande vivement les WebSockets pour les applications qui enchaînent fréquemment des appels d’outils : sans connexion persistante, les surcoûts du réseau peuvent réduire les gains de latence.
- Ultrafast prend aussi en charge les requêtes HTTP via le SDK. OpenAI recommande ce niveau lorsque la vitesse justifie le coût supérieur.
- Ultrafast prend en charge la résidence des données aux États-Unis et le traitement mondial, mais pas les points de terminaison de traitement régional dans l’UE ou d’autres régions hors des États-Unis.
- Les organisations qui travaillent avec une équipe de compte OpenAI peuvent la contacter pour demander des limites plus élevées ou un accès en avant-première à GPT-5.6 Sol.
03 Pourquoi c’est important
Les développeurs peuvent choisir le niveau de service API le plus rapide d’OpenAI pour GPT-6 Astra, tout en tenant compte du coût supérieur, des limites basses et des restrictions de traitement régional.
04 Pour qui c’est utile
Développeurs de logiciels.
Source originaleOpenAI Developers