01 Ce qui s’est passé

Dans sa documentation, OpenAI décrit Ultrafast comme le niveau de service le plus rapide de l’API OpenAI. Il est actuellement accessible à tous les utilisateurs de l’API pour GPT-6 Astra, sous réserve de limites basses. GPT-5.6 Sol est disponible en avant-première.

02 Les points essentiels

  • Les limites par défaut de GPT-6 Astra sont de 500 000 jetons par minute pour les niveaux d’utilisation de l’API 1 à 3, de 1 000 000 pour le niveau 4 et de 5 000 000 pour le niveau 5.
  • Dans chaque événement response.create, définissez model sur gpt-6-astra et service_tier sur ultrafast. OpenAI recommande vivement les WebSockets pour les applications qui enchaînent fréquemment des appels d’outils : sans connexion persistante, les surcoûts du réseau peuvent réduire les gains de latence.
  • Ultrafast prend aussi en charge les requêtes HTTP via le SDK. OpenAI recommande ce niveau lorsque la vitesse justifie le coût supérieur.
  • Ultrafast prend en charge la résidence des données aux États-Unis et le traitement mondial, mais pas les points de terminaison de traitement régional dans l’UE ou d’autres régions hors des États-Unis.
  • Les organisations qui travaillent avec une équipe de compte OpenAI peuvent la contacter pour demander des limites plus élevées ou un accès en avant-première à GPT-5.6 Sol.

03 Pourquoi c’est important

Les développeurs peuvent choisir le niveau de service API le plus rapide d’OpenAI pour GPT-6 Astra, tout en tenant compte du coût supérieur, des limites basses et des restrictions de traitement régional.

04 Pour qui c’est utile

Développeurs de logiciels.

Source originaleOpenAI Developers