01 Was passiert ist
In der Dokumentation bezeichnet OpenAI Ultrafast als die schnellste Service-Stufe der OpenAI API. Für GPT-6 Astra ist sie derzeit allen API-Nutzern zugänglich, jedoch mit niedrigen Limits. Für GPT-5.6 Sol gibt es Vorschauzugang.
02 Die wichtigsten Details
- Die Standardlimits für GPT-6 Astra liegen bei 500.000 Token pro Minute für API-Nutzungsstufen 1–3, bei 1.000.000 für Stufe 4 und bei 5.000.000 für Stufe 5.
- In jedem response.create-Ereignis müssen Entwickler model auf gpt-6-astra und service_tier auf ultrafast setzen. OpenAI empfiehlt WebSockets nachdrücklich für Anwendungen mit häufigen, unmittelbar aufeinanderfolgenden Tool-Aufrufen: Ohne dauerhafte Verbindung können Netzwerk-Overheads die Latenzgewinne verringern.
- Ultrafast unterstützt außerdem HTTP-Anfragen über das SDK. OpenAI empfiehlt die Stufe, wenn die Geschwindigkeit die höheren Kosten rechtfertigt.
- Ultrafast unterstützt US-Datenresidenz und globale Verarbeitung, aber keine regionalen Verarbeitungsendpunkte in der EU oder anderen Regionen außerhalb der USA.
- Organisationen, die mit einem OpenAI-Account-Team zusammenarbeiten, können dort höhere Rate-Limits oder Vorschauzugang für GPT-5.6 Sol beantragen.
03 Warum das wichtig ist
Entwicklungsteams können für GPT-6 Astra OpenAIs schnellste API-Service-Stufe auswählen und dabei höhere Kosten, niedrige Limits und Einschränkungen bei der regionalen Verarbeitung berücksichtigen.
04 Für wen es relevant ist
Softwareentwickler.
OriginalquelleOpenAI Developers