01 Что произошло

В документации OpenAI Ultrafast описан как самый быстрый уровень обслуживания OpenAI API. Сейчас он доступен всем пользователям API для GPT-6 Astra, но с низкими лимитами. Для GPT-5.6 Sol доступен предварительный доступ.

02 Ключевые детали

  • Стандартные лимиты GPT-6 Astra: 500 000 токенов в минуту для уровней использования API 1–3, 1 000 000 — для уровня 4 и 5 000 000 — для уровня 5.
  • В каждом событии response.create задайте model: gpt-6-astra и service_tier: ultrafast. OpenAI настоятельно рекомендует WebSockets для приложений с частыми последовательными вызовами инструментов: без постоянного соединения сетевые накладные расходы могут снизить выигрыш в задержке.
  • Ultrafast также поддерживает HTTP-запросы через SDK. OpenAI рекомендует использовать этот уровень, если скорость оправдывает более высокую стоимость.
  • Ultrafast поддерживает резидентность данных в США и глобальную обработку, но не региональные конечные точки обработки в ЕС и других регионах за пределами США.
  • Организации, работающие с командой OpenAI по работе с клиентами, могут обратиться к ней, чтобы запросить более высокие лимиты или предварительный доступ к GPT-5.6 Sol.

03 Почему это важно

Разработчики могут выбрать самый быстрый уровень обслуживания OpenAI API для GPT-6 Astra, учитывая более высокую стоимость, низкие лимиты и ограничения региональной обработки.

04 Кому полезно

Разработчики программного обеспечения.

ПервоисточникOpenAI Developers