01 Что произошло
В документации OpenAI Ultrafast описан как самый быстрый уровень обслуживания OpenAI API. Сейчас он доступен всем пользователям API для GPT-6 Astra, но с низкими лимитами. Для GPT-5.6 Sol доступен предварительный доступ.
02 Ключевые детали
- Стандартные лимиты GPT-6 Astra: 500 000 токенов в минуту для уровней использования API 1–3, 1 000 000 — для уровня 4 и 5 000 000 — для уровня 5.
- В каждом событии response.create задайте model: gpt-6-astra и service_tier: ultrafast. OpenAI настоятельно рекомендует WebSockets для приложений с частыми последовательными вызовами инструментов: без постоянного соединения сетевые накладные расходы могут снизить выигрыш в задержке.
- Ultrafast также поддерживает HTTP-запросы через SDK. OpenAI рекомендует использовать этот уровень, если скорость оправдывает более высокую стоимость.
- Ultrafast поддерживает резидентность данных в США и глобальную обработку, но не региональные конечные точки обработки в ЕС и других регионах за пределами США.
- Организации, работающие с командой OpenAI по работе с клиентами, могут обратиться к ней, чтобы запросить более высокие лимиты или предварительный доступ к GPT-5.6 Sol.
03 Почему это важно
Разработчики могут выбрать самый быстрый уровень обслуживания OpenAI API для GPT-6 Astra, учитывая более высокую стоимость, низкие лимиты и ограничения региональной обработки.
04 Кому полезно
Разработчики программного обеспечения.
ПервоисточникOpenAI Developers