OpenAI тестирует Ultrafast для GPT‑5.6 Sol со скоростью до 750 токенов

OpenAI открыла ограниченное предварительное тестирование режима Ultrafast для модели GPT‑5.6 Sol в API. По заявлению компании, новый уровень сервиса обеспечивает до 750 выходных токенов в секунду — до 14 раз быстрее стандартной обработки. Инфраструктурным партнёром выступает Cerebras.
Ставка на сложные задачи в реальном времени
OpenAI позиционирует Ultrafast как способ применять флагманскую модель там, где важна минимальная задержка. Ранее для работы в реальном времени разработчикам обычно приходилось выбирать менее крупные или узкоспециализированные модели. Новый режим должен объединить высокую скорость с возможностями GPT‑5.6 Sol.
Компания приводит несколько предполагаемых сценариев: анализ логов, изменений кода и сообщений инженеров во время инцидента; оценку рыночных сигналов и подозрительных транзакций; поддержку клиентов в голосовых диалогах; ответы о товарах, проверку остатков и помощь при оформлении заказа.
Также OpenAI указывает на исследовательские и экспериментальные задачи. По её описанию, процессы, для которых команды прежде запускали ночные пакеты экспериментов, можно перевести в несколько последовательных итераций в течение рабочего дня.
Первые пользователи и роль Cerebras
В предварительном тестировании участвует начальная группа компаний из сфер разработки, коммерции, финансовых исследований и поддержки. Среди названных OpenAI организаций — Jane Street, Podium, Basis и Rogo. Компания намерена использовать результаты их работы, чтобы определить, в каких продуктах резкий рост скорости даёт наибольший эффект.
Внутри OpenAI режим уже проверяют для реагирования на инциденты. Команды используют его для чтения логов, анализа трассировок, обобщения обсуждений, определения следующих проверок и подготовки либо валидации исправлений. При этом окончательное решение и развёртывание остаются за инженерами.
Ultrafast продолжает развитие скоростных режимов OpenAI: снижение цен на GPT‑5.6 и Fast mode для Sol описывает снижение цен на GPT‑5.6 Luna и Terra и запуск Fast mode для Sol. В новом анонсе компания делает акцент именно на более высокой пропускной способности Sol в API.
Доступ пока ограничен
GPT‑5.6 Sol в режиме Ultrafast уже доступна избранной группе клиентов в рамках limited preview. OpenAI обещает расширять доступ по мере роста вычислительных мощностей, но сроков и параметров коммерческой доступности не раскрывает.
Практический вывод для бизнеса: режим стоит рассматривать для процессов, где ценность зависит от ответа во время самого события — например, звонка, сбоя или изменения данных. До широкого запуска необходимо оценить доступность сервиса, требования конкретного сценария и контроль решений со стороны команды.

