VMTech
Обсудить проект

OpenAI тестирует Ultrafast для GPT‑5.6 Sol со скоростью до 750 токенов

OpenAI тестирует Ultrafast для GPT‑5.6 Sol со скоростью до 750 токенов

OpenAI открыла ограниченное предварительное тестирование режима Ultrafast для модели GPT‑5.6 Sol в API. По заявлению компании, новый уровень сервиса обеспечивает до 750 выходных токенов в секунду — до 14 раз быстрее стандартной обработки. Инфраструктурным партнёром выступает Cerebras.

Ставка на сложные задачи в реальном времени

OpenAI позиционирует Ultrafast как способ применять флагманскую модель там, где важна минимальная задержка. Ранее для работы в реальном времени разработчикам обычно приходилось выбирать менее крупные или узкоспециализированные модели. Новый режим должен объединить высокую скорость с возможностями GPT‑5.6 Sol.

Компания приводит несколько предполагаемых сценариев: анализ логов, изменений кода и сообщений инженеров во время инцидента; оценку рыночных сигналов и подозрительных транзакций; поддержку клиентов в голосовых диалогах; ответы о товарах, проверку остатков и помощь при оформлении заказа.

Также OpenAI указывает на исследовательские и экспериментальные задачи. По её описанию, процессы, для которых команды прежде запускали ночные пакеты экспериментов, можно перевести в несколько последовательных итераций в течение рабочего дня.

Первые пользователи и роль Cerebras

В предварительном тестировании участвует начальная группа компаний из сфер разработки, коммерции, финансовых исследований и поддержки. Среди названных OpenAI организаций — Jane Street, Podium, Basis и Rogo. Компания намерена использовать результаты их работы, чтобы определить, в каких продуктах резкий рост скорости даёт наибольший эффект.

Внутри OpenAI режим уже проверяют для реагирования на инциденты. Команды используют его для чтения логов, анализа трассировок, обобщения обсуждений, определения следующих проверок и подготовки либо валидации исправлений. При этом окончательное решение и развёртывание остаются за инженерами.

Ultrafast продолжает развитие скоростных режимов OpenAI: снижение цен на GPT‑5.6 и Fast mode для Sol описывает снижение цен на GPT‑5.6 Luna и Terra и запуск Fast mode для Sol. В новом анонсе компания делает акцент именно на более высокой пропускной способности Sol в API.

Доступ пока ограничен

GPT‑5.6 Sol в режиме Ultrafast уже доступна избранной группе клиентов в рамках limited preview. OpenAI обещает расширять доступ по мере роста вычислительных мощностей, но сроков и параметров коммерческой доступности не раскрывает.

Практический вывод для бизнеса: режим стоит рассматривать для процессов, где ценность зависит от ответа во время самого события — например, звонка, сбоя или изменения данных. До широкого запуска необходимо оценить доступность сервиса, требования конкретного сценария и контроль решений со стороны команды.

#openai#gpt56#cerebras#aiinference
Открытая аналитика
На сайте 1 просмотров
мин чтения 3 13.08.2026
Instagram

OpenAI тестирует Ultrafast для GPT‑5.6 Sol со скоростью до 750 токенов

Открыть публикацию в Instagram ↗