OpenAI показала GPT‑5.6 Sol в режиме Ultrafast: до 14 раз быстрее

OpenAI представила Ultrafast — новый режим обработки для GPT‑5.6 Sol, который должен сделать фронтирную модель пригодной для сценариев, где важна не только точность, но и реакция почти в реальном времени. Анонс опубликован 13 августа 2026 года.
Что обещает Ultrafast
По заявлению OpenAI, Ultrafast работает до 14 раз быстрее стандартной обработки GPT‑5.6 Sol и выдаёт до 750 токенов в секунду. Режим запускается сначала в API и построен на инфраструктуре Cerebras. Речь идёт не о новой отдельной модели, а о новом классе скорости для той же модели: OpenAI хочет уменьшить задержку, не переводя пользователя на более простой или менее способный вариант.
Компания приводит несколько сценариев, где задержка особенно заметна. При аварии в сервисе модель может быстрее разобрать логи, изменения в коде и сообщения инженеров. В финансовых исследованиях она способна обновлять выводы, пока меняются данные. В голосовой поддержке высокая скорость позволяет не разрывать разговор, даже если ответ требует нескольких шагов и обращения к разным системам.
Это пока ранний доступ. Ultrafast доступен ограниченной группе клиентов OpenAI, а расширение зависит от роста вычислительных мощностей. Публичного общего запуска для всех пользователей API или ChatGPT в анонсе нет.
Почему это меняет рынок
Обычно компании выбирают: отправить запрос к сильной модели и ждать дольше или взять быструю модель с компромиссом по качеству. Ultrafast проверяет другую стратегию — ускорить именно сложную модель. Если такой режим станет массовым, AI сможет надёжнее работать внутри живых процессов: голосовых диалогов, поддержки, мониторинга, поиска по большим массивам данных и интерактивных приложений.
Для бизнеса это также вопрос стоимости простоя и времени сотрудника. Быстрый ответ не просто улучшает ощущение от интерфейса: он позволяет сделать больше итераций до того, как изменится контекст. Но цифра «до 14 раз» — это верхняя граница из заявления OpenAI, а не гарантия для любого запроса. Реальная задержка зависит от длины контекста, нагрузки, инструментов и сетевого пути.
Партнёрство с Cerebras показывает и вторую сторону события. Конкуренция между AI-платформами идёт не только за качество моделей, но и за специализированные системы, способные обслуживать их с низкой задержкой. В результате скорость инференса становится частью продукта, а не незаметной инфраструктурной характеристикой.
Что доступно в «Сразу»
Попробовать в «Сразу». GPT‑5.6 Sol Pro можно выбрать в чате «Сразу» для кода, анализа и задач, где важен быстрый результат. Доступность Ultrafast зависит от OpenAI и в каталог «Сразу» не заявлена.
Первоисточник: анонс Ultrafast от OpenAI.