OpenAI запускает режим Ultrafast для GPT-5.6 Sol: скорость выросла в 14 раз
Компания OpenAI представила предпросмотр режима "Ultrafast" для своей флагманской модели GPT-5.6 Sol, который увеличивает скорость генерации до 750 выходных токенов в секунду благодаря партнерству с Cerebras.
OpenAI запустила предпросмотр режима Ultrafast для модели GPT-5.6 Sol. Этот режим увеличивает скорость генерации текста в 14 раз по сравнению со стандартной версией, достигая 750 выходных токенов в секунду.
Режим доступен в предварительном просмотре для избранных корпоративных клиентов через API. Ускорение стало возможным благодаря партнерству с компанией Cerebras, чьи чипы специализируются на задачах ИИ.
Запуск - ответ на растущий спрос со стороны бизнеса, где скорость отклика часто становится узким местом. В конкурентной борьбе за корпоративный рынок скорость и стоимость запросов становятся такими же важными, как и качество ответов. Ultrafast-режим для флагманской GPT-5.6 Sol позволяет использовать максимальное качество модели без задержек. Это стратегический ход против давления со стороны более легких открытых моделей и коммерческих API конкурентов.
Ускорение в 14 раз показывает, что аппаратная оптимизация радикально меняет опыт работы с большими языковыми моделями. Для разработчиков это открывает возможности создавать приложения, ранее невозможные из-за высокой латентности: интерактивные системы реального времени, мгновенную обработку длинных данных или интеграцию ИИ в высоконагруженные конвейеры. Скорость в 750 токенов в секунду приближает взаимодействие с ИИ к живому диалогу даже при больших контекстах.
Запуск сигнализирует о смещении битвы за корпоративный рынок в плоскость инфраструктуры и производительности. OpenAI нацеливается на сегмент, где критически важны надежность и масштабируемость. Это поднимает планку для всех игроков рынка - ожидания клиентов к скорости топовых моделей будут пересмотрены. Фокус на скорости для флагманской модели может привести к дальнейшей сегментации предложения OpenAI, где разные режимы работы будут предлагаться по разным ценам. Пока режим в предпросмотре, но его полномасштабный запуск повлияет на то, как компании выбирают и используют большие языковые модели для самых требовательных задач.


