Если вы когда-нибудь ловили себя на том, что смотрите на экран, постукиваете ногой и бормочете: «Давай, ChatGPT, у меня нет целого дня», то у OpenAI есть для вас именно то, что нужно — потому что, видимо, скорость ответа чат-бота была настоящим узким местом в нашей жизни.
Лаборатория ИИ выпустила новый режим под названием Ultrafast, который, по её словам, предназначен для серьёзного ускорения темпа работы её самой новой и мощной модели GPT-5.6 Sol. Да, всё верно: модель называется Sol, как будто ей нужно было звучать как персонаж из научной фантастики.
Компания утверждает, что Ultrafast может работать в 14 раз быстрее стандартной обработки, выдавая до 750 выходных токенов в секунду. Эти токены, для непосвящённых, представляют собой отдельные фрагменты текста, генерируемые LLM при взаимодействии с человеком — так что по сути это разница между разговором с быстро говорящим аукционистом и задумчивым философом.
«До сих пор получение скорости в реальном времени обычно означало выбор меньшей или более специализированной модели», — говорится в сообщении компании в блоге в четверг. «Ultrafast указывает на прогресс в новом направлении: больше полезной работы в секунду». Потому что кто не хочет измерять полезность в терминах сырой пропускной способности?
Конкуренты OpenAI, такие как Anthropic, также запустили ускоренные версии своих моделей. У Claude есть быстрый режим, хотя он не обеспечивает такой скорости, какую предлагает OpenAI. Так что если вы беспокоились, что Claude обгоняет GPT, будьте уверены: OpenAI бросила перчатку, и она сделана из кремния и высокомерия.
OpenAI предполагает, что эта высокооктановая версия GPT-5.6 Sol может быть развёрнута в ряде различных корпоративных рабочих процессов, особенно в реагировании на инциденты, обслуживании клиентов и поддержке, анализе финансовых рынков и электронной коммерции, среди прочих соответствующих областей. Потому что ничто так не говорит о «спокойствии под давлением», как чат-бот, который реагирует на сбой сервера со скоростью света.
Ultrafast, который в настоящее время выпускается в предварительной версии, работает благодаря партнёрству OpenAI с производителем чипов Cerebras. В настоящее время эта предварительная версия доступна лишь небольшой группе клиентов, хотя OpenAI заявляет, что расширит доступ к функции по мере «роста мощностей». Так что пока большинству из нас придётся продолжать ждать мучительные миллисекунды, которые требуются GPT-5.6 Sol для ответа. Мы постараемся справиться.