Cerebras и OpenAI представили ранний доступ к Ultrafast Mode — новому сервисному уровню, который первым появится в OpenAI API и работает на инфраструктуре Cerebras. Ultrafast пока доступен ограниченной группе клиентов, доступ будет расширяться постепенно. Cerebras обеспечивает работу GPT-5.6 Sol в режиме Ultrafast со скоростью до 750 выходных токенов в секунду без компромиссов по качеству, что позволяет ускорить наиболее критичные по времени задачи.

Передовой интеллект на беспрецедентной скорости
Разработчикам ИИ-продуктов всегда приходилось выбирать между скоростью и качеством. По мере роста моделей растут и вычислительные затраты, и издержки на перемещение данных, что замедляет отклик. Пользователям часто приходится либо ждать качественный результат, либо мириться с результатом похуже, но быстрее.
GPT-5.6 Sol Ultrafast снимает эту дилемму, принося передовой интеллект в продукты и рабочие процессы, где важна каждая секунда. По данным Artificial Analysis, GPT-5.6 Sol в режиме Ultrafast работает в 11 раз быстрее, чем Fable 5, и в 5 раз быстрее, чем Opus 4.8 в режиме Fast.

В Cerebras протестировали Ultrafast, сравнив её напрямую с популярными моделями на бенчмарке Humanity's Last Exam. HLE — сложный тест, состоящий из 2500 вопросов, на которые обычно способны ответить только обладатели докторских степеней в таких областях, как химия, экономика и литература.
В ходе тестирования GPT-5.6 Sol в режиме Ultrafast ответила на все 2500 вопросов HLE за 11 часов 11 минут. Claude Fable 5 потребовалось 78 часов 27 минут — более трёх суток непрерывных вычислений — чтобы прийти к тем же результатам. Иными словами, Ultrafast прошла через передний край человеческого знания за один рабочий день, достигнув сопоставимой точности почти в 7 раз быстрее.
Бенчмаркинг проводился Cerebras с использованием GPT 5.6 Sol Ultrafast с Codex при повышенном уровне рассуждений (xhigh) 10 июля, и Claude Fable 5 с Claude Code при том же уровне рассуждений 13–15 июля.
По мере роста возможностей моделей расширяется и спектр применений быстрого инференса. GPT-5.6 Sol — лучшая на сегодня модель OpenAI для юридических документов, финансовых моделей и инженерных отчётов. На бенчмарке GDP-Val, который оценивает экономически значимые задачи интеллектуального труда, Ultrafast показала ускорение в 5,6 раза без потери качества — это демонстрирует, как более быстрый инференс способен ускорять экономически важную работу.

Бенчмаркинг проводился Cerebras 31 июля 2026 года с использованием GPT 5.6 Sol и GPT 5.6 Sol Ultrafast при среднем уровне рассуждений в Codex.
Высокоскоростной интеллект для критически важных задач
Более быстрый интеллект меняет границы возможного для отдельных специалистов и организаций. С Ultrafast агентов можно ставить на критический путь задач, где важна каждая секунда.
С GPT-5.6 Sol Ultrafast Cerebras даёт ИИ, который поспевает за тем, как вы думаете, пишете код и работаете в команде. Интересно наблюдать, как рабочие процессы и приложения преображаются благодаря сверхбыстрому инференсу.
— Роган Варма, продукт-менеджер OpenAI
Ultrafast даёт устойчивое преимущество организациям, использующим передовой ИИ для быстрого реагирования на поступающую информацию. Компании, эксплуатирующие веб-сервисы, могут применять Ultrafast для поиска первопричин и устранения производственных сбоев, сохраняя доверие клиентов, предотвращая потерю выручки и экономя минуты простоя относительно SLA. А в условиях враждебных, высокорисковых кибератак Ultrafast становится незаменимым инструментом для команд безопасности, которым нужно быстро обнаруживать злоумышленников и реагировать на них, чтобы сдержать катастрофические потери.
В более широком смысле Ultrafast открывает совершенно новые режимы работы с агентами: она даёт данные и обновления в реальном времени, избавляя от необходимости переключаться между несколькими параллельными сессиями, чтобы получить максимум от агентов.
Раньше приходилось ждать пару минут, пока задача завершится, а теперь она заканчивается ещё до того, как появляется возможность переключиться на что-то другое. Это делает меня намного продуктивнее.
— Джеффри Ванг, исследователь OpenAI
С Ultrafast исследователи и инженеры могут сосредоточить внимание на глубокой проработке отдельных, наиболее важных задач, продолжая использовать стандартный режим обработки для параллелизации рутинных задач. В Cerebras рассчитывают на то, что новая волна ИИ-инноваций поднимет планку возможностей для отдельных людей и организаций, работающих с отзывчивым ИИ.
Головокружительная скорость — результат прорывных инноваций
GPT-5.6 Sol в режиме Ultrafast работает на революционной архитектуре Wafer-Scale Engine от Cerebras, созданной специально для нагрузок передового ИИ. Быстрый инференс передовых моделей — это, по сути, проблема перемещения данных: на GPU инференс крупных моделей упирается в пропускную способность памяти, поскольку веса модели приходится многократно перегонять между памятью на кристалле и внешним хранилищем для генерации каждого следующего токена в ответе модели.
Cerebras решает эту неэффективность нестандартным способом: на каждом кристалле размером с целую пластину размещается 44 ГБ SRAM. Веса модели остаются на кристалле, а токены проходят без задержек через слои модели, конвейерно распределённые между пластинами. Такой технический подход хорошо масштабируется с ростом размера модели, обеспечивая сохранение преимущества в скорости и на будущих передовых моделях.
Ultrafast: ограниченный превью-доступ
GPT-5.6 Sol в режиме Ultrafast сегодня доступна в ограниченном превью-режиме избранной группе клиентов. Доступ будет расширяться по мере роста вычислительных мощностей.