Предварительный просмотр режима Ultrafast: GPT‑5.6 Sol со скоростью до 14 раз выше

Новый класс скорости для передового интеллекта, превращающий скорость в конкурентное преимущество.
Сегодня мы представляем предварительную версию Ultrafast — нового тарифного плана, в котором модель GPT‑5.6 Sol работает вплоть до 14 раз быстрее по сравнению со стандартной обработкой. Первым этот сервис запускается в OpenAI API. Работающий на базе технологий Cerebras, режим Ultrafast генерирует до 750 токенов вывода в секунду, делая нашу самую интеллектуальную на момент анонса модель доступной для продуктов и рабочих процессов, где каждая секунда имеет значение.
С выходом GPT‑5.6 мы раздвигаем границы возможностей наших моделей и повышаем их эффективность на каждом уровне нашей технологической цепочки. Эти улучшения сделали передовой искусственный интеллект более доступным по цене и полезным для большего числа людей. До сих пор достижение реального времени отклика обычно означало выбор в пользу меньшей или более узкоспециализированной модели. Ultrafast указывает путь в новом направлении: больше полезной работы в секунду.
Когда скорость больше не требует компромиссов в интеллекте, ИИ может проникать в самые критичные ко времени бизнес-процессы, и становятся возможными новые виды работ. Мы уже наблюдаем несколько перспективных сценариев применения Ultrafast:
- Реагирование на инциденты и обеспечение надежности: при сбое критически важной системы — анализ логов приложений, недавних изменений в коде и отчетов инженеров для выявления вероятной причины и помощи в подготовке исправления прямо во время развития аварийной ситуации.
- Финансовые исследования и безопасность: анализ рыночных сигналов, оценка транзакций и выявление подозрительной активности в условиях постоянно меняющейся обстановки.
- Поддержка клиентов и голосовые ассистенты: решение сложных вопросов клиентов в реальном времени без прерывания разговора, даже если для поиска ответа требуется задействовать несколько шагов или систем.
- Электронная коммерция: ответы на вопросы о товарах, проверка запасов, персонализация рекомендаций и решение проблем с оформлением заказа, пока покупатель еще делает выбор, предотвращая уход с брошенной корзиной.
- Интерактивные исследования и эксперименты: превращение исследований, которые раньше выполнялись за ночь, в интерактивную рабочую сессию, позволяющую командам тестировать идею, изучать результаты, корректировать подход и запускать новый эксперимент без потери рабочей концентрации.
В период предварительного просмотра мы работаем с первой группой клиентов, чтобы понять, в каких сценариях такая скорость дает наибольший прирост ценности, и как эти знания в дальнейшем повлияют на наши продукты. Если вашему бизнесу требуется передовой интеллект на максимальной скорости, вы можете подписаться на уведомления о расширении доступа.
GPT‑5.6 Sol Ultrafast и стандартная версия создают работающий симулятор 3D-склада по одному текстовому запросу (показано параллельно).
Впечатления первых клиентов
Мы тестировали GPT‑5.6 Sol в режиме Ultrafast совместно с начальной группой компаний из сфер программирования, электронной коммерции, финансовых исследований, поддержки пользователей и других интерактивных приложений. Начало работы с реальными бизнес-процессами позволяет нам изучать эти условия в условиях полноценной продакшн-среды. Первые результаты помогают понять, где увеличение скорости на порядок создает наибольшую ценность и как меняются продукты, когда модель успевает за ходом мыслей пользователя. Мы будем использовать эти выводы для планирования развертывания по мере роста вычислительных мощностей.
»Прирост скорости, обеспечиваемый Cerebras, впечатляет. Это открывает новые сценарии использования моделей и делает для разработчиков практичным и продуктивным взаимодействие с ИИ в режиме реального времени.»— Джон Крепецци (John Crepezzi), направление ИИ-ассистентов, Jane Street
Как OpenAI использует Ultrafast
Внутри OpenAI группа разработчиков тестирует GPT‑5.6 Sol в режиме Ultrafast, чтобы понять, каким рабочим процессам идет на пользу передовой интеллект, способный отвечать в реальном времени.
Реагирование на инциденты — один из примеров, где наша команда использует Ultrafast. При срабатывании оповещения инженерам необходимо составить точную картину происходящего в условиях, когда система и симптомы еще меняются. Команды используют инструмент для быстрого чтения логов, анализа трассировок, синтеза обсуждений, определения следующих проверок и помощи в подготовке или проверке исправления — и все это за малую долю времени при сохранении возможностей модели Sol. Это сокращает задержку между обнаружением сигнала, проверкой гипотезы и выбором следующего шага, при этом окончательное решение и развертывание остаются за инженерами.
В исследовательских задачах наша команда применяет Ultrafast для быстрого поиска по базам знаний, запросов к данным, а также для оперативного сбора, организации и суммирования информации из связанных инструментов. Типичным сценарием в исследованиях ранее был запуск пакета экспериментов на ночь с просмотром результатов утром. С Ultrafast этот цикл сокращается до нескольких итераций в течение одного рабочего дня.
Работа на базе технологий Cerebras
Ultrafast знаменует собой следующий шаг в нашем партнерстве с Cerebras по внедрению инференса с ультранизкими задержками на платформу OpenAI. Теперь, с моделью GPT‑5.6 Sol в режиме Ultrafast, Cerebras поддерживает самую интеллектуальную модель OpenAI на момент этого анонса, обеспечивая скорость до 750 токенов вывода в секунду. Это позволяет компаниям создавать более отзывчивые продукты, принимать решения быстрее и внедрять мощный ИИ непосредственно в самые требовательные рабочие процессы.
Доступность
GPT‑5.6 Sol в режиме Ultrafast сегодня доступен в рамках ограниченного предварительного просмотра для избранной группы клиентов. Мы будем расширять доступ по мере роста мощностей. Подпишитесь на обновления.
Автор
Полный текст статьи читайте на OpenAI
