Предварительный просмотр режима Ultrafast: GPT‑5.6 Sol со скоростью до 14 раз выше

previewing-ultrafast-mode--seo-v001.png?

Новый класс скорости для передового интеллекта, превращающий скорость в конкурентное преимущество.

Получать новости о доступе

Сегодня мы представляем предварительную версию Ultrafast — нового тарифного плана, в котором модель GPT‑5.6 Sol работает вплоть до 14 раз быстрее по сравнению со стандартной обработкой. Первым этот сервис запускается в OpenAI API. Работающий на базе технологий Cerebras, режим Ultrafast генерирует до 750 токенов вывода в секунду, делая нашу самую интеллектуальную на момент анонса модель доступной для продуктов и рабочих процессов, где каждая секунда имеет значение.

С выходом GPT‑5.6 мы раздвигаем границы возможностей наших моделей и повышаем их эффективность на каждом уровне нашей технологической цепочки. Эти улучшения сделали передовой искусственный интеллект более доступным по цене и полезным для большего числа людей. До сих пор достижение реального времени отклика обычно означало выбор в пользу меньшей или более узкоспециализированной модели. Ultrafast указывает путь в новом направлении: больше полезной работы в секунду.

Когда скорость больше не требует компромиссов в интеллекте, ИИ может проникать в самые критичные ко времени бизнес-процессы, и становятся возможными новые виды работ. Мы уже наблюдаем несколько перспективных сценариев применения Ultrafast:

  • Реагирование на инциденты и обеспечение надежности: при сбое критически важной системы — анализ логов приложений, недавних изменений в коде и отчетов инженеров для выявления вероятной причины и помощи в подготовке исправления прямо во время развития аварийной ситуации.
  • Финансовые исследования и безопасность: анализ рыночных сигналов, оценка транзакций и выявление подозрительной активности в условиях постоянно меняющейся обстановки.
  • Поддержка клиентов и голосовые ассистенты: решение сложных вопросов клиентов в реальном времени без прерывания разговора, даже если для поиска ответа требуется задействовать несколько шагов или систем.
  • Электронная коммерция: ответы на вопросы о товарах, проверка запасов, персонализация рекомендаций и решение проблем с оформлением заказа, пока покупатель еще делает выбор, предотвращая уход с брошенной корзиной.
  • Интерактивные исследования и эксперименты: превращение исследований, которые раньше выполнялись за ночь, в интерактивную рабочую сессию, позволяющую командам тестировать идею, изучать результаты, корректировать подход и запускать новый эксперимент без потери рабочей концентрации.

В период предварительного просмотра мы работаем с первой группой клиентов, чтобы понять, в каких сценариях такая скорость дает наибольший прирост ценности, и как эти знания в дальнейшем повлияют на наши продукты. Если вашему бизнесу требуется передовой интеллект на максимальной скорости, вы можете подписаться на уведомления о расширении доступа.

GPT‑5.6 Sol Ultrafast и стандартная версия создают работающий симулятор 3D-склада по одному текстовому запросу (показано параллельно).

Впечатления первых клиентов

Мы тестировали GPT‑5.6 Sol в режиме Ultrafast совместно с начальной группой компаний из сфер программирования, электронной коммерции, финансовых исследований, поддержки пользователей и других интерактивных приложений. Начало работы с реальными бизнес-процессами позволяет нам изучать эти условия в условиях полноценной продакшн-среды. Первые результаты помогают понять, где увеличение скорости на порядок создает наибольшую ценность и как меняются продукты, когда модель успевает за ходом мыслей пользователя. Мы будем использовать эти выводы для планирования развертывания по мере роста вычислительных мощностей.

1 из 4
»Прирост скорости, обеспечиваемый Cerebras, впечатляет. Это открывает новые сценарии использования моделей и делает для разработчиков практичным и продуктивным взаимодействие с ИИ в режиме реального времени.»
— Джон Крепецци (John Crepezzi), направление ИИ-ассистентов, Jane Street

Как OpenAI использует Ultrafast

Внутри OpenAI группа разработчиков тестирует GPT‑5.6 Sol в режиме Ultrafast, чтобы понять, каким рабочим процессам идет на пользу передовой интеллект, способный отвечать в реальном времени.

Реагирование на инциденты — один из примеров, где наша команда использует Ultrafast. При срабатывании оповещения инженерам необходимо составить точную картину происходящего в условиях, когда система и симптомы еще меняются. Команды используют инструмент для быстрого чтения логов, анализа трассировок, синтеза обсуждений, определения следующих проверок и помощи в подготовке или проверке исправления — и все это за малую долю времени при сохранении возможностей модели Sol. Это сокращает задержку между обнаружением сигнала, проверкой гипотезы и выбором следующего шага, при этом окончательное решение и развертывание остаются за инженерами.

В исследовательских задачах наша команда применяет Ultrafast для быстрого поиска по базам знаний, запросов к данным, а также для оперативного сбора, организации и суммирования информации из связанных инструментов. Типичным сценарием в исследованиях ранее был запуск пакета экспериментов на ночь с просмотром результатов утром. С Ultrafast этот цикл сокращается до нескольких итераций в течение одного рабочего дня.

Работа на базе технологий Cerebras

Ultrafast знаменует собой следующий шаг в нашем партнерстве с Cerebras по внедрению инференса с ультранизкими задержками на платформу OpenAI. Теперь, с моделью GPT‑5.6 Sol в режиме Ultrafast, Cerebras поддерживает самую интеллектуальную модель OpenAI на момент этого анонса, обеспечивая скорость до 750 токенов вывода в секунду. Это позволяет компаниям создавать более отзывчивые продукты, принимать решения быстрее и внедрять мощный ИИ непосредственно в самые требовательные рабочие процессы.

Доступность

GPT‑5.6 Sol в режиме Ultrafast сегодня доступен в рамках ограниченного предварительного просмотра для избранной группы клиентов. Мы будем расширять доступ по мере роста мощностей. Подпишитесь на обновления.

Автор

OpenAI

Полный текст статьи читайте на OpenAI