Представляем OpenAI o1‑preview
Обновление от 17 сентября 2024 г.: Ограничения на использование теперь составляют 50 запросов в неделю для o1‑preview и 50 запросов в день для o1‑mini.
Мы разработали новую серию моделей искусственного интеллекта, созданных для того, чтобы тратить больше времени на размышления перед ответом. Они способны рассуждать над сложными задачами и решать более трудные проблемы в области науки, программирования и математики по сравнению с предыдущими моделями.
Сегодня мы выпускаем первую модель из этой серии в ChatGPT и через наш API. Это предварительная версия, и мы ожидаем регулярные обновления и улучшения. Вместе с этим релизом мы также публикуем оценки для следующего обновления, которое в настоящее время находится в разработке.
Как это работает
Мы обучили эти модели тратить больше времени на обдумывание проблем перед ответом, подобно тому, как это делает человек. В процессе обучения они учатся совершенствовать свой мыслительный процесс, пробовать различные стратегии и распознавать свои ошибки.
В наших тестах обновление следующей модели демонстрирует результаты на уровне аспирантов при решении сложных бенчмарк-задач по физике, химии и биологии. Мы также обнаружили, что она превосходно справляется с математикой и программированием. На отборочном экзамене Международной математической олимпиады (IMO) модель GPT‑4o правильно решила лишь 13% задач, в то время как модель с возможностью рассуждения набрала 83%. Их навыки программирования оценивались в соревнованиях и достигли 89-го процентиля в состязаниях на Codeforces. Вы можете прочитать об этом подробнее в нашей технической исследовательской статье.
Будучи ранней моделью, она пока не обладает многими функциями, которые делают ChatGPT полезным, такими как поиск информации в интернете, а также загрузка файлов и изображений. В ближайшей перспективе для многих повседневных задач GPT‑4o будет более функциональной.
Но для задач, требующих сложных рассуждений, это значительный шаг вперед и новый уровень возможностей искусственного интеллекта. Учитывая это, мы сбрасываем счетчик обратно до 1 и называем эту серию OpenAI o1.
Безопасность
В рамках разработки этих новых моделей мы создали новый подход к обучению безопасности, который использует их возможности рассуждения для соблюдения правил безопасности и согласованности (alignment). Благодаря способности анализировать наши правила безопасности в контексте, модель может применять их более эффективно.
Один из способов измерения безопасности — тестирование того, насколько успешно наша модель продолжает следовать своим правилам безопасности, если пользователь пытается их обойти (известно как «джейлбрейк»). В одном из наших самых сложных тестов на джейлбрейк GPT‑4o набрала 22 балла (по шкале от 0 до 100), в то время как наша модель o1‑preview набрала 84 балла. Вы можете узнать больше об этом в системной карте и в нашей исследовательской статье.
Чтобы соответствовать новым возможностям этих моделей, мы усилили нашу работу по обеспечению безопасности, внутреннее управление и сотрудничество с федеральным правительством. Это включает в себя строгие тесты и оценки с использованием нашей структуры готовности (Preparedness Framework), лучший в своем классе ред-тестинг (red teaming) и процессы проверки на уровне совета директоров, в том числе силами нашего Комитета по безопасности и защите (Safety & Security Committee).
В рамках нашего обязательства по обеспечению безопасности ИИ мы недавно оформили соглашения с Институтами безопасности ИИ США и Великобритании. Мы начали реализацию этих соглашений на практике, включая предоставление институтам раннего доступа к исследовательской версии этой модели. Это стало важным первым шагом в нашем партнерстве, помогающим установить процесс исследования, оценки и тестирования будущих моделей до и после их официального выпуска.
Для кого это предназначено
Эти расширенные возможности рассуждения могут оказаться особенно полезными, если вы решаете сложные задачи в области науки, программирования, математики и смежных дисциплинах. Например, o1 может использоваться исследователями в области здравоохранения для аннотирования данных секвенирования клеток, физиками — для генерации сложных математических формул, необходимых в квантовой оптике, а разработчиками из всех сфер — для создания и выполнения многошаговых рабочих процессов.
OpenAI o1-mini
Серия o1 превосходно справляется с точной генерацией и отладкой сложного кода. Чтобы предложить разработчикам более эффективное решение, мы также выпускаем OpenAI o1‑mini, более быструю и дешевую модель для рассуждений, которая особенно эффективна в программировании. Будучи меньшей по размеру моделью, o1‑mini на 80% дешевле, чем o1‑preview, что делает ее мощным и экономичным решением для приложений, требующих навыков рассуждения, но не нуждающихся в широких общемировых знаниях.
Как использовать OpenAI o1
Пользователи ChatGPT Plus и Team смогут получить доступ к моделям o1 в ChatGPT начиная с сегодняшнего дня. И o1‑preview, и o1‑mini можно выбрать вручную в меню выбора моделей, а на момент запуска недельные лимиты запросов составят 30 сообщений для o1‑preview и 50 для o1‑mini. Мы работаем над увеличением этих лимитов и над тем, чтобы ChatGPT мог автоматически выбирать правильную модель для конкретного запроса.

Пользователи ChatGPT Enterprise и Edu получат доступ к обеим моделям начиная со следующей недели.
Разработчики, которые соответствуют требованиям5-го уровня использования API (API usage tier 5), могут начать прототипирование с обеими моделями в API уже сегодня с лимитом в 20 запросов в минуту (RPM). Мы работаем над увеличением этих лимитов после проведения дополнительных тестов. API для этих моделей в настоящее время не включает вызов функций (function calling), стриминг (streaming), поддержку системных сообщений и некоторые другие функции. Чтобы начать работу, ознакомьтесь с документацией по API.
Мы также планируем предоставить доступ к o1‑mini всем бесплатным пользователямChatGPT.
Что дальше
Это ранняя предварительная версия данных моделей рассуждения в ChatGPT и API. Помимо обновлений самих моделей, мы планируем добавить функции поиска в интернете, загрузки файлов и изображений, а также другие возможности, чтобы сделать их еще более полезными для каждого.
Мы также планируем продолжать разработку и выпуск моделей нашей серии GPT в дополнение к новой серии OpenAI o1.
- Попробовать в ChatGPT Plus
- Попробовать в API
Авторы
Полный текст статьи читайте на OpenAI
