Представляем GPT‑5.1 для разработчиков

Сегодня мы выпускаем GPT‑5.1 на платформе API — следующую модель в серии GPT‑5, которая объединяет в себе высокий уровень интеллекта и скорость для широкого спектра автономных задач и задач по программированию. GPT‑5.1 динамически адаптирует время, затрачиваемое на размышления, в зависимости от сложности задачи, что делает модель значительно быстрее и эффективнее с точки зрения расхода токенов при решении повседневных рутинных задач. В модели также появился режим «без рассуждений» (no reasoning), позволяющий быстрее отвечать на задачи, не требующие глубокого анализа, сохраняя при этом передовые интеллектуальные возможности GPT‑5.1.
Чтобы сделать GPT‑5.1 еще эффективнее, мы выпускаем расширенное кэширование промптов с возможностью хранения кэша до 24 часов, что обеспечивает более быстрый ответ на последующие вопросы при меньших затратах. Наши клиенты, использующие приоритетную обработку (Priority Processing), также заметят значительно более высокую производительность GPT‑5.1 по сравнению с GPT‑5.
В области написания кода мы тесно сотрудничали с такими стартапами, как Cursor, Cognition, Augment Code, Factory и Warp, чтобы улучшить характер кодирования, управляемость и качество кода GPT‑5.1. В целом модель GPT‑5.1 кажется более интуитивной в использовании для программирования и более коммуникабельной при отправке пользователю обновлений в процессе выполнения задач.
Наконец, мы представляем два новых инструмента для GPT‑5.1: инструмент apply_patch, предназначенный для более надежного редактирования кода, и инструмент командной строки (shell), позволяющий модели запускать команды оболочки.
GPT‑5.1 — это следующий шаг в развитии серии GPT‑5, и мы планируем продолжить инвестиции в создание более умных и способных моделей, которые помогут разработчикам выстраивать надежные автономные рабочие процессы.
Эффективные рассуждения при решении любых задач
Адаптивные рассуждения
Чтобы сделать GPT‑5.1 быстрее, мы полностью переработали подход к обучению ее мыслительным процессам. На простых задачах GPT‑5.1 тратит на размышления меньше токенов, обеспечивая более высокую скорость работы продуктов и меньшие расходы. На сложных задачах, требующих дополнительных размышлений, модель проявляет настойчивость, изучая варианты и проверяя свою работу для достижения максимальной надежности.
Balyasny Asset Management отметили, что модель GPT‑5.1 «превзошла как GPT‑4.1, так и GPT‑5 в нашем полном наборе динамических тестов, работая при этом в 2–3 раза быстрее, чем GPT‑5». Они также добавили, что при выполнении задач на рассуждение, требующих активного использования инструментов, модель GPT‑5.1 «стабильно расходовала примерно в два раза меньше токенов, чем ведущие конкуренты, при сопоставимом или лучшем качестве». В свою очередь, компания Pace, занимающаяся автоматизацией страховых бизнес-процессов (BPO) с помощью ИИ, также протестировала модель и сообщила, что их агенты работают «на 50% быстрее на базе GPT‑5.1, превосходя при этом показатели точности GPT‑5 и других ведущих моделей во всех наших тестах».
GPT‑5.1 варьирует время на размышления гораздо динамичнее, чем GPT‑5. На репрезентативной выборке задач ChatGPT модель GPT‑5.1 справляется с простыми задачами значительно быстрее, даже при высоком уровне усилий на рассуждение.
Например, на запрос «покажи npm-команду для вывода списка глобально установленных пакетов» GPT‑5.1 отвечает за 2 секунды вместо 10 секунд.
GPT-5 (Medium) тратит ~250 токенов (~10 секунд)
show an npm command to list globally installed packages
npm list -g --depth=0
GPT-5.1 (Medium) тратит ~50 токенов (~2 секунды)
show an npm command to list globally installed packages
Вы можете вывести список глобально установленных npm-пакетов с помощью:
- Только названия пакетов: npm ls -g --depth=0
- Включая пути их установки: npm ls -g
Первый вариант обычно является тем, что вам нужно.
Новый режим «без рассуждений» («no reasoning»)
Теперь разработчики могут использовать GPT‑5.1 без рассуждений, установив параметру reasoning_effort значение 'none'. Это заставляет модель вести себя как модель без механизма рассуждений для сценариев использования, чувствительных к задержкам, сохраняя при этом высокий интеллект GPT‑5.1 и дополнительное преимущество в виде производительного вызова инструментов. По сравнению с GPT‑5 с «минимальным» уровнем рассуждений, модель GPT‑5.1 в режиме без рассуждений лучше справляется с параллельным вызовом инструментов (что само по себе увеличивает скорость выполнения комплексных задач), написанием кода, следованием инструкциям и использованием поисковых инструментов, а также поддерживает веб-поиск в нашей API-платформе. Sierra поделилась, что в их реальных оценках модель GPT‑5.1 в режиме «без рассуждений» показала «улучшение производительности вызова инструментов с низкой задержкой на 20% по сравнению с минимальными рассуждениями GPT‑5».
С появлением значения 'none' для параметра reasoning_effort разработчики получают еще большую гибкость и контроль над балансом между скоростью, стоимостью и интеллектом для своих задач. По умолчанию для GPT‑5.1 установлено значение 'none', что идеально подходит для рабочих нагрузок, чувствительных к задержкам. Мы рекомендуем разработчикам выбирать уровень 'low' (низкий) или 'medium' (средний) для задач повышенной сложности и 'high' (высокий), когда интеллект и надежность важнее скорости.
Расширенное кэширование промптов
Расширенное кэширование повышает эффективность рассуждений, позволяя промптам оставаться активными в кэше в течение до 24 часов, а не нескольких минут, как это поддерживалось ранее. Благодаря увеличенному окну хранения большее количество последующих запросов может задействовать закэшированный контекст, что приводит к снижению задержек, уменьшению затрат и более плавной работе при длительных взаимодействиях, таких как многошаговые чаты, сеансы программирования или рабочие процессы извлечения знаний.
Цены на кэширование промптов остаются прежними: стоимость закэшированных входных токенов на 90% ниже по сравнению с незакэшированными, при этом дополнительная плата за запись в кэш или его хранение не взимается. Чтобы использовать расширенное кэширование с GPT‑5.1, добавьте параметр "prompt_cache_retention='24h'” в API Responses или Chat Completions. Более подробную информацию см. в документации по кэшированию промптов.
Программирование
GPT‑5.1 развивает возможности программирования модели GPT‑5, предлагая более управляемый стиль кодирования, меньшее количество избыточных размышлений, улучшенное качество кода, более качественные ориентированные на пользователя сообщения о состоянии (преамбулы) во время последовательности вызовов инструментов, а также более функциональный дизайн интерфейсов (frontend) — особенно при низких усилиях на рассуждение.
При решении более простых задач по написанию кода, таких как быстрое внесение правок, высокая скорость GPT‑5.1 упрощает процесс многократных итераций. При этом повышенная скорость выполнения простых задач не снижает производительность модели на сложных этапах. В бенчмарке SWE-bench Verified модель GPT‑5.1 работает еще дольше, чем GPT‑5, и достигает результата в 76.3%.
В бенчмарке SWE-bench Verified модели предоставляется репозиторий кода и описание проблемы, после чего она должна сгенерировать патч для ее устранения. Метки обозначают уровень усилий на рассуждения. Точность усреднена по всем 500 проблемам. Во всех моделях использовался инструмент apply_patch на базе JSON.
Мы получили предварительные отзывы о GPT‑5.1 от нескольких компаний, занимающихся разработкой ПО. Вот их впечатления:
- Augment Code назвали GPT‑5.1 «более целенаправленной, с меньшим количеством пустых действий, более эффективными рассуждениями и лучшей концентрацией на задачах», отметив, что они видят «более точные изменения, более плавные пул-реквесты и ускоренные итерации в проектах с несколькими файлами».
- Clineподелились, что в их оценках «GPT‑5.1 достигла уровня SOTA в нашем бенчмарке редактирования diff с улучшением на 7%, продемонстрировав исключительную надежность при решении сложных задач по программированию».
- CodeRabbit назвали GPT‑5.1 своей «предпочтительной моделью номер один для код-ревью».
- Cognition заявили, что GPT‑5.1 «заметно лучше понимает ваши запросы и работает в тесном сотрудничестве с вами для достижения результата».
- Factory отметили, что «GPT‑5.1 выдает заметно более быстрые ответы и адаптирует глубину рассуждений под конкретную задачу, сокращая избыточные размышления и улучшая общий опыт разработчика».
- Warp делают GPT‑5.1 моделью по умолчанию для новых пользователей, заявляя, что она «развивает впечатляющие достижения в области интеллекта, представленные в серии GPT‑5, являясь при этом гораздо более отзывчивой моделью».
«GPT 5.1 — это не просто очередная LLM. Это поистине агентная и самая естественно автономная модель из всех, что я когда-либо тестировал. Она пишет как вы, кодит как вы, легко следует сложным инструкциям и превосходно справляется с фронтенд-задачами, органично вписываясь в вашу существующую кодовую базу. Вы действительно можете раскрыть ее потенциал в Responses API, и мы рады предложить ее в нашей IDE.»
Новые инструменты в GPT‑5.1
Мы представляем два новых инструмента для GPT‑5.1, которые помогут разработчикам извлечь максимум пользы из модели в Responses API: свободный инструмент apply_patch для более надежного редактирования кода без необходимости экранирования JSON, а также инструментоболочки (shell tool), который позволяет модели писать команды для выполнения на вашей локальной машине.
Инструмент Apply_patch
Свободный инструмент apply_patch позволяет модели GPT‑5.1 создавать, обновлять и удалять файлы в кодовой базе с использованием структурированных diff-файлов. Вместо того чтобы просто предлагать правки, модель генерирует операции патчей, которые приложение применяет и по которым возвращает отчет, что обеспечивает итеративные многошаговые рабочие процессы редактирования кода.
Чтобы использовать инструмент apply_patch в Responses API, включите его в массив tools с помощью "tools": [{"type”: "apply_patch”}], а также либо включите содержимое файлов во входные данные, либо предоставьте модели инструменты для взаимодействия с вашей файловой системой. Модель будет генерировать элементы apply_patch_call для создания, обновления или удаления файлов, содержащие diff-патчи, которые вы применяете в своей файловой системе. Дополнительные сведения об интеграции с инструментом apply_patch см. в нашей документации для разработчиков.
Инструмент Shell
Инструмент командной строки (shell) позволяет модели взаимодействовать с локальным компьютером через контролируемый интерфейс командной строки. Модель предлагает команды оболочки; интеграция разработчика выполняет их и возвращает результаты. Это создает простой цикл «планирование-выполнение», который позволяет моделям исследовать систему, запускать утилиты и собирать данные до тех пор, пока задача не будет выполнена.
Чтобы использовать инструмент shell в Responses API, разработчики могут добавить его в массив tools со значением »tools": [{"type”: "shell”}]. API будет генерировать элементы "shell_call", содержащие команды оболочки для выполнения. Разработчики выполняют команды в локальной среде и передают результаты выполнения обратно в элементе "shell_call_output" в следующем запросе API. Узнайте больше в нашей документации для разработчиков.
Цены и доступность
Модели GPT‑5.1 и gpt-5.1-chat-latest доступны разработчикам на всех платных тарифных планах в API. Цены и лимиты запросов такие же, как у GPT‑5. Мы также выпускаем gpt-5.1-codex и gpt-5.1-codex-mini в API. Хотя GPT‑5.1 превосходно справляется с большинством задач по написанию кода, модели gpt-5.1-codex оптимизированы для длительных автономных задач программирования в Codex или аналогичных средах.
Разработчики могут начать создание приложений, используя нашу документацию для разработчиков по GPT‑5.1 и руководство по составлению промптов. В настоящее время мы не планируем прекращать поддержку GPT‑5 в API и заблаговременное предупредим разработчиков, если и когда примем такое решение.
Что дальше
Мы стремимся поэтапно внедрять самые мощные и надежные модели для реальной автономной работы и программирования — модели, которые мыслят эффективно, быстро итеративно совершенствуются и справляются со сложными задачами, не отвлекая разработчиков от рабочего процесса. Благодаря адаптивным рассуждениям, улучшенной производительности кодирования, более понятным обновлениям для пользователей и новым инструментам, таким как apply_patch и shell, GPT‑5.1 создана для того, чтобы помочь вам создавать продукты с меньшими трудностями. И мы продолжаем активно инвестировать в это направление: в ближайшие недели и месяцы вы можете ожидать появления еще более мощных автономных моделей и моделей для программирования.
Приложение: Оценки моделей
Оценка | GPT‑5.1 (высокий уровень) | GPT‑5 (высокий уровень) |
SWE-bench Verified | 76.3% | 72.8% |
GPQA Diamond | 88.1% | 85.7% |
AIME 2025 | 94.0% | 94.6% |
FrontierMath | 26.7% | 26.3% |
MMMU | 85.4% | 84.2% |
Tau2-bench Airline | 67.0% | 62.6% |
Tau2-bench Telecom* | 95.6% | 96.7% |
Tau2-bench Retail | 77.9% | 81.1% |
BrowseComp Long Context 128k | 90.0% | 90.0% |
* Для Tau2-bench Telecom мы предоставили GPT‑5.1 короткий, общий полезный промпт для повышения её производительности.
Автор
Полный текст статьи читайте на OpenAI
