Системная карта OpenAI GPT‑4.5

Системная карта GPT-4.5
Конкретные области риска
- Запрещенный контент
- Джейлбрейки (взломы защиты)
- Ошибки модели
Оценка готовности
- ХБРЯ (CBRN)Средний
- КибербезопасностьНизкий
- УбеждениеСредний
- Автономность моделиНизкий
Оценки по шкале
- Низкий
- Средний
- Высокий
- Критический
Развертываться могут только модели с оценкой «средняя» или ниже после применения мер смягчения.
Дальнейшая разработка разрешена только для моделей с оценкой «высокая» или ниже после применения мер смягчения.
Введение
Мы выпускаем исследовательскую предварительную версию OpenAI GPT‑4.5 — нашей самой крупной и обладающей наибольшим объемом знаний модели на сегодняшний день. Основываясь на GPT‑4o, модель GPT‑4.5 масштабирует предварительное обучение и создана как более универсальная по сравнению с нашими мощными моделями рассуждений, ориентированными на STEM. Мы обучили ее с использованием новых методов супервизии в сочетании с традиционными подходами, такими как контролируемая доработка (SFT) и обучение с подкреплением на основе отзывов людей (RLHF), аналогично тому, как это делалось для GPT‑4o. Перед развертыванием мы провели масштабную оценку безопасности и не обнаружили какого-либо значительного увеличения рисков безопасности по сравнению с существующими моделями.
Раннее тестирование показывает, что взаимодействие с GPT‑4.5 ощущается более естественным. Ее более широкая база знаний, лучшее соответствие намерениям пользователя и улучшенный эмоциональный интеллект делают ее отлично подходящей для таких задач, как письмо, программирование и решение практических проблем — с меньшим количеством галлюцинаций.
Мы делимся GPT‑4.5 в виде исследовательской предварительной версии, чтобы лучше понять ее сильные стороны и ограничения. Мы все еще изучаем ее возможности и с нетерпением ждем возможности увидеть, как люди будут использовать ее неожиданными для нас способами.
В этой системной карте описывается, как мы создавали и обучали GPT‑4.5, оценивали ее возможности и повышали безопасность, следуя процессу обеспечения безопасности OpenAI и концепции готовности (Preparedness Framework).
Авторы
Полный текст статьи читайте на OpenAI
