Системная карта OpenAI GPT‑4.5

GPT-4.5_system_card_16.9.png?w=1600&h=90
Читать системную картуАвторы

Системная карта GPT-4.5

Конкретные области риска

  • Запрещенный контент
  • Джейлбрейки (взломы защиты)
  • Ошибки модели

Оценка готовности

  • ХБРЯ (CBRN)
    Средний
  • Кибербезопасность
    Низкий
  • Убеждение
    Средний
  • Автономность модели
    Низкий

Оценки по шкале

  • Низкий
  • Средний
  • Высокий
  • Критический

Развертываться могут только модели с оценкой «средняя» или ниже после применения мер смягчения.
Дальнейшая разработка разрешена только для моделей с оценкой «высокая» или ниже после применения мер смягчения.

Введение

Мы выпускаем исследовательскую предварительную версию OpenAI GPT‑4.5 — нашей самой крупной и обладающей наибольшим объемом знаний модели на сегодняшний день. Основываясь на GPT‑4o, модель GPT‑4.5 масштабирует предварительное обучение и создана как более универсальная по сравнению с нашими мощными моделями рассуждений, ориентированными на STEM. Мы обучили ее с использованием новых методов супервизии в сочетании с традиционными подходами, такими как контролируемая доработка (SFT) и обучение с подкреплением на основе отзывов людей (RLHF), аналогично тому, как это делалось для GPT‑4o. Перед развертыванием мы провели масштабную оценку безопасности и не обнаружили какого-либо значительного увеличения рисков безопасности по сравнению с существующими моделями.

Раннее тестирование показывает, что взаимодействие с GPT‑4.5 ощущается более естественным. Ее более широкая база знаний, лучшее соответствие намерениям пользователя и улучшенный эмоциональный интеллект делают ее отлично подходящей для таких задач, как письмо, программирование и решение практических проблем — с меньшим количеством галлюцинаций.

Мы делимся GPT‑4.5 в виде исследовательской предварительной версии, чтобы лучше понять ее сильные стороны и ограничения. Мы все еще изучаем ее возможности и с нетерпением ждем возможности увидеть, как люди будут использовать ее неожиданными для нас способами.

В этой системной карте описывается, как мы создавали и обучали GPT‑4.5, оценивали ее возможности и повышали безопасность, следуя процессу обеспечения безопасности OpenAI и концепции готовности (Preparedness Framework).

Авторы

OpenAI

Полный текст статьи читайте на OpenAI