Дополнение к системной карте GPT‑5: Деликатные разговоры
Когда мы выпустили GPT‑5, мы отметили в системной карте, что работаем над созданием лучших ориентиров (бенчмарков) и продолжением укрепления безопасности моделей в сферах, связанных с психическим и эмоциональным расстройством. 3 октября мы развернули обновление, которое отражает эти усилия и улучшает модель ChatGPT по умолчанию, чтобы она лучше распознавала людей в моменты стресса и поддерживала их. В рамках этой работы мы сотрудничали более чем со 170 экспертами в области психического здоровья, чтобы помочь ChatGPT более надежно распознавать признаки стресса, реагировать с заботой и направлять людей к реальной поддержке, сократив количество ответов, не дотягивающих до нашего желаемого поведения, на 65–80%.
Мы публикуем сопутствующую публикацию в блоге, которая содержит более подробную информацию об этой работе, а также данное дополнение к системной карте GPT‑5, чтобы поделиться базовыми оценками безопасности. Эти оценки сравнивают версию от 15 августа модели ChatGPT по умолчанию (также известную как GPT‑5 Instant) с обновленной версией, запущенной 3 октября.
Автор
Полный текст статьи читайте на OpenAI
