Повышение качества медицинской аналитики в ChatGPT

16x9_Health_SEO_1.png?w=1600&h=900&fit=f

Модель GPT‑5.5 Instant делает передовую медицинскую аналитику доступной для еще большего числа людей благодаря усовершенствованию наших моделей и оценкам экспертов-врачей.

Вопросы здоровья — одна из самых важных тем, с которыми пользователи обращаются к ChatGPT. Каждую неделю более 230 миллионов человек используют ChatGPT для получения помощи в вопросах здоровья и благополучия: для расшифровки медицинской информации, понимания результатов анализов, подготовки к визитам к врачу, навигации по вопросам страховки, выработки полезных привычек и поиска ответов на дальнейшие вопросы.

Вместе с GPT‑5.5 Instant мы наблюдаем значительный качественный скачок в медицинской сфере: улучшилось распознавание случаев, когда может потребоваться неотложная помощь, повысилась способность запрашивать необходимый контекст, объяснять неопределенность и делать сложную информацию более понятной. По результатам наших самых сложных медицинских тестов GPT‑5.5 Instant теперь демонстрирует уровень, сопоставимый с нашими передовыми рассуждающими моделями (Thinking models). Поскольку эта модель доступна всем пользователям бесплатной версии ChatGPT, еще больше людей смогут оценить эти улучшения.

Этот прогресс отражает как развитие возможностей моделей, так и работу врачей, стоящую за нашими медицинскими оценками. Глобальная сеть практикующих врачей помогает определять, что именно означает «хороший» ответ в реальных медицинских ситуациях, анализируя примеры ответов модели, описывая идеальное поведение и выявляя типичные ошибки. Сотрудничество с врачами позволяет нам измерять прогресс в области здравоохранения и постепенно улучшать качество ответов ChatGPT.

Оценка прогресса в сфере здравоохранения

В сфере здравоохранения прогресс означает предоставление точных, понятных и взвешенных ответов: умение распознавать ситуации, когда требуется дополнительный контекст, объяснять неопределенность без излишней самоуверенности и помогать людям вовремя обращаться за медицинской помощью.

Для измерения этого прогресса мы используем специализированные медицинские тесты, включая HealthBench и HealthBench Professional. В этих оценках используются реалистичные медицинские диалоги и критерии, составленные врачами, для проверки таких качеств, как точность, безопасность, качество коммуникации, учет контекста, полнота информации и своевременное перенаправление к специалистам.

GPT‑5.5 Instant достигает эффективности в медицинских вопросах, сопоставимой с нашими новейшими передовыми моделями по совокупности медицинских тестов, включая HealthBench Professional, что значительно превосходит показатели GPT‑5.3 Instant. Модели 5.5 Instant (выпущенная в мае 2026 г.) и 5.3 Instant (выпущенная в марте 2026 г.) доступны всем пользователям бесплатной версии ChatGPT (с учетом лимитов), а для расчета стоимости 5.4 Thinking и 5.5 Thinking мы используем цены API.

В качестве еще одного сравнения мы попросили врачей написать ответы на типичные медицинские диалоги, выделив на это неограниченное время и предоставив доступ к интернету (но не к ИИ). Затем независимая группа врачей сравнила эти ответы специалистов с ответами модели, оценив важные для реального общения качества, включая точность, коммуникацию, полноту, следование инструкциям и полезность рекомендаций, на примере 3 500 проанализированных ответов.

В ходе данной оценки ответы GPT‑5.5 Instant получили более высокие оценки по различным критериям по сравнению с ответами, написанными врачами, и ответами более старых моделей.

По оценкам врачей, у ответов GPT‑5.5 Instant реже встречаются недостатки по сравнению с ответами старых моделей и даже людей-врачей. Например, у GPT‑5.5 Instant реже наблюдались случаи недостаточного учета местного контекста здравоохранения, упущения тревожных симптомов или необходимости направления к врачу, а также отсутствие запроса дополнительного контекста у пользователя при необходимости.

Учитывая масштаб использования наших моделей в сфере здравоохранения, еще один способ оценить недавние улучшения — проанализировать рабочий трафик. Мы используем системы мониторинга с сохранением конфиденциальности для отслеживания возможных проблем с фактологической точностью в медицинских ответах. Сравнивая недавний рабочий трафик в медицинской сфере (составляющий миллиарды сообщений в неделю), мы видим, что доля ответов хотя бы с одной отмеченной проблемой фактологии снизилась на 71% за последние два месяца.

Как выглядят улучшенные ответы

Сравнение ответов моделей на реальные медицинские вопросы показывает, как улучшился ChatGPT в важнейших аспектах: распознавание ситуаций, требующих срочного внимания, более взвешенная оценка неопределенности и предоставление людям более четких и полезных рекомендаций о дальнейших действиях.

Медицинская экспертиза, стоящая за прогрессом

Этот прогресс достигается благодаря врачам, которые помогают нам определять, измерять и улучшать медицинские ответы в ChatGPT.

OpenAI сотрудничает с глобальной сетью, насчитывающей более 260 врачей из 60 стран, говорящих на 49 языках и представляющих 26 медицинских специальностей. Их отзывы определяют то, как ChatGPT отвечает на медицинские вопросы в самых разных сценариях: от повседневных вопросов о благополучии до более сложных клинических ситуаций.

Врачи изучают примеры ответов модели и оценивают их на предмет точности, ясности, полноты, должной осмотрительности и полезности. Они помогают выявить случаи, когда в ответе может отсутствовать важный контекст, когда он звучит излишне самоуверенно, когда стоит четче обозначить следующие шаги или более прямо порекомендовать пользователю обратиться за медицинской помощью.

На сегодняшний день врачи проанализировали более 700 000 примеров ответов модели, отражающих реальное использование ChatGPT пациентами и клиницистами. Каждые несколько минут врач изучает новый ответ. Их отзывы превращаются в критерии оценки и рубрикаторы, помогающие исследователям определять, являются ли ответы точными, безопасными, ясными, полными, осмотрительными и полезными в реальных медицинских ситуациях. Это дает нам четкое понимание того, где модели становятся лучше, а над чем еще стоит поработать.

Предоставление медицинских улучшений большему количеству людей

Эта работа также поддерживает более широкую деятельность OpenAI в области здравоохранения, включая инструменты, созданные для медицинских работников, такие как ChatGPT для клиницистов и OpenAI для здравоохранения, которые помогают медицинским специалистам с такими задачами, как ведение документации, исследования и оказание медицинской помощи.

Улучшение здоровья человека станет одним из самых личных и осязаемых результатов внедрения искусственного общего интеллекта (AGI). По мере того как наши модели продолжают совершенствоваться, наша цель — сделать ChatGPT более точным, полезным и эффективным в такие моменты, а также делать эти достижения доступными для все большего числа людей.

Автор

OpenAI

Полный текст статьи читайте на OpenAI