Инструменты23 сентября 2026 г., 23:03 МСК🤖 Auto

OpenAI представил MentalHealthBench: новый стандарт оценки ИИ в психиатрии

OpenAI выпустила специализированный бенчмарк MentalHealthBench для объективной оценки способности языковых моделей оказывать безопасную и эффективную психологическую поддержку.

Баннер новости 8130

Проблема безопасности в психиатрической помощи

Развитие больших языковых моделей (LLM) для использования в сфере ментального здоровья столкнулось с серьезным препятствием: отсутствием надежных метрик для оценки не только эффективности, но и безопасности ответов. Неправильные или токсичные рекомендации от ИИ могут нанести реальный вред пользователям, что требует строгого контроля качества.

Компания OpenAI представила MentalHealthBench — первый в своем роде бенчмарк, разработанный специально для тестирования моделей в контексте психиатрической помощи. Цель проекта — создать стандартизированный инструмент, позволяющий исследователям и разработчикам измерять, насколько хорошо ИИ справляется с деликатными темами, кризисными состояниями и этическими дилеммами.

Методология и структура оценки

MentalHealthBench базируется на анализе сотен сценариев, имитирующих реальные диалоги между пациентом и терапевтом. Оценка производится по нескольким ключевым направлениям:

  • Безопасность (Safety): Способность модели избегать вредных советов, саморазрушительных рекомендаций и токсичных высказываний.
  • Эмпатия и поддержка: Насколько ответ модели соответствует стандартам профессиональной психологической помощи.
  • Соблюдение протоколов: Умение модели распознавать кризисные ситуации (например, суицидальные намерения) и направлять пользователя к профессиональной помощи, а не пытаться «лечить» самостоятельно.

Исследователи отмечают, что традиционные бенчмарки часто упускают нюансы человеческого общения, поэтому MentalHealthBench включает в себя как количественные метрики, так и качественные оценки от экспертов-психиатров.

Значение для индустрии

Внедрение MentalHealthBench знаменует собой переход от эмпирического тестирования ИИ к научно обоснованной оценке. Это позволяет:

  1. Сравнивать различные модели на единой, прозрачной основе.
  2. Выявлять «слепые зоны» в обучении моделей, связанные с ментальным здоровьем.
  3. Повышать доверие пользователей к ИИ-ассистентам, гарантируя, что они не навредят в уязвимые моменты жизни.

OpenAI подчеркивает, что разработка бенчмарка велась в тесном сотрудничестве с экспертами в области психического здоровья, чтобы обеспечить максимальную релевантность тестовых сценариев реальным клиническим практикам.

Источник: OpenAI ↗