Представьте: нейросеть, которая безупречно проходит тесты на толерантность, в реальном диалоге советует держаться подальше от человека с ВИЧ. Звучит как научная фантастика? Увы, это данные свежего исследования, опубликованного в авторитетном журнале Nature Health.
Учёные решили проверить шесть популярных языковых моделей, включая ChatGPT, Grok и Claude, на наличие скрытых предубеждений в медицинском контексте. Сначала алгоритмы прогоняли через стандартные психологические опросники, оценивающие склонность к стигматизации. И здесь ИИ показал блестящие результаты — даже лучше, чем усреднённые показатели выборки из 56 тысяч реальных людей. Казалось бы, можно выдохнуть.
Но когда задачу усложнили, картина резко изменилась. Нейросетям предложили завершить повседневные истории о вымышленных персонажах — всего разработали более 50 сценариев, в которых менялся только один параметр: медицинский статус героя. Всё остальное оставалось идентичным. Модели сгенерировали свыше 60 тысяч вариантов концовок на английском и китайском языках. И вот тут вскрылась тревожная закономерность.
Персонажей с шизофренией или ВИЧ алгоритмы регулярно описывали как опасных и рекомендовали соблюдать дистанцию. Героев с повышенным давлением или болями в спине чаще наделяли чертами некомпетентности. Примечательно, что уровень дискриминации зависел и от языка запроса: китайские формулировки провоцировали больше предвзятых ответов, чем английские.
Впрочем, исследователи нашли и обнадёживающий момент: если перед выдачей ответа попросить модель рассуждать шаг за шагом, токсичность суждений резко снижается. Это говорит о том, что проблема не фатальна, но требует осознанного подхода.
Главный вывод: стандартные тесты на толерантность не отражают реального поведения ИИ в бытовых сценариях. Авторы работы призывают технологические компании проводить обязательный аудит контекстных суждений перед тем, как запускать медицинских ассистентов в клиническую практику.
Пока же важно помнить: даже самые продвинутые алгоритмы — не более чем инструмент, и полагаться на них без критической оценки опасно. Любые рекомендации, полученные от ИИ, требуют проверки и обязательной консультации с квалифицированным врачом. Технологии будущего не должны подменять человеческое участие и эмпатию — особенно там, где речь идёт о здоровье и жизни людей.