Исследование: пациенты чаще доверяют медицинским советам ИИ, чем врачей, даже если ответы неверные
Как проводилось исследование
Команда исследователей из Массачусетского технологического института, Стэнфорда, Корнелла, Медицинского центра Бет Израэль и IBM решила проверить, как пациенты воспринимают советы от врачей и ИИ. В качестве базы использовали 150 медицинских вопросов с сайта HealthTap. Ответы на эти вопросы подготовили два источника: врачи и GPT-3 - более ранняя версия генеративной модели OpenAI .
Затем специалисты сформировали три набора данных:
- 30 вопросов с ответами от реальных врачей,
- 30 с «качественными» ответами ИИ, которые врачи признали в целом верными,
- 30 с «низкокачественными» ответами ИИ, которые медики оценили как неверные или сомнительные.
Участниками эксперимента стали 300 человек, разделённые на три группы. Каждой предлагалось оценить 10 случайных пар «вопрос-ответ».
Что показали эксперименты
Результаты оказались неожиданными и тревожными:
- Первый эксперимент. Участники практически не могли определить, кто дал ответ - врач или ИИ. Точность угадывания составила всего 50–53%, то есть не выше случайного выбора. При этом люди демонстрировали высокую уверенность в своей оценке, даже когда ошибались.
- Второй эксперимент. Когда респонденты оценивали полезность и достоверность ответов без информации об их источнике, они сочли советы ИИ «значительно более валидными», чем врачебные. Даже ошибки ИИ воспринимались как сопоставимые по ценности с рекомендациями специалистов.
- Третий эксперимент. Здесь ответы снабжались случайными метками «врач», «ИИ» или «врач с ИИ». Оказалось, что сама метка сильно влияла на восприятие: если человеку говорили, что ответ дал врач, доверие резко возрастало - даже если это был на самом деле текст, сгенерированный машиной.
Отдельные тесты показали: даже врачи не всегда способны различить ответы коллег и ИИ. Когда они не знали источник, оценки совпадали. Но стоило добавить пометку «ответ от ИИ», их доверие сразу снижалось.
Почему это опасно
Авторы исследования предупреждают, что такая «переоценка» советов ИИ создаёт угрозу: пациенты могут следовать ошибочным рекомендациям так же охотно, как и врачебным.
«Когда некорректные ответы воспринимаются как надёжные и равнозначные советам врачей, это становится опасным сценарием, - пишут исследователи. - Особенно если учитывать, что многие люди не осознают разницу между источниками».
При этом парадоксально, что люди меньше доверяли ответам, если считали, что они принадлежат врачу, использующему ИИ. То есть сочетание «человека и машины» воспринималось менее убедительно, чем врач или ИИ по отдельности.
Есть ли плюсы у ИИ в медицине
Несмотря на риски, другие исследования показывают, что при правильном применении ИИ может стать мощным инструментом для врачей. Так, работа в журнале Nature Medicine (декабрь 2023) показала, что врачи, использующие GPT-4 для диагностики в симуляции, справлялись лучше, чем коллеги, полагающиеся на традиционные ресурсы.
Эти данные подтверждают: будущее медицины - в интеграции технологий, но при обязательном условии экспертного контроля. Как отмечает профессор Гарвардской медицинской школы Айзек Кохан, ключевым критерием должно стать качество лечения, а не только скорость получения ответа:
«Мы должны сравнивать не просто точность ответов, а конечные результаты лечения пациентов - как в системе с дефицитом врачей, так и при использовании ИИ», - пишет он.
Выводы
Исследование поднимает важный вопрос: можно ли доверять ИИ в критически важных сферах, где ошибки могут стоить жизни? Эксперты уверены, что ИИ способен улучшить медицину, но только как вспомогательный инструмент под контролем профессионалов, а не замена живого врача.