Искусственный интеллект в медицине: может ли ChatGPT Health заменить врача или это опасный эксперимент?

Подробный разбор запуска ChatGPT Health: как искусственный интеллект используется для медицинских консультаций, какова точность его диагностики, риски недооценки симпт...

Материал носит информационный характер и не заменяет консультацию психолога или врача.

Искусственный интеллект в медицине: может ли ChatGPT Health заменить врача или это опасный эксперимент?

По теме

Как люди с пограничным расстройством личности могут найти вн...

Узнайте, как новый инновационный терапевтический подход под названием «Компас ПРЛ» помогает людям с ...

Биполярное расстройство и преждевременная смертность: основн...

Биполярное расстройство значительно увеличивает риск преждевременной смерти — в два раза по сравнени...

Связь между инфекциями от клещей и кошек и суицидальным пове...

В статье рассматривается новое исследование, обнаружившее ДНК паразитов и бактерий, переносимых клещ...

Когнитивный анализ мотивов употребления алкоголя: желание пр...

Исследование изучает связь между самоотчетами о желании (wanting), удовольствием (liking), мотивами ...

Как психосоциальный стресс искажает восприятие времени: нейр...

Исследование раскрывает механизмы влияния психосоциального стресса на восприятие времени, анализируя...

22 типа словесного насилия над детьми: виды, последствия и з...

Исследование 166 научных работ выявило 22 типа словесного насилия над детьми (CVA). Узнайте о связи ...

Оригинал исследования на сайте автора

Более 300 миллионов человек каждую неделю обращаются к чат-боту ШаТэПэЖэ (ChatGPT) с вопросами, связанными со здоровьем. Чтобы удовлетворить этот колоссальный спрос, компания-разработчик OpenAI тихо запустила специализированный сервис ChatGPT Health (ЧаТэПэЖэ Хелс) для избранной группы взрослых пользователей в США. Это был своего рода мягкий запуск. Для первой в мире ориентированной на пациентов системы искусственного интеллекта (ИИ) презентация прошла на удивление тихо, и трудно отделаться от мысли, что на то были веские причины.

Как работает ChatGPT Health и в чем его особенности?

Новый сервис создан на той же базовой архитектуре, что и обычный ChatGPT, но с ключевым отличием: с разрешения пользователя искусственный интеллект может подключаться к его медицинской карте и загружать показатели здоровья, зафиксированные носимыми устройствами, такими как умные часы Apple Watch (Эппл Вотч). Хотя изначально эта функция была отдельной вкладкой в интерфейсе, теперь она полностью интегрирована. Это стало операционным решением компании после того, как разработчики заметили, что пользователи органично задают вопросы о здоровье в ходе обычных ежедневных бесед.

В официальном пресс-релизе OpenAI сообщается, что ChatGPT Health может «помочь расшифровать записи о визите к врачу, понять результаты анализов, разобраться в обсуждениях между пациентом и доктором, а также подготовить вопросы для последующих приемов». Платформа призвана оптимизировать взаимодействие пользователя с помощью более «персонализированных бесед».

Внутренние противоречия и реальные риски

Однако в основе этой инициативы лежит серьезное противоречие. С одной стороны, компания оговаривается, что сервис не предназначен для диагностики или лечения и «не создан для того, чтобы заменять уход и экспертную оценку квалифицированных медицинских специалистов». С другой стороны, именно для этого общественность будет его использовать, и разработчики прекрасно это понимают.

«Реальность такова, что мы живем во время, когда не у всех есть доступ к качественной медицинской помощи или своевременной помощи, — заявил один из руководителей компании репортерам. — Средняя продолжительность приема врача в США составляет менее 15 минут... Пациенты часто остаются один на один с необходимостью разбираться в огромном объеме фрагментированной информации».

Для многих черный ящик ChatGPT Health станет заменой врача. В конце концов, если бы у пользователей был полноценный и быстрый доступ к своему доктору, зачем им понадобился искусственный интеллект?

Ограниченный набор навыков больших языковых моделей

Когда ChatGPT только появился в 2022 году, он работал исключительно на основе так называемой параметрической архитектуры. Это означало, что модель была полностью ограничена массивами текстовых данных, на которых ее обучали, отсюда и название — Большая языковая модель (БЯМ / LLM). Запрос вроде «Какой лучший источник витамина С?» заставлял ИИ опираться на статистическую модель, чтобы предсказать наиболее вероятную последовательность слов в ответе.

Сильной стороной модели было мастерское имитирование человеческой беседы: тексты получались плавными, уверенными и грамотными. Слабостью же являлось то, что обучающие данные были крайне разношерстными. Они включали всё подряд: научные статьи в открытом доступе, мейнстримные материалы, посты в блогах, форумы с вопросами и ответами (например, Reddit) и даже социальные сети, которые порой представляют собой настоящий рассадник дезинформации.

Пользователь, спрашивающий о витамине С, должен был надеяться, что фразы вроде «гуава, киви и цитрусовые» встречались в обучающих материалах чаще, чем «сосиски и икра». Хуже того, если запрос не был охвачен обучением, искусственный интеллект просто выдумывал ответ, подобно подростку, пытающемуся произвести впечатление на друзей. Так родились так называемые «галлюцинации» ИИ.

Проблема поиска и оценки информации

Но технологии развиваются с невероятной скоростью. Весной 2023 года ChatGPT был обновлен с помощью плагина RAG (Retrieval-Augmented Generation — генерация, дополненная поиском). Этот программный модуль позволяет современным версиям ИИ выполнять онлайн-поиск в реальном времени, если обучающих данных недостаточно для полноценного ответа.

И хотя это дает искусственному интеллекту доступ ко всему богатству цифровых знаний человечества, здесь кроется подвох: найти данные вовсе не означает уметь их правильно оценить. Можно предоставить человеку доступ ко всему каталогу медицинской литературы PubMed (ПьюМед), но это не значит, что он сможет принимать клинические решения. Таким образом, как для искусственного интеллекта, так и для людей, ключевым фактором является не просто доступ к информации, а способность различать качественные источники, взвешивать доказательства и применять знания на практике. Именно этими качествами ИИ пока не обладает.

Скудная база доказательств и опасные ошибки

Программирование ИИ с такими высокоуровневыми навыками определенно возможно, но этот процесс оказывается крайне сложным. Опубликованные аудиты контента, связанного со здоровьем, показывают, что улучшение способности ИИ к рассуждению будет иметь решающее значение для успеха подобных платформ.

Одно недавнее исследование показало, что чат-боты при ответах на медицинские запросы выдавали «проблематичные» ответы в трети или половине случаев, а доля «небезопасных» ответов составляла от 5% до 13%. Собственный аудит пяти популярных чат-ботов, опубликованный ранее в авторитетном «Британском медицинском журнале» (British Medical Journal), зафиксировал «проблематичные» ответы примерно в 50% случаев при обсуждении тем, подверженных дезинформации. Пятая часть ответов была оценена экспертами как «крайне проблематичная» и потенциально способная нанести вред здоровью при их практическом применении.

Это лишь два исследования из десятков посвященных эффективности медицинских ответов ИИ. Все они показывают, что такие системы остаются непоследовательными и ненадежными.

Недооценка тяжелых состояний: статистика триажа

Ограниченные данные по использованию именно ChatGPT Health вызывают не меньшую тревогу. В ходе структурированного тестирования рекомендаций по медицинской сортировке (триажу), Рамасвами и его коллеги из системы здравоохранения Маунт-Синай в Нью-Йорке сообщили, что 52% экстренных случаев были недооценены. Пациентов с диабетическим кетоацидозом или надвигающейся дыхательной недостаточностью направляли на амбулаторное обследование в течение 24–48 часов вместо того, чтобы срочно отправить в отделение неотложной помощи.

Предварительные исследования, ожидающие рецензирования, аналогичным образом показывают, что ChatGPT Health соглашается с решениями медсестер и врачей по первичной сортировке пациентов лишь в 50% случаев.

К чему может привести 50-процентная ошибка триажа?

  • Гипердиагностика: направление пациентов с незначительными недомоганиями в скорую помощь создает колоссальную нагрузку на и без того перегруженную систему здравоохранения.
  • Недодиагностика: пропуск реального неотложного состояния может иметь катастрофические, фатальные последствия для пациента.

Имеющиеся данные убедительно свидетельствуют о том, что искусственный интеллект пока не является подходящим инструментом для первичного медицинского триажа. Попробуйте сказать об этом тем более чем 40 миллионам людей, которые ежедневно обращаются к чат-боту с вопросами о своем самочувствии.

Где ИИ действительно полезен, а где таится опасность

Всё вышесказанное не означает, что функции с низким уровнем риска совершенно небезопасны. Например, искусственный интеллект может:

  • Точно переводить сложную клиническую терминологию на понятный язык.
  • Помогать упорядочивать медицинские записи.
  • Визуализировать и хронологически анализировать результаты лабораторных анализов.
  • Помогать пользователям формулировать вопросы для предстоящего визита к лечащему врачу.

Сложность заключается в том, что ChatGPT Health не поддерживает надежную границу между этими безопасными функциями и реальным клиническим суждением. Как только система начинает интерпретировать симптомы и давать конкретные рекомендации, она автоматически превращается в работающую систему триажа — независимо от всех юридических оговорок и дисклеймеров компании OpenAI. Существует явный разрыв между тем, для чего система спроектирована, и тем, как конечный пользователь будет ее применять. И пока нет никаких доказательств того, что сам искусственный интеллект способен осознать это ограничение.

Будущее медицинского ИИ: оценка и безопасность

Хорошая новость заключается в том, что разработчики продолжают оценивать платформу с помощью специальной матрицы оценки под названием Health Bench. Созданная в сотрудничестве с 262 врачами из 60 стран, представляющими 26 медицинских специальностей, эта система периодически проверяет тысячи диалогов, чтобы выявлять и устранять слабые места платформы.

Это надежный и крайне необходимый шаг, однако данные подобных проверок пока не опубликованы, и очевидно, что технология находится в стадии доработки, а не является полностью завершенным продуктом.

Подобные общедоступные инициативы продолжаются даже тогда, когда лидеры индустрии призывают к большей осмотрительности. Руководители ведущих технологических компаний неоднократно выступали за замедление разработки передового искусственного интеллекта, внедрение более строгих мер безопасности и организацию независимого надзора. Тот же принцип применим и к здравоохранению: проверки безопасности должны идти в ногу с растущими возможностями технологий. К сожалению, сейчас этого не происходит.

Представьте себе последствия, если бы автомобильный концерн выпустил новый грузовик на рынок, предварительно не доказав его абсолютную безопасность на дороге. Мы бы не стали терпеть недоработанный продукт или успокаивающие заверения производителя в том, что это «проект в разработке». Мы должны требовать точно такой же подотчетности от компаний, чье влияние на общественное здравоохранение огромно. Без такой ответственности каждый из нас рискует стать участником масштабного и не до конца просчитанного медицинского эксперимента.

Короткие версии статей можно найти в телеграм-канале.

Посмотреть канал
Кликните еще раз для перехода

Uriage Мягкий Скраб Для Лица с Гибискусом 50 мл

Мягкий скраб для лица Uriage с АНА гибискуса и микрогранулами бережно очищает кожу, удаляя омертвевш...

Uriage Мягкий Скраб Для Лица с Гибискусом 50 мл

Razor Breeze станки одноразовые для мужчин №4 — чистое брить...

Одноразовые мужские станки Razor Breeze обеспечивают комфортное и чистое бритьё без раздражения. Лез...

Razor Breeze станки одноразовые для мужчин №4 — чистое бритьё

Канпол охлаждающий прорезыватель Машинка для малышей

Канпол прорезыватель охлаждающий Машинка — удобный аксессуар для облегчения дискомфорта десен при пр...

Канпол охлаждающий прорезыватель Машинка для малышей

Черника Форте с лютеином для зрения таблетки 250 мг №100

Черника Форте с лютеином - биодобавка для поддержки зрения и общего здоровья. Содержит комплекс вита...

Черника Форте с лютеином для зрения таблетки 250 мг №100

Pl Стерильная хирургическая вата 50 г — медицинская

Стерильная медицинская хирургическая вата Pl, весом 50 г, предназначена для бережной обработки ран, ...

Pl Стерильная хирургическая вата 50 г — медицинская

Борная кислота 3% спиртовой раствор 25 мл — антисептик

Борная кислота 3% на спирту во флаконе 25 мл — антисептическое средство для местного применения. Эфф...

Борная кислота 3% спиртовой раствор 25 мл — антисептик