Риски конфиденциальности при использовании ИИ в современной диагностике
Группа исследователей Йельской школы медицины под руководством PhD Qingyu Chen установила: fine-tuning — дообучение языковых моделей на реальных клинических записях — одновременно повышает точность…

Дообучение медицинского ИИ: точнее диагноз — выше утечка данных пациентов
Группа исследователей Йельской школы медицины под руководством PhD Qingyu Chen установила: fine-tuning — дообучение языковых моделей на реальных клинических записях — одновременно повышает точность диагностики и увеличивает вероятность того, что модель воспроизведёт чувствительную информацию пациентов, на которых обучалась. Исследование опубликовано в Nature Communications, первым автором указана Anran Li. Для вас как пациента это прямой сигнал: клиника, применяющая ИИ при расшифровке ваших снимков или анализе заключений, обязана раскрыть, на каких массивах данных модель обучалась и что происходит с вашими записями дальше.
Что показал эксперимент
Учёные провели контролируемое исследование на настоящих больничных записях. Та же процедура дополнительного обучения, которая улучшила диагностические показатели модели, повысила и риск «запоминания» персональных сведений с последующим их воспроизведением при работе с другими пациентами. Иными словами, ИИ стал точнее — но начал «помнить» то, что врачебная тайна обязывает стирать.
Какие документы и сведения вы вправе требовать
Если в учреждении, куда вы обращаетесь, используется ИИ-ассистент врача или система автоматической обработки снимков, требуйте от администрации письменные ответы на пять вопросов:
1. Какая конкретно модель применяется и проводилось ли её дообучение на данных вашей клиники либо сторонних массивах.
2. Какие категории ваших сведений — тексты заключений, снимки, лабораторные показатели — поступают в модель.
3. Передаются ли ваши данные разработчику ИИ, облачному провайдеру или исследовательским организациям.
4. Содержит ли подписанное вами информированное согласие отдельное разрешение на обработку данных именно в целях обучения модели.
5. Сохраняется ли обезличенная копия ваших записей в датасетах после завершения лечения.
Формулировка «согласен на использование данных в научных целях» юридически не покрывает передачу записей на дообучение коммерческого ИИ. Устные ответы администрации доказательной базы не создают — требуйте письменный ответ с исходящим номером и подписью ответственного лица.
Алгоритм действий при отказе или подозрении на утечку
Шаг 1. При записи на исследование задайте врачу прямой вопрос: «Используется ли в клинике ИИ при обработке моих данных и в каком объёме?»
Шаг 2. При отказе раскрыть состав модели и условия обработки — фиксируйте отказ письменно (заявление на имя главного врача в двух экземплярах, на вашем — входящий номер).
Шаг 3. При подозрении на утечку направляйте досудебную претензию главному врачу с требованием предоставить результаты служебного расследования в 30-дневный срок.
Шаг 4. При отсутствии ответа или неудовлетворительном ответе подавайте жалобу в территориальное управление Роспотребнадзора (нарушение порядка обработки персональных данных и врачебной тайны) и в Роскомнадзор.
Шаг 5. Сохраняйте всю переписку и досудебную претензию — они понадобятся при обращении в суд и при подаче заявления в страховую компанию, если утечка повлекла имущественный или репутационный ущерб.
Что отслеживать
Публикация в Nature Communications — это научный сигнал регуляторам, а не нормативный акт. Однако уже сейчас любая клиника, внедряющая ИИ-инструменты, обязана соблюдать ФЗ-152 «О персональных данных» и статью 13 Федерального закона № 323-ФЗ «Об основах охраны здоровья граждан» о врачебной тайне. Не ждите, пока конкретное учреждение попадётся на утечке. Фиксируйте условия обработки ваших данных до начала лечения — письменно и до подписания информированного согласия.