a
b
c
d
FindNews.ru - новости, последние события, хроники.
Фонд развития инноваций Республики Саха (Якутия) и компания Cloud Networks подписали меморандум о стратегическом партнерстве
Сегодня, 09:01
Праздник без спешки: как жители Кузбасса меняют новогодние привычки
Сегодня, 09:01
Wildberries расширила для продавцов модель продаж с самой низкой комиссией
Сегодня, 09:01
«ГигаЧат» сдал экзамены на бакалавра в РАНХиГС по двум направлениям
Сегодня, 09:01
От депутатов до артистов: «Дзен» стал рекомендовать мнения известных людей о новостях
Сегодня, 09:01
«Авито»: продажи елочных украшений из СССР выросли в два раза
Сегодня, 09:00
«Финуслуги» запустили сервис для малого и среднего бизнеса
Сегодня, 09:00
Эксперты «К2Тех» назвали главные барьеры внедрения MES в промышленности
Сегодня, 09:00
Портал «Рамблер» запустил помощника по новостям на базе искусственного интеллекта
Сегодня, 09:00
«МегаФон» расширил LTE-покрытие на автодороге в Хасанском округе
Сегодня, 09:00

Ученые «Сбера» создали бенчмарк для повышения качества медицинских консультаций

Учёные из центра практического искусственного интеллекта «Сбера» разработали медицинский бенчмарк 3MDBench, который моделирует консультации между врачом и пациентом на основе жалоб, снимков и характера пациента, с автоматической оценкой качества.

В этой системе взаимодействуют два виртуальных агента, каждый из которых управляется большой языковой или мультимодальной моделью искусственного интеллекта (ИИ). Один агент действует как врач, а другой — как пациент. Смысл в том, чтобы оценить, насколько эффективно современные ИИ-модели решают задачи врача, который консультирует пациентов дистанционно. Система проверяет их способность распознавать симптомы, формулировать диагноз и поддерживать естественный, понятный и эмпатичный диалог с пациентом. Такая симуляция позволяет изучить, как темперамент пациента и выбранная стратегия общения влияют на точность диагностики и общее качество взаимодействия. «Сбер» опубликовал научную статью под названием 3MDBench: Medical Multimodal Multi-agent Dialogue Benchmark.

Актуальность исследования обусловлена стремительным развитием телемедицины и растущей ролью языковых моделей в здравоохранении. Существующие медицинские бенчмарки часто включают лишь тесты с выбором ответа или короткие текстовые задачи, не моделируют полноценное общение между врачом и пациентом, не учитывают темперамент и эмоциональную реакцию человека. К тому же большинство из них берут в расчёт качество коммуникации и визуальные данные — например, фотографии симптомов, которые важны для постановки диагноза.

Бенчмарк 3MDBench включает почти 3 тыс. случаев с 34 диагнозами, которые основаны на реальных мультимодальных телемедицинских данных (текст + изображение). Исследование учёных «Сбера» показало, что использование диалога и мультимодальной информации существенно повышает точность диагностики. Добавление диалогов, по оценкам ученых «Сбера», увеличивает F1-меру на 6,5%, а включение информации от специально обученной свёрточной нейросети для классификации медицинских изображений — до 20%. Также подтверждено, что мультиагентная симуляция с персонализированными пациентами обеспечивает более реалистичную и содержательную оценку моделей.

Компании, которые разрабатывают медицинские ИИ-системы и телемедицинские платформы, могут бесплатно использовать 3MDBench для оценки и улучшения диагностических возможностей своих нейросетей в реалистичных условиях. Интеграция мультимодальных данных и улучшение диалоговых стратегий помогут компаниям-разработчикам, телемедицинским провайдерам, страховым компаниям и производителям медицинского ПО повысить качество удалённых консультаций.

Поделиться Подписаться на новости Короткая ссылка

Наука и высокие технологии - другие новости