Каталог медицинских данных для искусственного интеллекта в здравоохранении

Готовые наборы медицинских/медицинских данных для запуска вашего проекта искусственного интеллекта в здравоохранении

Каталог медицинских данных

Наборы медицинских и медицинских данных для машинного обучения

Что включает в себя каталог медицинских данных Shaip?

Каталог медицинских данных Shaip представляет собой готовую к использованию библиотеку обезличенных данных для обучения специалистов здравоохранения, соответствующих требованиям HIPAA и охватывающую 31 медицинскую специальность. В библиотеку входят 257 977 часов аудиозаписей врачебных диктовок, расшифрованные медицинские карты, электронные медицинские карты и мультимодальные наборы данных. Каждый набор данных лицензирован для коммерческого обучения ИИ и поставляется с возможностью обезличивания данных в соответствии с принципами Safe Harbor или Expert Determination.

Аудиоданные под диктовку врача

Наш обезличенный набор данных по здравоохранению включает аудиофайлы по 31 специальности, продиктованные врачами, в которых описывается клиническое состояние пациентов и план лечения, основанный на встречах врача и пациента в клинических условиях.

Готовые аудиофайлы для диктовки врача:

  • 257,977 31 часов реальных данных о речи врачей XNUMX специальности для обучения речевых моделей здравоохранения
  • Аудио под диктовку, записанное с различных устройств, таких как телефонная диктовка (54.3%), цифровой диктофон (24.9%), речевой микрофон (5.4%), смартфон (2.7%) и неизвестный (12.7%).
  • Отредактированные аудио и стенограммы PII в соответствии с рекомендациями Safe Harbor в соответствии с HIPAA
Аудиоданные под диктовку врача

Расшифрованные медицинские записи

Транскрибирование медицинских записей включает в себя расшифровку разговоров врача и пациента, медицинских заключений и медицинских оценок. Это помогает составить историю болезни пациента для будущих визитов и служит ориентиром для врачей. Это помогает оценить текущее состояние пациента и предложить подходящее лечение.

Готовые расшифрованные медицинские записи:

  • Транскрипция 257,977 31 часов реального врачебного диктанта из XNUMX специальности для обучения моделей медицинской речи
  • Расшифрованные медицинские записи из различных типов работ, таких как операционный отчет, сводка выписки, заметка о консультации, записка о госпитализации, заметка о неотложной помощи, клиническая записка, рентгенологический отчет и т. д.
  • Отредактированные аудио и стенограммы PII в соответствии с рекомендациями Safe Harbor в соответствии с HIPAA
Расшифрованные медицинские записи

Электронные медицинские карты (EHR)

Электронные медицинские карты или EHR — это медицинские записи, которые содержат историю болезни пациента, диагнозы, рецепты, планы лечения, даты вакцинации или иммунизации, аллергии, радиологические изображения (КТ, МРТ, рентген), лабораторные анализы и многое другое.

Готовые электронные медицинские карты (EHR):

  • 5.1M + Записи и аудиозаписи врачей по 31 специальности
  • Медицинские записи, соответствующие золотому стандарту реального мира, для обучения клиническому НЛП и другим моделям документооборота с искусственным интеллектом
  • Информация метаданных, такая как MRN (анонимизированная), дата поступления, дата выписки, продолжительность пребывания в днях, пол, класс пациента, плательщик, финансовый класс, состояние, решение о выписке, возраст, DRG, описание DRG, возмещение в долларах, AMLOS, GMLOS, риск смертность, тяжесть заболевания, морской окунь, почтовый индекс больницы и т. д.
  • Медицинские записи из различных штатов и регионов США: Северо-Восток (46%), Юг (9%), Средний Запад (3%), Запад (28%), Другие (14%)
  • Медицинские записи, относящиеся ко всем охватываемым классам пациентов - стационарные, амбулаторные (клинические, реабилитационные, повторяющиеся, хирургические дневные), неотложные.
Электронные медицинские карты (эхр)
  • Медицинские записи, относящиеся ко всем возрастным группам пациентов <10 лет (7.9%), 11–20 лет (5.7%), 21–30 лет (10.9%), 31–40 лет (11.7%), 41–50 лет (10.4%). ), 51-60 лет (13.8%), 61-70 лет (16.1%), 71-80 лет (13.3%), 81-90 лет (7.8%), 90+ лет (2.4%)
  • Соотношение полов пациентов 46% (мужчины) и 54% (женщины)
  • Отредактированные документы PII, соответствующие Руководству Safe Harbor в соответствии с HIPAA

Пять причин, по которым покупатели лицензия Шаип вместо того, чтобы сшивать его.

Медицинский каталог данных Shaip существует потому, что Большинство команд, занимающихся разработкой ИИ в здравоохранении, теряют от девяти до двенадцати месяцев. Получение соответствующих требованиям обучающих данных до начала обучения хотя бы одной модели. Вот что меняется, когда возвращаются данные за эти месяцы.

01

Масштаб каталога, недостижимый для большинства команд.

Каталог Shaip охватывает широкий спектр товаров. 257,977 часа диктовки врача, расшифровки из 31 медицинских специальностейа также электронные медицинские карты, охватывающие все возрастные группы пациентов — такой объем данных позволяет покупателям Обучать и оценивать модели, не объединяя десяток открытых наборов данных..

02

Соответствие требованиям — это исходное условие, а не обязательное условие.

Каждый медицинский набор данных Shaip поставляется с Деидентификация по умолчанию в соответствии с принципом "безопасной гавани" HIPAAЭкспертная оценка по запросу, обработка данных в соответствии с GDPR и готовность к заключению соглашения о деловом сотрудничестве (BAA) для организаций, подпадающих под действие регламента. Покупателям не нужно будет заново подгонять требования соответствия постфактум.

Безопасная гавань HIPAA Экспертное определение Соответствует GDPR Готовность к BAA
03

Специалисты с медицинским образованием, а не обычные участники краудсорсинга.

Аннотирование, транскрипция и контроль качества медицинского каталога Shaip выполняются следующими лицами: специалисты, прошедшие подготовку в области здравоохраненияРабочий процесс Shaip включает многоуровневый контроль качества и проверку с участием человека, откалиброванную в соответствии со стандартами клинической точности.

04

Сегодня — готовые решения, по индивидуальному заказу.

Покупатели могут немедленно получить лицензию на существующие наборы данных Shaip или заказать индивидуальный сбор данных, ориентированный на конкретные демографические группы, географические регионы, языки и форматы. без смены поставщиков или повторного проведения проверки на соответствие требованиям..

05

Доступно там, где уже работают команды, занимающиеся обработкой данных.

Обезличенные данные электронных медицинских карт и диктовки врачей, собранные Шаипом, доступны на [ссылка на сайт]. Рынок блоков данныхПредоставляются данные в форматах, которые уже используют команды разработчиков и специалистов по машинному обучению — JSON, CSV, WAV. Перед принятием решения доступны примеры наборов данных.

JSON CSV WAV ФХИР

Безопасность и соответствие

GDPR
HIPAA
ISO 9001: 2015
SOC 2 Тип II
стандартами качества ISO 27001
Свяжитесь с нами

Не можете найти то, что ищете?

Новые готовые наборы медицинских данных собираются по всем типам данных. 

Свяжитесь с нами сейчас, чтобы избавиться от беспокойства по сбору данных о медицинском обучении

  • Это поле для целей проверки и должны быть оставлены без изменений.
  • Регистрируясь, я соглашаюсь с Shaip Персональные данные и Условия Предоставления Услуг и даю свое согласие на получение маркетинговых сообщений B2B от Shaip.

Медицинские наборы данных — это данные здравоохранения, используемые для обучения, оценки и улучшения моделей ИИ/машинного обучения. Они могут включать аудиозаписи врачебных диктовок, расшифрованные медицинские карты, электронные медицинские карты, синтетические диалоги между врачом и пациентом, а также мультимодальные наборы данных здравоохранения, объединяющие соответствующий текст, речь и структурированные клинические данные.

Каталог медицинских данных Shaip включает аудиозаписи врачебных диктовок, расшифровки медицинских карт, электронные медицинские карты, синтетические диалоги между врачом и пациентом, а также мультимодальные наборы данных, которые связывают текст, речь и структурированные клинические данные на уровне пациента или случая обращения. Он содержит 257 977 часов аудиозаписей врачебных диктовок по 31 медицинской специальности и доступен для коммерческого обучения ИИ.

Да. Медицинские наборы данных Shaip по умолчанию обезличены в соответствии с принципом «безопасной гавани» HIPAA, что исключает 18 категорий идентификаторов, указанных в Правиле конфиденциальности HIPAA. Обезличивание на основе экспертной оценки также доступно, когда требуется статистическая сертификация, и Shaip готов к заключению соглашений о деловом сотрудничестве (BAA) с организациями, подпадающими под действие HIPAA.

Да. Медицинские наборы данных Shaip могут быть подготовлены в соответствии с требованиями HIPAA, GDPR и другими применимыми требованиями к данным в сфере здравоохранения в зависимости от масштаба проекта, географического положения, типа данных и договорных условий.

Оба варианта доступны. Shaip предлагает готовые наборы данных из сферы здравоохранения через каталог медицинских данных Shaip для коммерческого обучения ИИ. Если проект требует знания определенного языка, демографических данных, специализации, метода лечения или клинической среды, Shaip также может выполнить сбор медицинских данных на заказ в соответствии с теми же стандартами соответствия.

Да. Компания Shaip может создавать индивидуальные наборы медицинских данных с учетом специализации, возрастной группы пациентов, пола, географического положения, языка, метода исследования, клинических условий, формата, объема и требований проекта. Создание индивидуальных наборов данных определяется в рамках технического задания и соответствует применимым стандартам обезличивания и соблюдения нормативных требований.

Да. Shaip предоставляет репрезентативные примеры наборов данных в рамках соглашения о неразглашении, чтобы команды разработчиков ИИ могли оценить формат, качество, демографический охват и соответствие модели требованиям перед лицензированием. Доступ к примерам обычно является первым шагом перед получением стандартной лицензии или созданием пользовательской коллекции.

Shaip предоставляет медицинские наборы данных в форматах, готовых для использования с ИИ, включая JSON, CSV и FHIR для структурированных записей; WAV-файлы с парными транскриптами для аудиозаписей; и файлы транскриптов для наборов данных речи и языка. Мультимодальные наборы данных могут включать файлы манифестов, связывающие текст, аудио и структурированные клинические записи.

Shaip обеспечивает качество медицинских наборов данных посредством экспертной оценки, аннотирования специалистами в предметной области, рабочих процессов валидации и структурированных проверок качества. Эти процессы помогают обеспечить точность, надежность и готовность моделей к разработке искусственного интеллекта в здравоохранении.

Да. Медицинские наборы данных Shaip масштабируемы как для небольших пилотных проектов, так и для корпоративных проектов в области ИИ/машинного обучения. Они могут поддерживать проекты, требующие больших объемов медицинских записей, структурированных клинических данных, стенограмм или сотен тысяч часов аудиозаписей врачебных диктовок.

Да. Shaip предоставляет медицинские наборы данных в готовых к использованию форматах, таких как JSON, CSV, FHIR, WAV и файлы транскриптов. Эти форматы поддерживают интеграцию в существующие рабочие процессы разработки моделей искусственного интеллекта, машинного обучения, обработки естественного языка, распознавания речи, обучения на уровне магистратуры в здравоохранении и мультимодальных моделей.

Готовые медицинские наборы данных обычно могут быть предоставлены в течение нескольких дней после проверки образцов, подписания контракта и завершения лицензирования. Сроки сбора данных, адаптированные под конкретные задачи, зависят от масштаба проекта, размера набора данных, метода сбора, требований к соответствию нормативным требованиям и сложности, и определяются в техническом задании.

Стоимость медицинских наборов данных зависит от типа набора данных, способа представления, объема, требований к настройке, условий лицензирования, сроков предоставления и требований соответствия. Команды могут поделиться своими требованиями через форму «Свяжитесь с нами», чтобы получить индивидуальное предложение.

Высококачественные медицинские наборы данных необходимы для обучения точных, надежных и клинически полезных моделей искусственного интеллекта в здравоохранении. Они помогают улучшить медицинскую документацию, обработку естественного языка в клинической практике, распознавание речи, составление резюме, поддержку принятия решений, автоматизацию, рабочие процессы по уходу за пациентами и анализ данных в здравоохранении.