Интегратор GPU-серверов и рабочих станций · Россия и СНГ
8 (800) 350-70-73 · бесплатно по России  |  Условия поставки
Здравоохранение и фарма · Обработка документов и OCR · LLM и генеративный ИИ

Оцифровка медкарт и обработка страховых документов

OCR и LLM превращают бумажные карты, выписки и счета ОМС/ДМС в структурированные данные — обработка внутри организации.

Точность извлечения полей0,95–0,99 для печатного, 0,85–0,93 для рукописного
Скорость обработкитысячи страниц в час на один GPU
Ручная экспертиза счетов−50–70 % по публикациям

Диапазоны по отраслевым публикациям и типовым внедрениям; результат зависит от данных и процессов заказчика.

Задача

Что решаем

Бумажный архив типичной больницы — миллионы страниц: амбулаторные карты, истории болезни, согласия, результаты анализов из сторонних лабораторий. Рукописные записи врачей и печати делают классический OCR бесполезным. Страховые компании в ДМС и фонды ОМС получают счета и выписки в разнородных форматах и проверяют их вручную, тратя дни на экспертизу.

Задача — не просто распознать текст, а извлечь структуру: диагноз, назначения, даты, стоимость услуг, соответствие тарифу. И сделать это внутри организации, поскольку документы содержат врачебную тайну.

Как работает

Что делает ИИ

PaddleOCRTrOCRvLLMQwenPostgreSQLElasticsearch

Сканы проходят через конвейер: предобработка изображений, нейросетевое распознавание печатного и рукописного текста, затем локальная LLM извлекает поля по схеме и проверяет их согласованность. Спорные документы попадают оператору с подсветкой неуверенных фрагментов.

  • Распознавание рукописного текста и штампов с дообучением на образцах учреждения.
  • Извлечение структурированных данных в формат МИС или страховой системы.
  • Автоматическая проверка счетов на соответствие тарифам и медико-экономическим стандартам.
  • Поиск по всему архиву на естественном языке.

Важно: MIARCH поставляет вычислительную инфраструктуру и помогает развернуть модели. Само ПО для постановки диагноза является медицинским изделием и проходит регистрацию отдельно — на стороне разработчика или клиники.

Какие данные нужны

  • Сканы карт, выписок и счетов
  • Справочники услуг, тарифов и МКБ
  • Эталонные примеры для дообучения
Железо · Данные и табличный ML · Один узел в стойке

Какая инфраструктура нужна

Профиль data: OCR-модели и извлечение полей — конвейер из многих небольших моделей плюс LLM среднего размера, где важны и GPU, и много CPU-ядер для предобработки изображений, и быстрое хранилище под миллионы сканов. Для архива больницы или регионального страховщика подходит сервер R7 PRO из раздела GPU-серверов с двумя GPU; отдел на несколько операторов начнёт со станции W7 ULTRA из рабочих станций. Промышленные сканеры подключаются напрямую, распознанные документы и индекс хранятся на дисковом массиве узла, а при росте архива добавляется полка хранения без замены сервера.

Сравнить конфигурации →  ·  Подобрать по ускорителю →

Внедрение

Как идёт проект

  1. 01

    Данные и цель

    Фиксируем метрику успеха, источники данных и ограничения: on-premise, персональные данные, сроки.

  2. 02

    Пилот на нашей конфигурации

    Стартовая машина под задачу и подтверждённый профиль нагрузки перед закупкой кластера.

  3. 03

    Инфраструктура

    Поставка серверов, станций и охлаждения, монтаж, ввод в эксплуатацию, ПО и мониторинг.

  4. 04

    Сопровождение

    Масштабирование, обновление ускорителей в том же шасси, сервис и запчасти.

Смежные решения

Что ещё автоматизируют в отрасли «Здравоохранение и фарма»

Все решения для отрасли →

Запрос КП · ответ в течение рабочего дня

Опишите задачу и данные.

Вернёмся с профилем нагрузки, конфигурацией и коммерческим предложением на поставку в вашу страну.

Обсудить внедрение