Решение проблем с загрузкой и распознаванием документов

Большинство проблем с загрузкой документов и OCR сводятся к качеству изображения, отсутствию фото оборотной стороны, недопустимому подтипу документа или использованию копии вместо оригинала - вот как исправить каждую из них.

Short answer

Разбирайте проблему в таком порядке: разрешён ли этот подтип документа в вашем воркфлоу, было ли снято фото оборотной стороны, было ли изображение достаточно качественным и было ли это оригинальное фото, а не скриншот или скан. Эти четыре пункта покрывают почти все случаи.

Если документ не загружается или ключевые поля извлекаются некорректно, почти всегда причина - одна из немногих известных. Вот как их разобрать.

#Сначала: документ вообще разрешён?

Прежде чем разбираться с качеством изображения, убедитесь, что ваш воркфлоу принимает именно этот подтип документа для этой страны. Недопустимый подтип выглядит как проблема распознавания, но ею не является - и он не сработает для каждого пользователя с этим форматом документа, а не только для одного. См. подтипы - обычная причина отклонения документа.

#Размытые, тёмные или пересвеченные изображения

Didit проверяет качество изображения перед обработкой документа и просит пользователя переснять фото, если оно слишком размытое, слишком тёмное или слишком яркое. Попросите пользователя:

  • Использовать хорошее равномерное освещение без прямых бликов
  • Держать камеру неподвижно и дать ей сфокусироваться перед съёмкой
  • Держать все четыре угла документа в кадре
  • Достать документ из пластикового чехла - отражение мешает автозахвату

У пользователей ограниченное число попыток переснять фото; на последней разрешённой попытке изображение принимается, чтобы пользователь никогда не оказался заблокирован навсегда, но некачественный снимок всё равно может оставить поля нераспознанными. Проверьте предупреждения сессии на IMAGE_TOO_BLURRY, IMAGE_TOO_DARK или IMAGE_TOO_BRIGHT, чтобы подтвердить эту причину.

Если размытые документы проходят и даже одобряются, планка для вашего аппетита к риску задана слишком низко. Это исправляют две настройки в шаге проверки документа рабочего процесса:

  • Минимальное качество изображения (ползунок качества): каждое фото документа оценивается моделью качества в момент съёмки, и снимки ниже вашего минимума мгновенно отклоняются с просьбой переснять. Значение по умолчанию намеренно мягкое; поднимите его, и размытый оборот карты с оценкой 33 никогда не дойдёт до проверок.
  • Экран проверки снятого изображения (в разделе Расширенный): показывает человеку только что сделанное фото и просит подтвердить его или отсканировать заново до загрузки. Применяется только к сканам камерой, поскольку загрузки уже показывают предпросмотр файла.

Сама оценка качества есть в отчёте сессии, так что вы можете посмотреть на встревожившие вас сессии и выбрать порог чуть выше них.

#Поле не обнаружено или прочитано неверно (имя, дата рождения, номер документа)

Когда OCR не может извлечь конкретное поле, само по себе это обычно не приводит к отклонению сессии - по умолчанию она направляется на ручную проверку, чтобы человек мог это проверить.

Если это происходит часто для одного типа документа или одного языка, проверьте настройку Preferred character format вашего воркфлоу: выберите, должны ли извлечённые имена нормализоваться в латиницу или сохраняться в оригинальной письменности документа. Несоответствие здесь - частая причина искажённых или отсутствующих полей с именем на документах с кириллицей, арабским, греческим или иероглифическим письмом.

Если извлечено неверное значение (фамилия с одной неправильной буквой, адрес в поле имени), см. исправление неверно прочитанного имени или поля: поддержка не может отредактировать его за вас, но это могут шаг проверки данных пользователем, API update-data и повторная подача.

#Скриншоты, распечатки и фото экрана отклоняются

Didit требует оригинальное, снятое в реальном времени фото физического документа - а не скриншот, скан, распечатанную копию или фото документа с другого экрана. Проверки document liveness специально созданы для выявления именно таких случаев и пометят или отклонят сессию. Попросите пользователя сфотографировать физический документ напрямую.

Это сделано намеренно: принятие фото фотографии сводит на нет саму ценность проверки документа.

Детектор снимка экрана иногда может сработать на подлинном документе, сфотографированном на пёстром фоне - клавиатура, стол с узором, монитор позади карты. Если вы посмотрели изображения и документ явно настоящий, одобрите сессию сами: метка направляет на проверку именно для того, чтобы решение принял человек. У каждого сигнала liveness документа (снимок экрана, печатная копия, подмена портрета) в настройках подделки шага есть собственные пороги проверки и отклонения на случай, если какой-то из них слишком чувствителен для вашего трафика.

#Отсутствует фото оборотной стороны

Удостоверения личности и водительские удостоверения двусторонние - Didit нужно фото и лицевой, и оборотной стороны, чтобы завершить извлечение данных. Для паспортов нужна только страница с фото.

Если пользователи регулярно застревают на шаге съёмки оборотной стороны, проверьте, действительно ли документ, о котором идёт речь, содержит на обороте читаемые данные в этой стране. Требовать фото оборотной стороны, на которой ничего нет, значит заставлять пользователей проваливать шаг без всякой пользы.

#Камера вообще не открывается

Это выглядит как проблема с документом, но на самом деле это проблема среды:

  • Встроенные браузеры приложений. Ссылка, открытая во встроенном браузере другого приложения (например, чата), часто не может получить доступ к камере. Открытие той же ссылки в обычном браузере телефона решает проблему.
  • Ранее отклонённое разрешение. Как только человек отказал сайту в доступе к камере, браузер это запоминает. Разрешение нужно выдать заново в настройках сайта; поток не может запросить его снова.
  • Камера уже используется. Другая вкладка или приложение, удерживающее камеру, блокирует к ней доступ. На некоторых устройствах предоставление доступа к микрофону тоже может занять камеру.

#Текст в потоке выглядит искажённым

Если пользователь сообщает о перепутанных или бессмысленных словах в интерфейсе (не на документе), обычная причина - расширение браузера для перевода страницы, переписывающее экран. Попросите отключить перевод для этой страницы - поток уже предлагает собственные языки. См. настройка языка верификации.

#Сколько языков поддерживает OCR?

OCR Didit распознаёт документы на более чем 130 языках в рамках покрытия по документам и странам. Это отдельно от языка самого экрана верификации, который браузер пользователя устанавливает автоматически, если вы не зададите его явно.

#Всё ещё не получается?

Свяжитесь с поддержкой и укажите ID сессии проблемной верификации - это самый быстрый способ для команды разобраться в конкретном случае, потому что он позволяет увидеть именно те изображения и предупреждения, о которых вы говорите.