Искусственный интеллект значительно облегчил работу OCR. Дело в том, что обученные нейросети способны «додумывать» смысл слов и даже целых фраз, исходя из контекста — т.е. других окружающих слов. Поэтому даже документ сравнительно низкого качества, где традиционная система OCR пасует или выдает неуверенный результат, может быть обработан с помощью ИИ. Тем самым, качество распознавания резко возрастает.
Подобные системы существуют не только для личного пользования — в конце концов, для личного использования можно просто загрузить нужный скан в любую нейросеть и получить текстовую расшифровку. В корпоративной же среде сотрудникам приходится иметь дело с десятками и сотнями документов в день. А если речь идет об
оцифровке бумажного архива и переводе тысяч документов в электронную форму, то распознавание документов с помощью ИИ становится настоящим спасением.
Интересно, что ИИ не только улучшает качество и скорость распознавания, но и автоматизирует другие процессы работы с документацией. Поэтому
корпоративные системы управления документами с функцией распознавания, такие как «Анарта», способны в десятки раз ускорить работу по оцифровке архива. Каждый сканированный документ автоматически получает метаданные, категоризируется и попадает в файловое хранилище с учетом действующей в организации структуры.