Ученые МГУ им. М.В. Ломоносова представили метод поиска заданных слов и фраз в цифровых изображениях рукописных текстов. Их предлагается рассматривать как последовательных отдельных штрихов.
Алгоритм сегментирует изображения на штрихи, нормализует их и классифицирует с использованием математических описаний формы. После этого сопоставляется последовательность штрихов запроса и документа для поиска совпадений и оценки их точности. Метод предполагает ранжирование найденных фрагментов по степени соответствия ключевым словам.
По мнению исследователей, их решение обходит ограничения классического распознавания и дает работать напрямую с изображениями рукописей. Алгоритм предназначен для создания поисковых систем для архивов, библиотек и музейных коллекций, а также для исследований культурного и научного наследия. В будущем планируется расширение наборов данных и адаптация к различным стилям письма.
Нажимая на кнопку, вы соглашаетесь с политикой конфиденциальности
ICT.Moscow — открытая площадка о цифровых технологиях в Москве. Мы создаем наиболее полную картину развития рынка технологий в городе и за его пределами, помогаем бизнесу следить за главными трендами, не упускать возможности и находить новых партнеров.