Метрические книги, ревизские сказки, исповедные ведомости - почти любой, кто занимался историей своей семьи, знает, как тяжело читать такие документы. Дореформенная орфография, выцветшие чернила, писарский почерк XIX века: на разбор одной страницы может уйти вечер. АрхивРидер решает эту задачу за несколько минут - вы загружаете скан или фотографию, а сервис распознаёт текст и переводит его в понятный современный вид.
В этой статье - пошаговая инструкция по работе с сервисом и отдельный раздел о том, как получить максимально точную расшифровку.
Шаг 1. Зарегистрируйтесь и получите бесплатные баллы
Все операции в сервисе оплачиваются баллами. При регистрации вы получаете 5 бесплатных баллов - этого хватит, чтобы расшифровать пять страниц и понять, подходит ли вам сервис. Ещё 5 баллов можно получить за подписку на наш Telegram-канал - кнопка бонуса есть в личном кабинете.
Как тратятся баллы:
- -1 балл - расшифровка одной обычной страницы документа
- -2 балла - расшифровка разворота (две страницы на одном скане)
- -если обработка завершилась ошибкой, баллы автоматически возвращаются на баланс
Когда бесплатные баллы закончатся, баланс можно пополнить пакетом на странице «Цены»: чем больше пакет, тем дешевле обходится каждая страница.
Шаг 2. Загрузите документ
На странице «Мои документы» перетащите файл в область загрузки или выберите его вручную. Поддерживаются форматы JPG, PNG и PDF. Можно загрузить несколько файлов сразу, но для лучшего качества распознавания мы советуем загружать документы по одному - следующие страницы вы всегда сможете добавить к документу позже.
Сервис справляется и со сложными случаями: артефакты сканирования, шум, нестандартная структура страницы. Если на фотографии разворот книги - две страницы рядом - система определит это автоматически.
Шаг 3. Дождитесь распознавания
Обработка одной страницы занимает несколько минут. Статус виден в списке документов - когда расшифровка будет готова, документ можно открыть и посмотреть результат.
Шаг 4. Работайте с результатом
На странице документа вы получите:
- -оригинальный текст - то, что написано в документе, с сохранением исходной орфографии
- -современную расшифровку - тот же текст, переведённый в привычный современный вид без потери смысла
- -структурированную таблицу - для метрических книг и других табличных документов данные раскладываются по колонкам: имена, даты, события
Любой блок можно скопировать одной кнопкой. Если вы заметили неточность, откройте встроенный редактор и поправьте текст вручную - ваша версия сохранится рядом с автоматической.
Изображение документа: лупа и масштаб
На странице документа скан отображается рядом с расшифровкой, и для сверки текста с оригиналом не нужно открывать изображение в отдельной программе - все инструменты встроены.
Лупа. Наведите курсор на изображение - фрагмент под курсором показывается увеличенным. У лупы два режима, переключатель - в панели кнопок справа вверху изображения:
- -панель сбоку - рядом с документом открывается большое окно с увеличенным фрагментом; рамка на изображении показывает, какая область увеличена. Удобно, когда нужно разобрать целую строку или запись
- -линза под курсором - увеличенный фрагмент появляется прямо под курсором и следует за ним. Удобно быстро «пробегать» по странице; у края документа линза выступает наружу, так что текст на самой границе тоже читается
Выбранный режим запоминается. Если лупа не нужна, её можно совсем отключить в личном кабинете - на странице профиля. На телефонах и планшетах лупа не показывается - там работает привычное увеличение жестом.
Масштаб. Кнопки «+» и «−» справа вверху увеличивают и уменьшают само изображение, кнопка «1:1» возвращает исходный размер. Увеличенное изображение можно перемещать, зажав левую кнопку мыши. Пока изображение увеличено, лупа отключена - нажмите «1:1», чтобы вернуть её.
Как сверять текст. Откройте расшифровку рядом со сканом и ведите лупой по строкам оригинала, сравнивая спорные места - имена, фамилии, даты, цифры возраста в табличных колонках. Для разбора одной неразборчивой записи целиком удобнее увеличить изображение кнопкой «+» и подвинуть нужный фрагмент мышью. Найденные ошибки сразу правьте во встроенном редакторе.
Шаг 5. Добавьте следующие страницы
Если документ многостраничный, не загружайте страницы как отдельные документы. На странице уже обработанного документа нажмите «Добавить следующую страницу» - новая страница будет привязана к текущему документу, а сервис учтёт контекст предыдущих страниц при распознавании. Это особенно важно для метрических книг: повторяющиеся фамилии, названия сёл и структура записей помогают системе точнее читать сложные места.
Прежде чем добавлять следующую страницу, перепроверьте результат по уже обработанной: если видите ошибки - поправьте их в редакторе. Исправленный текст станет более точным контекстом для следующих страниц.
Как получить максимальный результат
Качество расшифровки напрямую зависит от того, что и как вы загружаете. Вот проверенные приёмы, которые заметно улучшают результат.
1. Начните с качественного изображения
Это самый важный фактор. Идеальный вариант - скан с разрешением 300 dpi и выше. Если сканера нет и вы фотографируете документ (например, в читальном зале архива):
- -снимайте строго сверху, без перекоса - текст должен быть параллелен краям кадра
- -следите за освещением: равномерный рассеянный свет без бликов и теней от рук или телефона
- -страница должна попадать в кадр целиком, включая края с номерами записей
- -не используйте цифровой зум - лучше поднесите телефон ближе
- -проверьте резкость перед загрузкой: если текст трудно прочитать на экране телефона при увеличении, системе тоже будет сложнее
2. Загружайте документы по одному
Пакетная загрузка удобна, но одиночная даёт лучшее качество: каждая страница получает максимум внимания при обработке. Загрузите первую страницу, дождитесь результата, а затем добавляйте следующие через кнопку «Добавить следующую страницу».
3. Держите страницы одного дела вместе
Связанные страницы - главный источник контекста. Когда вы добавляете страницы последовательно в один документ, сервис использует уже распознанные записи: если на предыдущей странице встречалась редкая фамилия, система с большей вероятностью правильно прочитает её и на следующей, даже если там она написана неразборчиво. Для метрических книг и ревизских сказок это даёт ощутимый прирост точности.
4. Разворот или отдельные страницы?
Сервис умеет распознавать развороты (это стоит 2 балла - как две страницы). Но если оригинал в плохом состоянии или текст мелкий, лучше сфотографировать каждую страницу разворота отдельно: изображение получится крупнее и детальнее, а значит - точнее расшифровка.
5. Не пропускайте ручную проверку
Автоматическая расшифровка - это черновик высокого качества, но имена собственные, редкие топонимы и повреждённые фрагменты стоит сверять с оригиналом. В интерфейсе документ и расшифровка отображаются рядом: ведите лупой по строкам скана или увеличьте изображение кнопками, а правки вносите во встроенном редакторе. Особенно важно перепроверить страницу до того, как добавите к документу следующую: исправленный текст станет более точным контекстом для новых страниц. Проверенный вами текст - это уже готовый материал для семейного древа или публикации.
6. Если результат всё равно не устроил
- -добавьте к документу соседние страницы - контекст может «вытянуть» спорные места
- -переснимите или пересканируйте оригинал в лучшем качестве и загрузите заново
- -напишите нам на help@archivereader.ru или в Telegram - разберём ваш случай
Коротко
- Зарегистрируйтесь - 5 баллов бесплатно, ещё 5 за подписку на Telegram.
- Загрузите чёткий скан или фото (JPG, PNG, PDF) - лучше по одной странице.
- Через несколько минут получите оригинальный текст, современную расшифровку и таблицу.
- Проверьте результат в редакторе и поправьте ошибки, если они есть.
- Добавляйте следующие страницы к тому же документу - контекст повышает точность.
Попробуйте на своём документе - первая расшифровка займёт меньше десяти минут вместе с регистрацией.