Какие приложения распознают сканированный текст
Сканированный текст распознаёт только версия для Zotero — на iPad, Mac и Windows.
Версия для Mendeley не распознаёт сканированный текст. В сканированном PDF без текстового слоя поиск и выделение текста ничего не находят; при этом можно пользоваться выделением области, стикерами и рукописными заметками.
Распознавание текста бесплатно. Создание выделений на распознанном тексте входит в покупку, как и любые другие выделения. См. Пробный период и покупка.
Как это работает
- Откройте сканированную статью. Распознавание начинается само, и вы видите «Распознаётся текст отсканированных страниц…».
- По завершении появляется «Текст скана распознан».
- Поиск в статье теперь находит и распознанный текст («Распознанный текст» с числом совпадений). См. Поиск.
Распознавание выполняется на вашем устройстве: на iPad и Mac — встроенным распознаванием текста Apple, в Windows — распознаванием текста, встроенным в Windows.
Выделение сканированного текста
- Выберите Маркер HL и проведите по тексту. Если распознавание ещё идёт, вас попросят провести ещё раз чуть позже.
- Перетащите мышью, чтобы выделить текст на сканированной странице (двойной щелчок — слово, Shift+щелчок — расширить выделение). Затем, как обычно, выберите Выделение или Подчёркивание.
См. Выделения, подчёркивания и области.
Настройки в Windows
- Настройки › Просмотр › Отсканированные PDF:
- Распознавать текст отсканированных страниц (включено по умолчанию). Если параметр выключен, статья со сканированными страницами сообщит об этом и предложит Включить.
- Языки распознавания текста, установленные в Windows, и какие из них Rectoly использует для чтения статей.
- Проверить снова и Открыть языковые параметры Windows.
- Кэш распознанного текста с кнопкой Очистить: сохранённый текст распознаётся заново при следующем открытии каждой статьи.
Добавление языка распознавания в Windows
Windows распознаёт только те языки, для которых установлено распознавание текста. Если язык отсутствует, статья показывает «В этой статье есть отсканированные страницы, но в Windows не установлен ни один язык распознавания текста.» с кнопкой Параметры Windows.
- Нажмите Параметры Windows (или Открыть языковые параметры Windows в Настройки › Просмотр › Отсканированные PDF).
- В Параметры Windows › Время и язык › Язык и регион добавьте язык. Если он уже есть, откройте его Языковые параметры.
- Установите его дополнительные компоненты, включая оптическое распознавание символов.
- Вернувшись в Rectoly, нажмите Проверить снова.
Очистка распознанного текста
Распознанный текст хранится на устройстве, поэтому каждая статья распознаётся только один раз. Чтобы распознать всё заново:
- Настройки › Диагностика › Кэш распознанного текста.
- Настройки › Просмотр › Отсканированные PDF › Кэш распознанного текста › Очистить.
Ограничения
- Распознанный текст используется для поиска и выделения в виде PDF, но не в режиме чтения.
- Вертикальный японский текст не распознаётся.
- На распознанном тексте нет маркеров выделения; используйте маркер.
- Совпадение при поиске должно находиться в пределах одной строки.