Сканирование PDF-файлов с помощью оптического распознавания символов, преобразование изображений в PDF с возможностью поиска и извлечение текста — в первую очередь в браузере, где поддерживается WASM.
Стандартное распознавание текста в Tentaco запускается локально в вашем браузере для типичного сканирования. Ваши страницы не загружаются по этому пути, если вы не используете явно отмеченную облачную функцию.
OCR поддерживает основные латинские алфавиты и дополнительные языки в зависимости от пакета движка, загруженного в сеанс вашего браузера. Проверьте пользовательский интерфейс инструмента на наличие списка активных языков.
Да — откройте PDF OCR или центр инструментов OCR, перетащите отсканированный PDF-файл и извлеките текст с возможностью поиска или текстовый слой в зависимости от режима.