Обновлено:
Отсканируйте или импортируйте страницу в ScanLens, запустите OCR на правильном исходном языке, сверьте распознанный текст с изображением, исправьте значимые ошибки и затем переведите извлечённый текст. Переводите постранично или небольшими фрагментами, если документ длинный либо содержит колонки, таблицы, печати или несколько языков.
Этот порядок переводит распознанный текст; он не обещает заменить вёрстку исходного PDF переведённой версией. Скан остаётся визуальным первоисточником. Имена, даты, суммы, юридические и технические термины стоит проверить у человека, владеющего языком, или у квалифицированного переводчика, когда точность важна.
OCR превращает пиксели в символы. Смазанность, блики, мелкий шрифт, рукописный текст, сложные колонки и неверно выбранный исходный язык дают ошибки ещё до перевода.
Перевод работает с результатом OCR. Безупречно переведённая ошибка распознавания остаётся ошибкой — поэтому исходный текст надо проверить первым.
Таблицы, подписи, печати, отступы и оформление страницы остаются в исходном скане. По изображению страницы вы поймёте, к чему относится каждый извлечённый фрагмент.
Машинный перевод полезен, чтобы понять смысл и подготовить черновик. Он не заменяет квалифицированного переводчика, когда документ определяет права, лечение, миграционный статус, финансы или безопасность.
ScanLens распознаёт текст документа и даёт действия, чтобы этот текст скопировать, перевести, выгрузить и отредактировать. Это хорошо подходит, чтобы понять письмо, перевести отдельные абзацы, подготовить черновик или перенести проверенные формулировки в другое приложение.
Страница не обещает автоматически заменить каждую строку внутри исходного PDF, сохранить шрифты и геометрию колонок, дать заверенный перевод или надёжно прочитать рукописный текст и печати. Для полноценного выпуска документа используйте распознанный текст как исходные данные для подходящего процесса перевода и вёрстки, а затем сверьте готовый результат с оригиналом.
Тень поперёк строки меняет буквы и знаки препинания. Рассеянный дневной или сбалансированный комнатный свет обычно даёт более чистое распознавание, чем одна жёсткая лампа.
Чем больше пикселей на символ, тем лучше распознавание. Подойдите ближе, оставляя видимыми все края страницы и держа камеру параллельно листу.
Переводите колонки, таблицы, подписи к рисункам и заметки на полях отдельными логическими блоками, если единый порядок чтения смешает несвязанный текст.
Суммы, даты, размеры, номера моделей, реквизиты счетов и адреса — поля с высокой ценой ошибки. Сверьте каждое со сканом, прежде чем полагаться на перевод.
ScanLens распознаёт текст со сканов и предлагает действие перевода для этого распознанного текста. Проверьте и поправьте результат OCR, прежде чем переводить важное.
Эта страница не заявляет об автоматической замене вёрстки. Порядок работы переводит распознанный текст, а исходная отсканированная страница остаётся визуальным ориентиром.
Текущий публичный факт о продукте — ровно 14 языков OCR. Доступность языков перевода — отдельный вопрос, она зависит от языковой пары и текущих системных служб.
Распознавание рукописного текста уже и менее стабильно, чем OCR печатного. Проверьте на характерном почерке, внимательно просмотрите распознанный исходник и не полагайтесь на него для значимого содержимого без человеческой проверки.
Он помогает понять смысл в первом приближении, но значимые документы должен проверить квалифицированный человек. Ошибку способны внести и OCR, и перевод.
Основное распознавание ScanLens работает на iPhone. Действие перевода может использовать возможности и сетевое поведение задействованной службы перевода или системного сценария, поэтому для конфиденциального текста проверьте текущие настройки устройства и служб.