更新:

Translate a Scanned Document on iPhone

用本机 OCR 从扫描件或照片中识别文字,改掉会影响意思的识别错误,再翻译提取出来的文字。原始页面始终留着,方便对照。

本机 OCR 14 种 OCR 语言 识别结果可编辑
Download on the App Store

在 iPhone 上怎么翻译扫描的文件?

在 ScanLens 里扫描或导入这一页,用正确的源语言跑 OCR,把识别结果和图像对照一遍,改掉会改变意思的错误,然后翻译提取出的文字。文件较长,或者有分栏、表格、印章、多语言混排时,请按页或按小段翻译。

这套做法翻译的是识别出来的文字,并不承诺把原始 PDF 的版式替换成翻译版。扫描件仍是视觉上的依据。当准确性重要时,姓名、日期、金额、法律术语和专业表述应当交给通晓该语言的人或有资质的译者复核。

OCR 翻译有两个各自独立的准确性环节

环节一:识别原文

OCR 把像素变成字符。模糊、反光、小字号、手写、复杂分栏,以及选错源语言,都会在翻译开始前就制造错误。

环节二:翻译识别出的词

翻译是从 OCR 的结果出发的。一个被完美翻译的识别错误,仍然是错的——所以要先核对识别出的原文。

版式是上下文,不是翻译产物

表格、签名、印章、间距和页面设计都留在原扫描件里。用页面图像判断每一段提取出的文字属于哪里。

人工复核依然必要

机器翻译适合用来理解内容和起草。当一份文件决定权利、医疗、移民身份、财务或安全时,它不能替代有资质的译者。

分步:扫描、识别、核对、翻译

  1. 拍一页看得清的内容. 让画面充满,纸张放平,光线均匀,别把页边和脚注切掉。如果已经有更清晰的图片,直接导入。
  2. 选择正确的 OCR 语言. ScanLens 公开支持 14 种语言的 OCR。选与纸面印刷相符的源语言;多语言混排的文件可能需要分几次处理。
  3. 核对并修改识别结果. 把 OCR 结果与页面图像对照。改正姓名、数字、标点、标题,以及任何会改变句意的词。
  4. 执行翻译. 翻译已经核对过的文字。可用性和质量会随语言组合、系统版本、术语以及所用的翻译服务而变化。
  5. 把原件放在结果旁边. 当对方可能需要核对措辞、格式、印章或签名时,把原扫描件与译文一起保存或发送。

ScanLens 翻译什么——以及它不声称做什么

ScanLens 能识别文件中的文字,并提供复制、翻译、导出和编辑这些识别文字的操作。用来看懂一封信、翻译选定的段落、准备一份草稿,或者把核对过的措辞带进另一个应用,都很合适。

本页并不承诺自动替换原始 PDF 里的每一行,也不承诺保留字体和分栏几何、提供经认证的翻译,或可靠地读出手写与印章。要产出完整文件,请把识别出的文字作为输入,交给合适的翻译与排版流程,再把成品与原件对照。

翻译之前,怎样让 OCR 更准

用均匀的光

横穿一行的阴影会改变字母和标点。柔和的日光或均衡的室内光,通常比一盏硬光灯得到更干净的识别结果。

让画面充满

每个字符占的像素越多,识别越好。靠近一些,同时保证页面四边都在画面内,并让相机与纸面平行。

把复杂区域分开

当单一阅读顺序会把不相关的文字混在一起时,把分栏、表格、图注和旁注拆成更小的逻辑块分别翻译。

数字要人工核对

金额、日期、尺寸、型号、账户信息和地址都是影响很大的字段。在依赖译文之前,逐项与扫描件核对。

Frequently asked questions

ScanLens 能翻译扫描版 PDF 里的文字吗?

ScanLens 能从扫描件中识别文字,并为识别结果提供翻译操作。翻译重要内容之前,请先核对并修正 OCR 结果。

它会生成版式相同的翻译版 PDF 吗?

本页并未声称会自动替换版式。这套流程翻译的是识别出的文字,原始扫描页仍是视觉依据。

ScanLens 支持多少种 OCR 语言?

当前公开的产品信息是恰好 14 种 OCR 语言。可翻译的语言是另一回事,取决于语言组合和当时的系统服务。

它能翻译手写内容吗?

手写识别的覆盖面比印刷体 OCR 更窄,结果也更不稳定。请用有代表性的笔迹测试,仔细核对识别出的原文;涉及后果时,没有人工核实就不要依赖它。

机器翻译适合法律或医疗文件吗?

它有助于先看懂大意,但有后果的文件应由有资质的人复核。OCR 和翻译都可能引入错误。

做 OCR 需要把文件上传吗?

ScanLens 的核心 OCR 在 iPhone 上运行。翻译操作可能会用到所涉翻译服务或系统流程的能力和网络行为,因此处理敏感文字时,请检查当前的设备与服务设置。

翻译之前,先核对识别出的文字

ScanLens 把原始页面与可编辑的 OCR 文字并排放着,让你先改好关键字段,再带着上下文去翻译。

Download on the App Store