更新:
在 ScanLens 里扫描或导入这一页,用正确的源语言跑 OCR,把识别结果和图像对照一遍,改掉会改变意思的错误,然后翻译提取出的文字。文件较长,或者有分栏、表格、印章、多语言混排时,请按页或按小段翻译。
这套做法翻译的是识别出来的文字,并不承诺把原始 PDF 的版式替换成翻译版。扫描件仍是视觉上的依据。当准确性重要时,姓名、日期、金额、法律术语和专业表述应当交给通晓该语言的人或有资质的译者复核。
OCR 把像素变成字符。模糊、反光、小字号、手写、复杂分栏,以及选错源语言,都会在翻译开始前就制造错误。
翻译是从 OCR 的结果出发的。一个被完美翻译的识别错误,仍然是错的——所以要先核对识别出的原文。
表格、签名、印章、间距和页面设计都留在原扫描件里。用页面图像判断每一段提取出的文字属于哪里。
机器翻译适合用来理解内容和起草。当一份文件决定权利、医疗、移民身份、财务或安全时,它不能替代有资质的译者。
ScanLens 能识别文件中的文字,并提供复制、翻译、导出和编辑这些识别文字的操作。用来看懂一封信、翻译选定的段落、准备一份草稿,或者把核对过的措辞带进另一个应用,都很合适。
本页并不承诺自动替换原始 PDF 里的每一行,也不承诺保留字体和分栏几何、提供经认证的翻译,或可靠地读出手写与印章。要产出完整文件,请把识别出的文字作为输入,交给合适的翻译与排版流程,再把成品与原件对照。
横穿一行的阴影会改变字母和标点。柔和的日光或均衡的室内光,通常比一盏硬光灯得到更干净的识别结果。
每个字符占的像素越多,识别越好。靠近一些,同时保证页面四边都在画面内,并让相机与纸面平行。
当单一阅读顺序会把不相关的文字混在一起时,把分栏、表格、图注和旁注拆成更小的逻辑块分别翻译。
金额、日期、尺寸、型号、账户信息和地址都是影响很大的字段。在依赖译文之前,逐项与扫描件核对。
ScanLens 能从扫描件中识别文字,并为识别结果提供翻译操作。翻译重要内容之前,请先核对并修正 OCR 结果。
本页并未声称会自动替换版式。这套流程翻译的是识别出的文字,原始扫描页仍是视觉依据。
当前公开的产品信息是恰好 14 种 OCR 语言。可翻译的语言是另一回事,取决于语言组合和当时的系统服务。
手写识别的覆盖面比印刷体 OCR 更窄,结果也更不稳定。请用有代表性的笔迹测试,仔细核对识别出的原文;涉及后果时,没有人工核实就不要依赖它。
它有助于先看懂大意,但有后果的文件应由有资质的人复核。OCR 和翻译都可能引入错误。
ScanLens 的核心 OCR 在 iPhone 上运行。翻译操作可能会用到所涉翻译服务或系统流程的能力和网络行为,因此处理敏感文字时,请检查当前的设备与服务设置。