更新:
ScanLensでページを取り込むか読み込み、正しい原文の言語でOCRを実行し、認識結果を画像と見比べ、意味が変わる誤りを直してから、取り出した文字を翻訳します。書類が長いとき、段組み・表・押印・複数言語が混ざるときは、ページ単位か小さなまとまりごとに翻訳してください。
この流れが翻訳するのは認識した文字であり、元のPDFのレイアウトを翻訳版に置き換えると約束するものではありません。スキャンが見た目の基準として残ります。氏名・日付・金額・法律用語・専門用語は、正確さが求められる場面では、その言語に通じた人か資格のある翻訳者に確認してもらってください。
OCRは画素を文字に変えます。ぼけ、反射、小さな活字、手書き、複雑な段組み、原文言語の取り違えは、翻訳が始まる前に誤りを生みます。
翻訳はOCRの結果を出発点にします。誤認識を完璧に翻訳しても、内容は間違ったままです。だから原文の認識結果を先に確かめます。
表・署名・押印・余白・紙面の設計は元のスキャンに残ります。取り出した一節がどこに属するかは、ページの画像で確かめてください。
機械翻訳は、内容をつかむときや下書きを作るときに役立ちます。権利・医療・在留資格・金銭・安全を左右する書類では、資格のある翻訳者の代わりにはなりません。
ScanLensは書類の文字を認識し、その文字をコピー・翻訳・書き出し・編集する操作を用意しています。手紙の内容をつかむ、選んだ段落を訳す、下書きを整える、確認済みの文言を別のアプリへ移す——こうした用途によく合います。
一方で、元のPDFの中の一行ずつを自動で置き換えること、書体や段組みの形を保つこと、公的に有効な翻訳を出すこと、手書きや印章を確実に読み取ることは約束していません。完成した書類を作るには、認識した文字を適切な翻訳・組版の工程に渡し、仕上がりを原本と見比べてください。
一行を横切る影は、文字や句読点を変えてしまいます。拡散した昼光や、偏りのない室内光のほうが、強い一灯より認識はきれいになります。
一文字あたりの画素が増えるほど認識は良くなります。ページの端がすべて見える範囲で近づき、カメラを紙面と平行に保ってください。
一つの読み順では無関係な文が混ざるとき、段組み・表・図の説明・欄外の注は、小さなまとまりに分けて翻訳します。
金額・日付・寸法・型番・口座情報・住所は、間違いの影響が大きい項目です。翻訳を信頼する前に、一つずつスキャンと照合してください。
ScanLensはスキャンから文字を認識し、その認識結果に対して翻訳の操作を提供します。重要な内容を翻訳する前に、OCRの結果を見直して直してください。
このページは、レイアウトを自動で置き換えるとは述べていません。翻訳するのは認識した文字で、元のスキャンページが見た目の基準として残ります。
現在の公開されている製品情報では、ちょうど14言語です。翻訳できる言語は別の話で、言語の組み合わせやそのときのシステム側のサービスによって変わります。
手書きの認識は、印刷文字のOCRより対象が狭く、ばらつきも大きくなります。代表的な筆跡で試し、認識結果をよく確かめ、影響の大きい内容では人の確認なしに頼らないでください。
最初に内容をつかむ助けにはなりますが、影響の大きい書類は資格のある人に確認してもらってください。OCRも翻訳も、それぞれ誤りを生みます。
ScanLensの中心的なOCRはiPhone上で動きます。翻訳の操作は、関わる翻訳サービスやシステム側の仕組みの機能と通信の挙動を使うことがあるため、機微な文章では端末とサービスの現在の設定を確認してください。