1スキャンした PDF documents をアップロードします。クリーンな 300 DPI グレースケールスキャンは認識機能にとって最も有用です。
2言語を指定すると、 言語の名前を付けることで、 推測をさせることよりも 多くの利点が得られます。
3認識パスを実行します。単語は元のページ画像の上に見えないレイヤーとして書き戻されます。
4検索可能な PDF ファイルをダウンロードします。同じように見えますが、検索とテキストの選択が可能です。
OCR PDF よくある質問
ソースフォーマットは認識に影響するのか?
+
It does. PDF はページを固定します: フォント、ベクトル、ラスター画像、テキスト座標は凍結され、読者全員が同じレイアウトを見るようになります. How the page is stored decides what resolution and colour information the recogniser has to work with.
PDF に特有な何かは?
+
Yes — PDFはページの画像ではなく オブジェクトグラフです テキストは選択可能で ベクトルは鋭く残っています 内部のラスターコンテンツに何が起こっても. It affects what the recogniser can see.
PNG.toはピクセルを失うことを許さない場合に使うフォーマットを中心に構築されています。 損失なし、アルファ対応、スクリーンショット、ロゴ、ラインアート、ハードエッジのあるものの正しい答え。 画像作業はほとんど一歩ではありません。人々はフォーマットを変更するために来て、画像のサイズ、重さ、形状を変えて 帰ります。OCR PDF を同じアップロードパイプライン、同じサイズ制限、同じアカウントで実行するのは、4番目のタブではなく、ここにある理由です。
OCR PDFが終わったら、結果をどうするか。
+
透明度の決定は,透明度の変更を行う段階である。 That is the step most people actually came for, and doing it after OCR PDF rather than before it means the conversion works from the file you finally settled on.