はい — 抽出されたテキストは HTML で完全に選択可能で編集可能です。スキャンした PDF は (画像のみ) まず OCR を必要とします。その場合は変換の設定で OCR オプションを有効にしてください。
HTML は携帯電話や電子書籍リーダーで正しくリフローされますか?
+
PDF は固定ページを持ち、小さな画面ではページ全体を縮小するか、水平スクロールを強制します。HTML はテキストをテキストとして保存し、読者はスクリーン幅とフォントサイズに合わせてテキストを再配列します。多列レイアウトや大きな表はリフローが難しい部分です。変換後にチェックするべき部分です。 HTMLはソフトウェアをインストールしないで,すべてのデバイスのすべてのブラウザで読み取れる。
HTML は正しく編集可能ですか?
+
PDF から変換するのは、そのためです。出力は、固定ページ画像ではなく、段落、スタイル、表を含む実際の文書として開きます。これを直接編集することができ、再タイプする必要がありません。重いデザインのソースレイアウトは、単純な文字列よりも変換が遅いので、複雑なグリッドで作成されたものは、間隔が整理されているでしょう。
HTML のCSS、画像、リンクはどうなるのか?
+
HTML だけが別のプレゼンテーションレイヤーを持っているので、変換前にスタイルシートを解析して適用します。相対パスで参照された画像は、認証や JavaScript レンダリングの背後にある画像は含まれません。絶対リンクはクリック可能です。 PDFはPostScriptから派生した描画演算子、埋め込みフォント、埋め込み画像を含むページを記述するので、レイアウトはリフローではなくピンである。