ツールを選ぶ
上の17のツールからどれかを開いて、ファイルをドロップするだけ。アカウントもインストールも不要で、アップロード画面で待たされることもありません。
スキャンしたPDFを検索・選択できるようにする
いいえ。認識はtesseract.js(WebAssemblyにコンパイルされたTesseract OCRエンジン)を使ってブラウザ内で行われます。ダウンロードされるのはプログラム本体と言語モデルだけで、文書が送信されることはありません。
英語、スペイン語、ポルトガル語、フランス語、ドイツ語、インドネシア語、中国語(簡体字)、日本語、アラビア語です。処理する前に文書の言語を選んでください。中国語、日本語、アラビア語では英語も同時に認識されるため、混在する単語も正しく読み取れます。
PDFは元の見た目を保ったまま、認識したテキストが目に見えないレイヤーとして追加され、選択・検索・コピーができるようになります。テキストを編集するには、処理後のファイルを「PDFをWordに変換」にかけてください。そのレイヤーが.docxファイルに抽出されます。
OCRの精度はスキャンの状態によって決まります。ぼやけたページ、傾いたページ、解像度の低いページ、手書きの文字、装飾的なフォントでは誤りが増えます。最良の結果を得るには、300 dpiでスキャンし、ページをまっすぐに置き、十分なコントラストを確保してください。
上の17のツールからどれかを開いて、ファイルをドロップするだけ。アカウントもインストールも不要で、アップロード画面で待たされることもありません。
実際の処理は、オフラインアプリと同じ技術であるWebAssemblyとJavaScript(pdf-lib、pdf.js)を使ってブラウザが行います。ファイル自体がパソコンの外に出ることはありません。
処理が終わるとすぐに、ブラウザで通常どおりファイルがダウンロードされます。こちら側には何も保存されません。そもそもコピーを作らないので、サーバー上に削除すべきコピーも存在しないのです。
従来のオンラインPDFツールとは異なり、The PDFverseはWebAssemblyとJavaScriptを使って、すべてをクライアント側で処理します。文書がアップロードされたり、保存されたり、第三者のサーバーからアクセスされたりすることはありません。
複数のPDFを1つのファイルにまとめる
特定のページや文書全体を分ける
読みやすさを保ったままファイルサイズを縮小
JPGやPNGの画像をPDFに変換
PDFから高解像度のJPG画像を書き出す
強力なパスワード暗号化を追加
権限のある文書からパスワードを解除
テキストを編集可能なDOCX文書に抽出
DOCXファイルを汎用的なPDF形式に変換
横向きや逆さまのページの向きを直す
数回のクリックで不要なページを削除
「社外秘」などの文字を全ページに入れる
位置と書式を選んでページに番号を振る
手書きの署名を描いてページに配置
全ページの余白を切り取る
プレビューを見ながら並べ替え・回転・削除