PDFをテキストに変換
PDFから文字を取り出してその場で読んだりコピーしたりできます。テキスト層のあるPDFならどれでも動作します。
…
すべてブラウザ内で処理されます。ファイルが端末から送信されることはありません。
使い方
- PDFを選ぶ文書を枠にドロップするか、クリックして選びます。
- 出力の形を決める改行を保持すると元の体裁に近くなり、外すと段落が続けて出ます。ページの区切りを入れると各ページの始まりが分かります。
- コピーまたは保存テキストがページ上に表示されます。ボタン1つでコピーするか、.txt として保存できます。
ブラウザ内で動作する理由
すべての処理は WebAssembly により手元の端末で実行されます。アップロードがないため順番待ちもサーバー側の容量制限もなく、他人のストレージに文書の複製が残ることもありません。
よくある質問
何も出てきません。なぜですか?
その文書はほぼ確実にスキャンです。スキャンされたページは文字の「画像」であって文字ではないため、取り出せるものがありません。読み取るにはOCRという別の処理が必要です。
元のレイアウトは保たれますか?
おおむね保たれます。改行は語句の配置から復元するので、通常の文書ではうまくいきます。多段組みや複雑な表は、見た目の順ではなく読み順で出力されます。
PDFファイルはサーバーにアップロードされますか?
いいえ。すべてのツールは WebAssembly でブラウザ内で動作します。ファイルが端末から出ることはなく、アップロード待ちもなく、当方が保存・削除するものもありません。