UTILS.
100% ブラウザ内で完結

PDFからテキストを抽出

PDF内の選択可能なテキストをすべて取り出し、コピーやダウンロードできるプレーンテキストにします。アップロードは不要です。

初回利用時にエンジンを読み込むため、オフライン用のダウンロードはありません。それでもブラウザ内で非公開に動作し、何もアップロードされません。

ここにPDFをドロップするか、クリックしてファイルを選択

このツールについて

PDFのテキストレイヤーを、きれいでコピーしやすいプレーンテキストとして抽出します。ファイルをドロップすると、各ページが順番に読み取られ、ページの区切りにマーカーが挿入されます。その結果はクリップボードにコピーするか、.txtファイルとしてダウンロードできます。

すべてブラウザ内でローカルに動作します。文書がデバイスから外に出ることはなく、どこにも保存されません。そのため、契約書や請求書、明細書など機密性の高いファイルでも安心して使えます。

このツールは、PDFビューアで選択・コピーできる埋め込みのテキストレイヤーを読み取る点に注意してください。スキャンした文書はページを撮影した画像にすぎずテキストレイヤーがないため、結果は空になります。そうしたファイルには、代わりにOCRツールを使って文字を認識させてください。

よくある質問

PDFからテキストが出力されなかったのはなぜですか?
おそらくスキャンした文書です。ページが画像で、選択可能なテキストレイヤーがありません。このツールはOCRを行いません。スキャンした文字を認識するには、当サイトの画像OCRツールにページを通してください。
PDFはサーバーにアップロードされますか?
いいえ。テキストはブラウザのタブ内で完結して動作するPDFエンジンによって抽出されるため、ファイルがデバイスから外に出ることはありません。機密文書でも安心です。
元のレイアウトは保持されますか?
PDFが示す位置では改行が保持されますが、段組みや表、正確な間隔は読み順に平坦化されます。PDFは印刷用の形式なので、レイアウトを完全に復元できるとは限りません。
一部のページだけを抽出できますか?
このツールはすべてのページを抽出し、その間に「ページ N」の区切りを挿入します。そのため、出力ボックスから必要な部分だけをすばやく見つけてコピーできます。

その他のツール