PDF to Text
任意の PDF からテキストを抽出し、プレーンな .txt ファイルとしてコピーまたはダウンロードします。すべてブラウザ内で動作するため、ドキュメントがデバイスから出ることはありません。
ここに PDF ファイルをドロップ
または
PDF からテキストを抽出する方法
- 1 つの PDF ファイルをアップロード領域にドロップするか、クリックしてデバイスから選択します。
- コンテンツの場所を特定しやすくするため、ページ間にページマーカーを含めるかどうかを選択します。
- [テキストを抽出] をクリックし、全ページからテキストが取り出されるまで待ちます。
- 結果をクリップボードにコピーするか、.txt ファイルとしてダウンロードします。
よくある質問
PDF ファイルはサーバーにアップロードされますか?
いいえ。PDF to Text は pdf.js を使いブラウザ内で完全に実行されるため、ドキュメントがデバイスから出ることはありません。
このツールはどのようなテキストを抽出できますか?
PDF に埋め込まれたテキストレイヤーを抽出します。テキストレイヤーのないスキャン済みまたは画像ベースの PDF は、ほとんど、またはまったくテキストを返しません。
このツールは OCR を行いますか?
いいえ。Handio は光学文字認識を実行しません。PDF がスキャン済みの場合、テキストを復元するには専用の OCR ツールが必要です。
テキストの間隔が少し不自然なのはなぜですか?
PDF はテキストを連続した段落ではなく、位置指定された断片として保存します。段組みや表のような複雑なレイアウトでは、間隔や改行が不自然になることがあります。
関連ツール
PDF to Text を使う理由
PDF の言葉を抽出して再利用できます。エディターに貼り付けたり、レポートから引用したり、長いドキュメントを再入力せずに検索したりできます。
- PDF から文書やメールへ引用や一節をコピーできます。
- PDF の内容をテキストエディターやスプレッドシートで検索・編集可能にできます。
- レポートや論文から生のテキストを取り出して、分析、翻訳、要約に使えます。
ヒントと制限
PDF to Text は pdf.js を使って埋め込みテキストレイヤーを抽出するため高速でプライベートですが、OCR は実行しません。スキャン済みドキュメントはほとんど、またはまったくテキストを返さず、段組みページや表のような複雑なレイアウトは間隔が不自然になることがあります。