PDFテキスト変換ツール
PDFファイルのテキストを瞬時に抽出します。すべての処理はブラウザ内で完結し、アップロードも待ち時間もありません。
PDFをここにドロップ
または クリックして選択
50MBまでのPDFファイルに対応
ファイルはすべてブラウザ内で処理されます。サーバーには何もアップロードされません。
PDFテキスト変換ツールについて
Konvityのpdfテキスト変換ツールは、ブラウザ内で直接あらゆるPDFからテキストを抽出します。インストール不要、アップロード不要、待ち時間もありません。また、無料のocrオンラインツールとしても機能します。ページが実際のテキストではなくスキャンされた画像だった場合、内蔵のOCRが画像を読み取り、文字を抽出します。
プレーンテキストではなく、スキャンしたpdfをwordに変換したいですか。OCRが完了すると、結果を.txtだけでなく実際の.docxファイルとしてダウンロードできます。これが、サイトやツールを切り替えることなく、一つの手順でpdfをocrでwordに変換する方法です。このocrオンライン処理はすべてお使いの端末上で実行されます。サーバーには何も送信されないため、ファイルはプライベートなまま保たれます。
主な使い方
古い紙の書類をデジタル化する
古い契約書、手紙、手書きの用紙をスマートフォンでスキャンしてPDFとして保存します。元のPDFにテキスト層がまったくなくても、ここでOCRを実行すれば実際に編集可能なテキストが得られます。
スキャンしたPDFの中身を検索する
スキャンしたPDFは画像の裏にテキストがないため、Ctrl+Fで検索できません。OCRを実行すると、どこにでも検索・コピー・貼り付けできるプレーンテキストが得られます。
スキャンした書類をWordに変換する
スキャンした契約書、用紙、手紙を編集する必要がある場合は、OCRでテキストを抽出して.docxファイルとしてダウンロードします。ページ全体を打ち直す代わりに、Microsoft WordやGoogleドキュメントで直接開けます。
研究論文から引用を抽出する
学術論文やレポートから引用、データ、参考文献を手で打ち直すことなくコピーできます。要約や引用、文献レビューを書く際の時間の節約になります。
請求書や領収書からデータを抽出する
紙の請求書や領収書をスキャンしてテキストに変換し、数字や詳細を手で入力し直す代わりに表計算ソフトや経理ソフトにコピーできます。
翻訳や再利用のためにコンテンツを準備する
PDFのマニュアル、レポート、プレゼンテーションからきれいなテキストを抽出し、PDFの書式に悩まされることなく翻訳ツールやブログ記事、他の文書に貼り付けられます。
よくある質問
PDFファイルはサーバーにアップロードされますか。
いいえ。Konvityはすべてのファイルをブラウザ内でPDF.jsを使ってローカルに処理します。ファイルがお使いの端末から外部に送信されることはなく、完全なプライバシーが保たれます。
どのようなPDFファイルに対応していますか。
ほとんどの標準的なPDFに対応しています。スキャンされたPDFや画像ベースのPDFの場合、抽出できるテキストがほとんどないページを検出し、Tesseract.jsによる端末上でのOCR(オプション)でテキストを認識します。この処理もすべてブラウザ内でローカルに実行されます。
OCRによるテキスト抽出の精度はどのくらいですか。
OCRはブラウザ内で完全に実行され、鮮明でスキャン状態の良い書類には高い精度を発揮しますが、低解像度のスキャン、特殊なフォント、手書き文字では精度が下がることがあります。OCRの結果を利用する前に必ず内容を確認してください。
抽出したテキストをWord文書としてエクスポートできますか。
はい。.txtのダウンロードに加えて、元のPDFのページに対応した改ページを保持した.docx(Word)ファイルをダウンロードできます。
ファイルサイズに制限はありますか。
はい、50MBまでのPDFファイルに対応しています。それより大きいファイルは、アップロード前に分割または圧縮してください。
モバイルでもこのツールを使えますか。
はい。このツールは完全にレスポンシブ対応しており、iOSやAndroidのChrome、Safariを含むすべての最新モバイルブラウザで動作します。
OCRはどの言語に対応していますか。
内蔵のOCRは現在、英語のテキストを認識します。今後のアップデートで対応言語が追加される可能性があります。