PDF OCR

OCRを使用してスキャンされたPDFファイルや画像からテキストを認識します。

チュートリアルを読む →

PDFまたは画像ファイルをここにドロップ

または ファイルを選択

なぜPDFNeo

スピード、プライバシー、シンプルさのために。

高速処理

最適化されたエンジンで数秒で処理

100%安全

ファイルはローカル処理、サーバーには送信されません

どこでも動作

あらゆるデバイス、ブラウザ、時間で利用可能

登録不要 オフライン対応 ファイル制限なし ずっと無料
ファイルはローカル処理され、サーバーに送信されることはありません。

こちらをご覧ください: PDFのOCR

よくある質問、ステップバイステップガイド、プロのテクニック——すべてがここに。セクションをクリックして展開してください。

スキャンPDFを検索可能にする方法

スキャンしたPDFの文字をコピーしたり検索したりできなくて困ったことはありませんか?OCRで解決できます。

  1. スキャンPDFをアップロード. OCR処理したいスキャンPDFまたは画像PDFをアップロードエリアにドラッグしてください。
  2. 言語を選択. ドキュメントに含まれる言語を選択してください。日本語、英語をはじめ、多くの言語に対応しています。正確な認識のために重要です。
  3. OCR処理を開始. OCRボタンをクリックして、文字認識処理を開始します。ツールがページごとに文字を解析し、テキストレイヤーを追加します。
  4. テキスト化されたPDFをダウンロード. 処理完了後、検索可能なテキストレイヤーが追加された新しいPDFをダウンロードしてください。文字を選択したり検索したりできるようになります。
デスクトップソフトではなく、オンラインでPDFをOCRする理由

OCRソフトといえば高額なイメージがありますが、たまに使うだけならわざわざ買う必要はありません。Adobe Acrobat ProもOCR機能はありますが、月額数千円はちょっと…という方も多いはず。PDFNeoのオンラインOCRなら、ブラウザを開くだけですぐに使えます。インストール不要、登録不要、完全無料。何よりすごいのは、すべての処理がブラウザ内でローカル実行されること。あなたのスキャン書類がどのサーバーにもアップロードされることはありません。身分証明書、契約書、個人情報が含まれる書類——すべてがあなたのデバイス上に留まります。

PDFのOCRが必要になるのはどんな時?

スキャンした書類から文字をコピーしたい時。 スキャンPDFの中の特定の文字をコピーして使いたいのに、画像なので選択できない。OCRすれば、文字を選択してコピーできるようになります。

大量の書類の中からキーワード検索したい時。 何十、何百ものスキャン書類の中から、特定の言葉を含む書類を探したい。OCRでテキスト化しておけば、ファイル内検索が可能になります。

書類の内容をテキストとして再利用したい時。 紙の書類をデジタル化したけど、画像のままでは使いにくい。OCRでテキスト化すれば、Wordに貼り付けたり編集したりできます。

アーカイブやバックアップを検索可能にする時。 古い書類をスキャンして保存しているけど、探すのが大変。全部OCRしておけば、キーワードですぐに目的の書類が見つかります。

プロ直伝!OCRのテクニック

元の画像が鮮明なほど精度が上がります。スキャンする時は解像度を300 DPI程度に設定し、影や歪みがないようにしましょう。低画質の画像だと認識率がガクッと下がります。

正しい言語を選びましょう。ドキュメントの言語を正しく指定することで、認識精度が大幅に上がります。日本語の書類なら日本語を選んでください。

処理後は必ず確認しましょう。特に数字や固有名詞は間違えやすいので、重要な箇所は目視で確認することをおすすめします。100%完璧ではないので、過信は禁物です。

表や図が多い書類は苦手です。OCRは基本的に文章の認識が得意で、複雑な表や図形、特殊な書式は苦手です。そういった箇所は特に注意して確認しましょう。

よくある質問
OCRとは何ですか?

OCRはOptical Character Recognition(光学文字認識)の略です。スキャンした書類や画像の中の文字をコンピュータが解析して、編集可能なテキストデータに変換する技術のことです。

どのくらい正確ですか?

文字の鮮明さや言語によって異なりますが、鮮明なスキャン画像なら95%以上の精度で認識できます。手書き文字や低解像度の画像では精度が下がります。

元の画像は保持されますか?

はい。元の画像はそのままで、その上に透明なテキストレイヤーが追加されます。見た目は元のスキャン画像のまま、文字を選択・検索できるようになります。

PDFはサーバーにアップロードされますか?

全くありません。すべてのOCR処理はブラウザ内でローカル実行されます。ファイルがデバイスから出ることは一切ありません。タブを閉じれば、すべてがメモリから消去されます。

日本語に対応していますか?

はい、日本語に対応しています。日本語と英語が混在したドキュメントも認識可能です。処理を始める前に、ドキュメントの言語を選択してください。

処理にはどれくらい時間がかかりますか?

ページ数とデバイスの性能によります。数ページなら数十秒で完了しますが、何十ページもある場合は数分かかることがあります。

手書き文字も認識できますか?

残念ながら手書き文字の認識には対応していません。印刷された文字(活字体)の認識に特化しています。