OCR PDF

スキャンした PDF を検索可能なドキュメントまたはプレーン テキスト ファイルに変換します。認識はローカルで実行され、元の PDF ページは変更されません。

  • 1アップロード
  • 2設定
  • 3処理
  • 4ダウンロード
ここにファイルをドラッグ アンド ドロップします
または

サポートされているファイルの種類: .pdf。最大 1 ファイルをアップロードできます。各ファイルは 25 MB 以下である必要があります。

サポートされているファイルの種類: .pdf。最大 1 ファイルをアップロードできます。各ファイルは 25 MB 以下である必要があります。

設定

OCR 言語

Ctrl または Cmd を押したまま複数の言語を選択します。

出力フォーマット
認識品質

スキャンしたページを検索可能な PDF またはプレーン テキストに変換する

次に行う必要がある内容に一致する出力を選択してください。検索可能な PDF を使用すると、元のページを参照できる状態に保ちながら、認識されたテキストを見つけやすくなります。一方、主にメモ、編集、または再利用のために文言を抽出したい場合には、プレーン テキストの方が適しています。

認識される前に正しい言語を選択してください

文書で使用されている言語を選択すると、OCR エンジンが文字、アクセント、句読点、単語パターンをより正確に解釈するのに役立ちます。バイリンガルのテキストや異なる言語で書かれたセクションを含む PDF では、複数の言語を選択できます。

元のページの外観を維持する

OCR は、ドキュメントを再設計するのではなく、各ページに表示される単語を認識することに重点を置いています。元の PDF ページは視覚的に変更されていないため、検索可能な PDF 出力は、スキャン、署名、スタンプ、イラスト、および既存のページの書式設定を保存したい場合に適しています。

よくある質問

OCR 言語が重要なのはなぜですか?

言語はさまざまな文字セット、アクセント、句読点規則、単語パターンを使用します。正しい言語を選択すると、認識エンジンにより適切なコンテキストが提供されます。言語が一致しないと、有効な文字が似た文字または記号として解釈される可能性があります。

複数の言語を含む PDF を認識できますか?

はい。言語セレクターを使用すると、複数の言語を選択できます。文書内で意味のある言語をすべて選択しますが、より焦点を絞って選択すると認識時の曖昧さが軽減されるため、無関係な言語を追加することは避けてください。

一部の単語が正しく認識されないのはなぜですか?

ページがぼやけている、傾いている、低解像度、過度に圧縮されている、汚れている、かすれている、または不均一な照明の下で撮影された場合、認識エラーが発生する可能性が高くなります。珍しいフォント、画像上のテキスト、狭い欄、スタンプ、手書きのメモなども文字の識別を困難にする可能性があります。

OCR は手書きのテキストを認識できますか?

OCR は、通常、明確に印刷または入力されたテキストの方が信頼性が高くなります。きれいな手書き文字は部分的に認識される場合がありますが、結果は書き方によって大きく異なる場合があります。手書きの名前、署名、メモ、番号は、正確な転写として扱うのではなく、手動でチェックする必要があります。

×ファイル サイズが制限を超えています。

×これ以上ファイルをアップロードすることはできません。

より多くの機能を利用するには、アカウントをアップグレードしてください

月額請求
年間請求
-40%

プレミアム

US$ / 月
US$48 で毎年請求されます

無制限

US$ / 月
US$96 で毎年請求されます