OCR PDF
スキャンした PDF を検索可能なドキュメントまたはプレーン テキスト ファイルに変換します。認識はローカルで実行され、元の PDF ページは変更されません。
- 1アップロード
- 2設定
- 3処理
- 4ダウンロード
設定
Ctrl または Cmd を押したまま複数の言語を選択します。
スキャンしたページを検索可能な PDF またはプレーン テキストに変換する
次に行う必要がある内容に一致する出力を選択してください。検索可能な PDF を使用すると、元のページを参照できる状態に保ちながら、認識されたテキストを見つけやすくなります。一方、主にメモ、編集、または再利用のために文言を抽出したい場合には、プレーン テキストの方が適しています。
認識される前に正しい言語を選択してください
文書で使用されている言語を選択すると、OCR エンジンが文字、アクセント、句読点、単語パターンをより正確に解釈するのに役立ちます。バイリンガルのテキストや異なる言語で書かれたセクションを含む PDF では、複数の言語を選択できます。
元のページの外観を維持する
OCR は、ドキュメントを再設計するのではなく、各ページに表示される単語を認識することに重点を置いています。元の PDF ページは視覚的に変更されていないため、検索可能な PDF 出力は、スキャン、署名、スタンプ、イラスト、および既存のページの書式設定を保存したい場合に適しています。
よくある質問
OCR 言語が重要なのはなぜですか?
言語はさまざまな文字セット、アクセント、句読点規則、単語パターンを使用します。正しい言語を選択すると、認識エンジンにより適切なコンテキストが提供されます。言語が一致しないと、有効な文字が似た文字または記号として解釈される可能性があります。
複数の言語を含む PDF を認識できますか?
はい。言語セレクターを使用すると、複数の言語を選択できます。文書内で意味のある言語をすべて選択しますが、より焦点を絞って選択すると認識時の曖昧さが軽減されるため、無関係な言語を追加することは避けてください。
一部の単語が正しく認識されないのはなぜですか?
ページがぼやけている、傾いている、低解像度、過度に圧縮されている、汚れている、かすれている、または不均一な照明の下で撮影された場合、認識エラーが発生する可能性が高くなります。珍しいフォント、画像上のテキスト、狭い欄、スタンプ、手書きのメモなども文字の識別を困難にする可能性があります。
OCR は手書きのテキストを認識できますか?
OCR は、通常、明確に印刷または入力されたテキストの方が信頼性が高くなります。きれいな手書き文字は部分的に認識される場合がありますが、結果は書き方によって大きく異なる場合があります。手書きの名前、署名、メモ、番号は、正確な転写として扱うのではなく、手動でチェックする必要があります。
分割 PDF
PDF を結合
PDF を整理する
ページの抽出
ページの削除
PDF マルチツール
PDF を圧縮
修復 PDF
OCR PDF
PDF から Word へ
PDF から Excel
PDF から PowerPoint へ
PDF から画像へ
PDF から JPG へ
PDF から PNG へ
PDF から WebP へ
PDF から PDF/A
PDFをラスタライズする
Word から PDF へ
Excel から PDF へ
PowerPoint から PDF へ
画像を PDF に変換
JPG から PDF
PNG から PDF
WebP から PDF へ
PSDからPDFへ
HEIC から PDF
Markdown ~ PDF
EPUB から PDF
MOBIからPDFへ
FB2 から PDF
CBZ から PDF
DJVU から PDF へ
XPS から PDF へ
ODT から PDF へ
RTF から PDF へ
TIFF から PDF
PDF を回転
ページ番号を追加する
透かしを追加
PDF をトリミング
フォーム作成者
PDF を編集
PDF を保護する
PDF のロックを解除する
PDF に署名