PDF の文字認識

スキャンした契約書、撮影したページ、PDF で保存された古いファクス。見た目は文書でも、振る舞いは画像です。検索できず、一行も写せず、読み上げソフトにも読むものがありません。このページは語を認識し、紙の上の同じ位置へ、見えない形で戻します。スキャンの見え方は変わらず、それ以外がすべて動きはじめます。

認識は読み取りではなく推測です。きれいな印刷面はほぼ完璧に出ますが、しわの寄ったレシートの写真はそうなりません。自動の修正はしません。数字をもっともらしく直すのは、二度と気づけない誤りだからです。

スキャンは送信しません。エンジンと言語モデルをブラウザに落とし、そこで処理します。出てくるのはあなたのスキャンに見えない文字層を重ねたもの。見た目は同じで、検索・コピー・読み上げが効くようになります。

近い道具: 画像から文字起こし · PDF をテキストに · PDF を Word に変換 · PDF 圧縮

使い方

  1. スキャンした PDF を選びます。
  2. 文書の言語を選びます。認識の出来は、ほかの何よりここに左右されます。
  3. ボタンを押して待ち、検索できる PDF か、ただの文字を保存します。

知っておくと便利

「検索できる PDF」とは何か

それはあなたのスキャンに二枚目の層を重ねたものです。認識された語が、印刷された語のちょうど上に、見えないインクで置かれています。ページの見た目は同じ——同じ紙、同じ印、同じ余白の書き込み——なのに Ctrl+F で名前が見つかり、一文を写せて、読み上げソフトが読めます。画像を残し、きれいな文字に置き換えないのはそのためです。スキャンはしばしばそれ自体が証拠であり、組み直せば別のものになってしまいます。

認識は読み取りではなく推測です

きれいな印刷面はほぼ完璧に出ます。しわの寄ったレシートの写真はそうなりませんし、どの処理系でも同じです。ですから終了後に平均の確信度を示し、自動の修正はしません。数字をもっともらしく直すのは、誰にも気づけない種類の誤りだからです。頼りにする前に、特に数字を読み直してください。

よくある質問

スキャンはアップロードされますか。

されません。処理系と言語モデルをブラウザに落として、そこで動かします。ファイルは端末に残ります。

どれくらい落としますか。

二〜三メガバイトほどです(処理系と言語モデル一つ)。数字は押す前にページに出ますし、初回のあとは通信なしで動きます。

すでに文字のある PDF もかけるべきですか。

いいえ。気づいた時点でページがそう伝えます。認識は良い文字を推測に置き換えるだけです。「PDF を文字に」をお使いください。

何ページまで扱えますか。

五十ページまでです。それ以上はブラウザで数十分かかります。実際に処理した枚数はページが伝えます。

関連ツール