OCR(画像から文字認識・日本語対応)

画像やスクリーンショットに写った日本語・英語の文字を、ブラウザ上だけで読み取ってテキストにするOCRツールです。範囲指定、グレースケール・二値化・拡大などの前処理、日本語の不要なスペースの除去に対応し、画像がサーバーへ送信されることはありません。

画像は送信されません。認識モデルのみダウンロードします(初回のみ約8.8MB。2回目以降はブラウザに保存されたデータを使います)。

画像をドラッグ&ドロップ、または Ctrl/⌘+V で貼り付け

PNG / JPEG / WebP / BMP に対応しています

使い方

  1. 画像をドラッグ&ドロップするか、「画像を選択」から読み込みます。スクリーンショットは Ctrl/⌘+V で貼り付けることもできます。
  2. 「認識する言語」を選びます。日本語と英語が混在する場合は「日本語+英語」、縦書きの文章は「日本語(縦書き)」を選びます。
  3. 必要に応じて前処理(グレースケール・コントラスト・二値化・拡大・回転)を調整します。プレビュー上をドラッグすると、その範囲だけを認識できます。
  4. 「文字を認識」を押すと、結果がテキストエリアに表示されます。初回のみ認識モデルのダウンロードが行われます。
  5. 結果は編集でき、「クリップボードへコピー」または「.txtでダウンロード」で保存できます。

このツールについて

OCRツールは、画像に写った文字を読み取ってテキストデータに変換するツールです。紙の資料を撮影した写真やスクリーンショット、PDFを画像にしたものなどから、文字を入力し直さずに取り出したいときに役立ちます。

認識にはオープンソースのOCRエンジンTesseractをWebAssembly化したtesseract.js(Apache-2.0)を使い、Web Worker上で処理するため認識中も画面が固まりません。日本語の認識結果では文字の間に半角スペースが入りやすいため、それを除去する後処理や、段落内の改行を結合する後処理も用意しています。

認識エンジンと言語データはこのサイトから配信され、外部のCDNは使用しません。言語データは初回のみダウンロードしてブラウザに保存するため、2回目以降はすぐに使えます。画像はブラウザの外に出ることはありません。

よくある質問

認識精度を上げるにはどうすればいいですか?

文字が小さい場合は「拡大」を、背景に色や模様がある場合は「二値化」を試してください。傾いている画像は回転で向きを合わせ、認識したい部分だけを範囲指定すると精度が上がることがあります。手書き文字や装飾の多いフォントは苦手です。

どのくらいのデータをダウンロードしますか?

初回のみ、認識エンジン(約3.9MB)と言語データ(日本語・縦書きは約2MB、英語は約2.9MB)をダウンロードします。言語データはブラウザに保存され、2回目以降は再ダウンロードしません。

PDFから文字を読み取れますか?

PDFは直接読み込めません。PDFのページをスクリーンショットするなどして画像にしてから読み込んでください。

画像がサーバーに送信されることはありますか?

ありません。ダウンロードするのは認識モデルだけで、画像の読み込みから文字認識まですべてブラウザ内で処理されます。