·12 分

画像の文字起こしを無料でする方法|OCRツール徹底解説

スキャンPDFや写真に含まれる文字をテキスト化する無料OCRの使い方を解説。オンラインツールの比較とプライバシーリスクへの対処法もまとめた。

画像の文字起こしとは何か、なぜ必要か

名刺をスマートフォンで撮影してテキストデータにしたい、スキャンした契約書からコピペできる文字列を取り出したい、スクリーンショットに写り込んだエラーメッセージを検索したい——こうした場面で必要になるのが OCR(Optical Character Recognition) による画像からのテキスト抽出だ。

OCRはもともと専用スキャナーと組み合わせる業務向けソフトウェアとして普及したが、現在はブラウザだけで完結するオンラインツールが多数存在し、インストール不要で利用できる。日本語・英語・中国語など多言語への対応状況はツールによって差があるため、用途に合ったものを選ぶことが重要になる。


無料OCRツールを使う際のプライバシーリスク

利便性の高いオンラインOCRには、見落とされがちな問題がある。ファイルをサーバーにアップロードする仕組みのツールでは、文書の内容が外部に送信される。

契約書、請求書、個人情報が含まれる名刺、社内マニュアルのスクリーンショットなどをアップロードした場合、そのデータがサービス提供者のサーバーに保存・分析される可能性は排除できない。無料ツールのプライバシーポリシーは読まれないまま「同意」されることが多く、実際に何が行われるかはユーザーには見えにくい。

代表的なオンラインOCRサービスとして Smallpdf や Adobe Acrobat オンラインツールがある。いずれも機能は充実しているが、ファイルはクラウドサーバーに送信される仕組みになっている。業務で扱う機密ファイルに使うには、社内のセキュリティポリシーと照らし合わせる必要がある。


一般的なOCRの使い方(手順)

オンラインOCRを使う場合の基本的な流れは以下のとおりだ。

  1. 画像を用意する — JPG・PNG・PDF・TIFFなど、ツールが対応している形式に変換しておく。解像度が低い(150dpi未満)と認識精度が下がるため、300dpi以上が望ましい。
  2. ツールにファイルを読み込む — ドラッグ&ドロップまたはファイル選択ダイアログで読み込む。
  3. 言語を設定する — 日本語テキストを含む場合は必ず日本語を選択する。多言語混在の場合は対応言語の組み合わせを確認する。
  4. テキストを抽出・コピーする — 変換後に表示されるテキストをそのままコピーするか、txtファイルとしてダウンロードする。
  5. 精度を確認する — 手書き文字、特殊フォント、背景がうるさい画像は認識ミスが多い。出力後に目視で確認する。

認識精度を上げるためのコツとして、画像の傾きを補正する(多くのOCRツールは自動補正機能を持つ)、コントラストを上げる(白背景に黒文字が理想)の2点は特に効果的だ。


ブラウザ内処理のOCRツールという選択肢

サーバー送信のリスクを避けたい場合、ファイルをサーバーに送らずブラウザ内だけで処理するツールが有効な選択肢になる。

画像→テキスト(OCR)ツール はその一つで、Tesseract.js(公式ドキュメント)をベースにブラウザ内で直接OCR処理を行う。アップロードという概念自体が存在しないため、機密文書を扱う場合のリスクを構造的に排除できる。ブラウザの開発者ツール(DevToolsのNetworkタブ)を開いた状態でファイルを読み込むと、画像データに関するサーバーへの通信が発生しないことを自分で確認できる。

主な対応言語は英語・日本語・中国語(簡体字)・韓国語など多数。JPG・PNG・WebP・PDFなどの形式に対応しており、出力結果はそのままコピーまたはテキストファイルとしてダウンロード可能だ。

主要OCRツールの比較

ツール送信先サーバー日本語対応料金ファイル上限
Smallpdf OCRあり(クラウド)◯無料プランあり(制限付き)5MB(無料)
Adobe Acrobat オンラインあり(Adobe クラウド)◯無料プランあり(制限付き)—
Google ドキュメント OCRあり(Google)◯無料(Googleアカウント必要)2MB
zerosend 画像→テキストなし(ブラウザ内)◯完全無料ブラウザメモリ依存

サーバーに送信しないという点は機能差ではなくアーキテクチャの違いであり、用途によってどちらを優先するかが変わる。


よくある質問(FAQ)

Q. 手書き文字の認識はできるか? A. OCRの認識精度は印刷文字を前提に設計されているものが多く、手書きは正答率が大幅に下がる。手書き専用のHWR(Handwriting Recognition)機能を持つツールが別途存在する。Google Keepの手書き→テキスト変換はその例だ。

Q. スマートフォンの写真をそのまま使えるか? A. 使える。ただし傾き・影・ピンボケがあると精度が落ちる。撮影時に真上から均一な照明で撮ることが精度向上に直結する。

Q. PDFがパスワード保護されている場合は? A. ロックされたPDFはそのままではOCRにかけられない。まず所有者権限でパスワードを解除し、その後 zerosend のPDF→画像変換でページを画像化してから OCR にかければ、ブラウザ内で処理を完結できる。

Q. 抽出したテキストの著作権はどうなるか? A. OCRによるテキスト抽出は複製行為にあたる可能性がある。著作権のある文書は権利者の許諾の範囲内で使用すること。文化庁の著作権情報で基本的な考え方を確認できる。


まとめ

画像の文字起こしには複数のアプローチがある。利便性を重視するなら Smallpdf や Google ドキュメントのクラウドOCRは実用的な選択肢だ。一方、機密文書や社外秘情報を扱う場合は、ファイルがサーバーに送信されるかどうかをツール選定の判断軸に加えるべきだ。

ブラウザ内処理のOCRはまだメジャーな選択肢とは言えないが、Tesseract.jsの精度向上により日常的な用途では十分に実用的なレベルに達している。画像→テキスト(OCR)ツールのようなサーバー送信なしのツールは、インストール不要・登録不要のまま使えるため、まず試してみる価格的ハードルがゼロという点も実際の普及を後押しする要因になっている。

ZE

著者

Zerosend Editorial

Zerosend の制作チームによる記事です。ファイルがデバイスの外に出ないことを設計の中心に置き、WASM・Web Worker をベースとするブラウザ完結ツールを開発しています。

Zerosend Editorial について →

© Zerosend Editorial ← Blog Index

関連記事