画像の文字起こし(OCR)

写真、スキャン画像、スクリーンショットをドラッグし、言語を確認して「文字を認識」を押すだけで、画像の文字をテキスト化できます。結果はコピーするか .txt で保存できます。認識はすべてブラウザ内で行われ、画像はどこにも送信されません。

ここにファイルをドラッグ&ドロップ または

JPG、PNG、WebP、HEIC、GIF、BMP、TIFF – 画像1枚、最大50 MB

ヒント:画像はCtrl+Vで貼り付けることもできます。

ファイルはブラウザー内だけで処理され、アップロードされません。お使いの端末の外に出ることはありません。

きれいに読み取るコツ:印刷された横書きの文字、正面から撮影、ピントが合っている、明るい背景に濃い文字、300 dpi 程度。手書き文字はほとんど認識できません。

認識したテキスト

画像を選び、言語を確認して「文字を認識」を押してください。

結果

計算方法

OCR(光学文字認識)は、画像のピクセルを文字に戻す技術です。手紙の写真、スキャンした請求書、資料のスクリーンショットなどを、コピー・検索・編集できるテキストに変換します。このツールは、オープンソースの定番OCRエンジンTesseractをWebAssemblyに変換したもので、ブラウザの中で直接動作します。

使い方

  1. 画像をドラッグするか、ファイルを選ぶか、Ctrl + Vで貼り付けます(クリップボードのスクリーンショットなど)。
  2. 画像内の文字の言語を確認します。日本語があらかじめ選ばれています。英語、ドイツ語、フランス語、スペイン語、ポルトガル語、イタリア語、オランダ語、ポーランド語、トルコ語、インドネシア語も選べます。
  3. 「文字を認識」を押します。進行バーで、データの読み込み中か認識中かがわかります。
  4. 必要に応じて枠内のテキストを直し、コピーするか.txt ファイルで保存します。

日本語の文字起こしについて

精度を上げるコツ

苦手なもの

Tesseractは印刷された文字向けに作られています。手書き文字、装飾の多いフォント、斜めから撮った看板、複雑な背景の上の文字はほとんど認識できません。表や段組みはただのテキストとして出力され、列の順番が入れ替わることがあります。表示される信頼度は、Tesseractが各単語に付けた値の平均です。70%を下回るときは、より良い画像を使うと改善します。金額、口座番号、請求書番号などの大事な数字は、必ず目で確認してください。0とO、1とl、5とSの取り違えは、きれいな原稿でも起こります。

初回はデータをダウンロードします

サーバーを使わずに認識するため、最初に「文字を認識」を押したときに、認識エンジン(約3.7 MB、転送時は圧縮されて約1.5 MB)と選んだ言語のデータをダウンロードします。日本語は1.9 MB、英語は2.8 MB、インドネシア語は1.1 MBです。ファイルはすべてこのサイトから配信され、外部のCDNには接続しません。言語データはブラウザ内(IndexedDB)に保存されるため、2回目からはすぐに始まります。1ページの認識にかかる時間は、端末と画像の大きさによって数秒ほどです。

プライバシー

画像が端末の外に出ることはありません。認識はブラウザ内(Web Worker)だけで行われ、認識したテキストもどこにも送信されません。タブを閉じれば何も残りません。ダウンロードした言語データだけは、削除するまでブラウザに保存されます。

よくある質問

画像はどこかにアップロードされますか?

いいえ。文字認識はすべてブラウザ内で行われます。ダウンロードされるのは認識エンジンと言語データだけで、それも第三者ではなくこのサイトから配信されます。画像とテキストは端末から出ません。

画像から文字を抽出する方法は?

画像をこのページにドラッグするかCtrl + Vで貼り付け、言語を選んで「文字を認識」を押します。認識後は「テキストをコピー」でWordやメールに貼り付けられます。

無料で使えますか?

はい、無料で、登録もアプリのインストールも不要です。回数の制限もありません。処理はお使いの端末で行われるため、サーバーの負荷を気にせず何枚でも読み取れます。

iPhoneやスマホでも使えますか?

はい、ブラウザがあれば使えます。スマホで撮った写真やスクリーンショットを選んで「文字を認識」を押してください。初回は言語データのダウンロードがあるため、Wi-Fi環境がおすすめです。

縦書きや手書きの文字も読み取れますか?

対応しているのは主に印刷された横書きの文字です。縦書きの文章は行の順番や文字が崩れることが多く、手書き文字はほとんど認識できません。

スクリーンショットの文字をテキスト化できますか?

はい。スクリーンショットを撮り(Windows:Win + Shift + S、Mac:Cmd + Shift + 4)、ここでCtrl + Vで貼り付けて「文字を認識」を押します。スクリーンショットは鮮明でまっすぐなので、OCRに向いています。

PDFにも使えますか?

直接は読み込めません。このツールが読むのは画像です。スキャンしたPDFは、ページのスクリーンショットを撮るか画像として書き出して貼り付けてください。文字情報を含むPDFなら、PDFビューアで文字を選択してコピーするだけで済みます。

文字起こしの結果に誤りがあるのはなぜですか?

多くの場合、原因は画像にあります。小さい、ぼやけている、傾いている、コントラストが低い、背景が複雑、といった画像は誤認識が増えます。明るい場所で真上から撮り、文字の部分だけを切り抜いて、言語の選択を確認してください。

出典・根拠

更新日:

関連ツール