画像の文字起こし(OCR)
写真、スキャン画像、スクリーンショットをドラッグし、言語を確認して「文字を認識」を押すだけで、画像の文字をテキスト化できます。結果はコピーするか .txt で保存できます。認識はすべてブラウザ内で行われ、画像はどこにも送信されません。
計算方法
OCR(光学文字認識)は、画像のピクセルを文字に戻す技術です。手紙の写真、スキャンした請求書、資料のスクリーンショットなどを、コピー・検索・編集できるテキストに変換します。このツールは、オープンソースの定番OCRエンジンTesseractをWebAssemblyに変換したもので、ブラウザの中で直接動作します。
使い方
- 画像をドラッグするか、ファイルを選ぶか、Ctrl + Vで貼り付けます(クリップボードのスクリーンショットなど)。
- 画像内の文字の言語を確認します。日本語があらかじめ選ばれています。英語、ドイツ語、フランス語、スペイン語、ポルトガル語、イタリア語、オランダ語、ポーランド語、トルコ語、インドネシア語も選べます。
- 「文字を認識」を押します。進行バーで、データの読み込み中か認識中かがわかります。
- 必要に応じて枠内のテキストを直し、コピーするか.txt ファイルで保存します。
日本語の文字起こしについて
- 横書きの日本語に対応しています。縦書きの文章(新聞・小説など)は正しく読み取れないことが多いため、横書きの資料やスクリーンショットでの利用がおすすめです。
- Tesseractは日本語の文字の間に空白を入れて出力することがあります。このツールは漢字・かな同士の間の空白を自動で取り除きます。英単語や数字の前後の空白はそのまま残ります。
- 文中の英数字もある程度読み取れますが、英語だけの文章なら「英語」を選んだほうが正確です。
精度を上げるコツ
- コントラスト:明るい無地の背景に濃い文字が最もよく認識されます。影、グラデーション、模様、透かしがあると精度が下がります。
- 正面から撮影:斜めではなく真上から撮りましょう。大きく傾いた行や、本の綴じ目付近で曲がった行は認識しにくくなります。
- 解像度:スキャンなら300 dpi程度が目安です。写真の場合は、文字が十分な大きさで写っていることが大切です。このツールは小さすぎる画像を自動で拡大し(最大2倍)、大きすぎる画像は長辺5,000ピクセルに縮小します。日本語は画数の多い漢字があるため、英語より大きめに写すと安定します。
- 切り抜き:文字のある部分だけを残し、余白や指、机の端は写さないようにします。スクリーンショットは画面全体ではなくウィンドウ部分だけにしましょう。
- 正しい言語:言語によって使う文字と辞書が変わります。「英語」のまま日本語の画像を読み込むと、ほとんど認識されません。
苦手なもの
Tesseractは印刷された文字向けに作られています。手書き文字、装飾の多いフォント、斜めから撮った看板、複雑な背景の上の文字はほとんど認識できません。表や段組みはただのテキストとして出力され、列の順番が入れ替わることがあります。表示される信頼度は、Tesseractが各単語に付けた値の平均です。70%を下回るときは、より良い画像を使うと改善します。金額、口座番号、請求書番号などの大事な数字は、必ず目で確認してください。0とO、1とl、5とSの取り違えは、きれいな原稿でも起こります。
初回はデータをダウンロードします
サーバーを使わずに認識するため、最初に「文字を認識」を押したときに、認識エンジン(約3.7 MB、転送時は圧縮されて約1.5 MB)と選んだ言語のデータをダウンロードします。日本語は1.9 MB、英語は2.8 MB、インドネシア語は1.1 MBです。ファイルはすべてこのサイトから配信され、外部のCDNには接続しません。言語データはブラウザ内(IndexedDB)に保存されるため、2回目からはすぐに始まります。1ページの認識にかかる時間は、端末と画像の大きさによって数秒ほどです。
プライバシー
画像が端末の外に出ることはありません。認識はブラウザ内(Web Worker)だけで行われ、認識したテキストもどこにも送信されません。タブを閉じれば何も残りません。ダウンロードした言語データだけは、削除するまでブラウザに保存されます。
よくある質問
画像はどこかにアップロードされますか?
いいえ。文字認識はすべてブラウザ内で行われます。ダウンロードされるのは認識エンジンと言語データだけで、それも第三者ではなくこのサイトから配信されます。画像とテキストは端末から出ません。
画像から文字を抽出する方法は?
画像をこのページにドラッグするかCtrl + Vで貼り付け、言語を選んで「文字を認識」を押します。認識後は「テキストをコピー」でWordやメールに貼り付けられます。
無料で使えますか?
はい、無料で、登録もアプリのインストールも不要です。回数の制限もありません。処理はお使いの端末で行われるため、サーバーの負荷を気にせず何枚でも読み取れます。
iPhoneやスマホでも使えますか?
はい、ブラウザがあれば使えます。スマホで撮った写真やスクリーンショットを選んで「文字を認識」を押してください。初回は言語データのダウンロードがあるため、Wi-Fi環境がおすすめです。
縦書きや手書きの文字も読み取れますか?
対応しているのは主に印刷された横書きの文字です。縦書きの文章は行の順番や文字が崩れることが多く、手書き文字はほとんど認識できません。
スクリーンショットの文字をテキスト化できますか?
はい。スクリーンショットを撮り(Windows:Win + Shift + S、Mac:Cmd + Shift + 4)、ここでCtrl + Vで貼り付けて「文字を認識」を押します。スクリーンショットは鮮明でまっすぐなので、OCRに向いています。
PDFにも使えますか?
直接は読み込めません。このツールが読むのは画像です。スキャンしたPDFは、ページのスクリーンショットを撮るか画像として書き出して貼り付けてください。文字情報を含むPDFなら、PDFビューアで文字を選択してコピーするだけで済みます。
文字起こしの結果に誤りがあるのはなぜですか?
多くの場合、原因は画像にあります。小さい、ぼやけている、傾いている、コントラストが低い、背景が複雑、といった画像は誤認識が増えます。明るい場所で真上から撮り、文字の部分だけを切り抜いて、言語の選択を確認してください。
出典・根拠
- Tesseract.js – ブラウザで動くOCRライブラリ(GitHub、Apache-2.0)
- Tesseract OCR ドキュメント – 認識精度を上げる方法(英語)
- ライセンス:Tesseract.js、Tesseractエンジン、言語データ(Apache-2.0)
更新日:
関連ツール
- 改行削除・テキスト整形PDFからコピーした文章の改行を一括削除。余分な空白や空行、見えない文字の削除、重複行の削除、並べ替えもできるテキスト整形ツールです。
- 文字数カウント文字数カウントツールです。空白・改行を含む文字数と含まない文字数、行数、段落数、読むのにかかる時間をリアルタイムで表示。X(旧Twitter)やSMSの上限もわかります。
- 画像圧縮ツール:画像を軽くするJPG・PNG・WebP・HEICの画像を無料で圧縮。アップロード不要でブラウザ内で処理し、最大20枚を一括で軽くできます。KB指定やZIP保存にも対応。
- SNS画像サイズ一覧2026インスタ、Facebook、YouTube、LinkedIn、X、Pinterest、Threadsの画像サイズを公式情報だけで一覧に。出典付きで、サイズのコピーや高さの計算もできます。
- インスタのハッシュタグカウンター・キャプション整形インスタのキャプションのハッシュタグと@メンションを数え、重複を表示。ハッシュタグを末尾にまとめ、改行を保ったまま整形できます。無料・登録不要。
- テキスト読み上げ:文章を音声で読み上げる無料の読み上げツールです。文章を貼り付けて声・速度・高さを選ぶだけで、ブラウザーが音声で読み上げます。登録不要、読んでいる単語も表示します。