高速な画像文字抽出(OCR)
最小のOCRモデルで画像内の文字を抽出します。ダウンロードも処理も最も速いモデルです。
文字の入った画像をドロップするか、クリックして選択
写真・スキャン・スクリーンショット:JPG・PNG・WebP・GIF・BMP・TIFF・AVIF。 英語などのラテン文字の言語と中国語を読み取ります。韓国語と日本語のかなは読み取れません。 ファイルはブラウザ内で処理され、アップロードされません。 削除するまで、このブラウザに保存されます。
Ctrl+O選択Ctrl+V貼り付け
文字認識モデル
最速モデル · …
英語などのラテン文字の言語(フランス語、ドイツ語、スペイン語、ポーランド語など)と中国語を読み取ります。韓国語、日本語のかな、ロシア語などのキリル文字、アラビア語、タイ語、ヒンディー語、ベトナム語は読み取れません。
ライセンス: モデル(Apache-2.0) · エンジン(MIT)
スクリーンショットや写真、スキャンしたページを、コピーや編集ができるテキストにすばやく変換します。3つの「画像から文字抽出」ツールの中で最も軽く、認識モデルはわずか6MBなので、スマホでも初回の起動が速く、その後はスクリーンショットを1〜2秒で読み取ります。すべてブラウザ内で動作するため画像が端末の外に出ることはなく、無料で登録も不要です。
画像から文字を読み取る 3 つのモデルの比較
| 画像から文字抽出(最速)このページ | 画像から文字抽出(バランス) | 画像から文字抽出(高精度) | |
|---|---|---|---|
| モデルのサイズ | 6 MB | 29.7 MB | 132.3 MB |
| 初回:エンジンと合わせたダウンロード時間(50 Mbit/s) | 19.6 MB · ≈ 3 秒 | 43.4 MB · ≈ 7 秒 | 145.9 MB · ≈ 24 秒 |
| 2 回目以降 | ブラウザーに保存 — 再ダウンロードなし | ||
| 速度 | 最速 | 速い | 最も遅い |
| 精度 | くっきりした文字向き | 写真や小さな文字でより正確 | 難しい画像で最も正確 |
| 読める文字 | ラテン文字(英語、フランス語、ドイツ語など)、中国語 | ラテン文字(英語、フランス語、ドイツ語など)、中国語、日本語 | ラテン文字(英語、フランス語、ドイツ語など)、中国語、日本語 |
認識エンジン(13.7 MB、WebGPU 対応ブラウザーでは 27.4 MB)は一度だけダウンロードし、3 つのモデルで共有します。ツールで読み取りを始めるまで何もダウンロードしません。
画像の文字をすばやくテキストにする方法
- ページのどこかに画像を1枚または複数ドロップするか、Ctrl+Vでスクリーンショットを貼り付けるか、クリックしてファイルを選びます。ほかの画像ツールで追加した画像は最初からリストにあり、サンプルのレシートで動作を確認することもできます。
- 初回は「モデルをダウンロードして読み取る」をクリックします。モデルとそれを動かすエンジン、合わせて約20MBを一度だけダウンロードしてブラウザに保存します。次からは、追加した画像はすぐに、選択中の画像はページを開くとすぐに読み取り、リストにあるほかの画像は「読み取る」か「すべて読み取る」をクリックしたときに読み取ります。
- 画像の横に表示されたテキストを確認します。画像内の領域をクリックするとその行がわかり、モデルが自信を持てなかった行には下線が付きます。入力して修正し、「テキストをコピー」(Ctrl+Shift+C)か「.txtをダウンロード」をクリックします。
- 必要なら「画像内の文字を隠す」で色を選び、文字を四角で覆った画像のコピーをダウンロードします。
主な機能
- 最小のモデル:6MB、エンジン込みで約20MB。一度ダウンロードすればブラウザに保存
- モデルの保存後は、スクリーンショットを1〜2秒で読み取り
- 英語などのラテン文字の言語、数字、中国語を読み取り
- 読む順番どおりのテキストと、画像上に枠と番号で示した領域
- テキストを編集・コピー、または.txtでダウンロード。モデルが自信を持てなかった行には下線
- 画像内の文字を隠して、マスクしたコピーをダウンロード
- 複数の画像をまとめて処理
プライバシーは守られますか?
はい。文字認識はすべてブラウザ内で行われ、画像もテキストも端末の外に出ることはありません。画像はリストから削除するまでこのブラウザに残ります。ダウンロードするのは、初めて使うときのモデルとエンジンだけで、このサイトから取得します。
よくある質問
初回の読み取りが遅いのはなぜですか?
初回は、ブラウザが認識モデル(6MB)とそれを動かすエンジン(14MB、WebGPUでグラフィックカードを使うブラウザでは27MB)をダウンロードし、準備するためです。どちらもブラウザに保存されるので、次の画像や次回の訪問ではダウンロードなしで始まります。エンジンは「バランス」「高精度」のツールと共通なので、あとでそちらを試すときはモデルだけがダウンロードされます。
どの言語を読み取れますか?
印刷された英語などのラテン文字の言語(フランス語、ドイツ語、スペイン語、ポルトガル語、イタリア語、ポーランド語、チェコ語、トルコ語など)、数字と記号、そして中国語です。韓国語、日本語のかな、ロシア語などのキリル文字、アラビア語、タイ語、ヒンディー語、ベトナム語は読み取れません。日本語には「バランス」か「高精度」のツールを使ってください。
最速モデルの精度はどのくらいですか?
スクリーンショットや書類、看板など、はっきり印刷された文字ならとても良好です。小さな文字やぼやけた写真は「バランス」や「高精度」のほうが正確に読み取れます。モデルが自信を持てなかった行には下線が付くので、確認に役立ちます。
最速・バランス・高精度のどれを使えばいいですか?
文字がはっきりしていて、ダウンロードを最小限にしたいなら「最速」です(初回は約20MB)。「バランス」(約43MB)は写真や小さな文字をより正確に読み取り、日本語にも対応します。「高精度」(約146MB)は難しい画像を最もよく読み取りますが、グラフィックアクセラレーション(WebGPU)がないと時間がかかります。
モデルが使っている容量を空けるには?
「文字認識モデル」の下にある「ダウンロードしたモデルを削除」をクリックすると、保存されたモデルがすべてこのブラウザから削除されます。次に文字を読み取るときに、もう一度ダウンロードされます。