高精度な画像文字抽出(OCR)
最大のOCRモデルで画像内の文字を抽出します。最も高精度ですが、初回のダウンロード容量は大きめです。
文字の入った画像をドロップするか、クリックして選択
写真・スキャン・スクリーンショット:JPG・PNG・WebP・GIF・BMP・TIFF・AVIF。 英語などのラテン文字の言語、中国語、日本語を読み取ります。韓国語は読み取れません。 ファイルはブラウザ内で処理され、アップロードされません。 削除するまで、このブラウザに保存されます。
Ctrl+O選択Ctrl+V貼り付け
文字認識モデル
高精度モデル · …
英語などのラテン文字の言語(フランス語、ドイツ語、スペイン語、ポーランド語など)、中国語(簡体字・繁体字)、日本語を読み取ります。韓国語、ロシア語などのキリル文字、アラビア語、タイ語、ヒンディー語、ベトナム語は読み取れません。
ライセンス: モデル(Apache-2.0) · エンジン(MIT)
小さな文字、撮影したページ、レシート、コントラストの低い画像やごちゃごちゃした画像など、精度が何より大切なときのために、このツールは3つの認識モデルのうち最も大きなモデルを使います。132MBのモデルは一度ダウンロードすればブラウザに保存されます。グラフィックアクセラレーション(WebGPU、現在のほとんどのデスクトップブラウザで利用可能)があれば文字の詰まったページも数秒で読み取り、プロセッサーだけの場合は短いページで約30秒かかります。画像が端末の外に出ることはなく、無料で登録も不要です。
画像から文字を読み取る 3 つのモデルの比較
| 画像から文字抽出(最速) | 画像から文字抽出(バランス) | 画像から文字抽出(高精度)このページ | |
|---|---|---|---|
| モデルのサイズ | 6 MB | 29.7 MB | 132.3 MB |
| 初回:エンジンと合わせたダウンロード時間(50 Mbit/s) | 19.6 MB · ≈ 3 秒 | 43.4 MB · ≈ 7 秒 | 145.9 MB · ≈ 24 秒 |
| 2 回目以降 | ブラウザーに保存 — 再ダウンロードなし | ||
| 速度 | 最速 | 速い | 最も遅い |
| 精度 | くっきりした文字向き | 写真や小さな文字でより正確 | 難しい画像で最も正確 |
| 読める文字 | ラテン文字(英語、フランス語、ドイツ語など)、中国語 | ラテン文字(英語、フランス語、ドイツ語など)、中国語、日本語 | ラテン文字(英語、フランス語、ドイツ語など)、中国語、日本語 |
認識エンジン(13.7 MB、WebGPU 対応ブラウザーでは 27.4 MB)は一度だけダウンロードし、3 つのモデルで共有します。ツールで読み取りを始めるまで何もダウンロードしません。
画像の文字を高精度で抽出する方法
- ページのどこかに画像をドロップするか、Ctrl+Vで貼り付けるか、クリックしてファイルを選びます。ほかの画像ツールで追加した画像(比較のために「バランス」のページで追加した画像など)は、すでにリストにあります。
- 初回は「モデルをダウンロードして読み取る」をクリックします。ダウンロード(エンジン込みで約146MB)は一度だけで、進行状況パネルにサイズ、進み具合(%)、残り時間が表示されます。その後はブラウザに保存されるので、次からはページを開くとすぐに選択中の画像を読み取り、リストのほかの画像は「読み取る」か「すべて読み取る」で読み取ります。
- 画像の横のテキストを確認します。領域をクリックするとその行がわかり、ダブルクリックするとその行を編集できます。下線の付いた行は見直しておくと安心です。確認できたら「テキストをコピー」(Ctrl+Shift+C)か「.txtをダウンロード」をクリックします。
- 文字を隠して画像を共有したいときは、「画像内の文字を隠す」で色と隠す領域を選び、マスクしたコピーをダウンロードします。
主な機能
- 最大のモデル:132MB、エンジン込みで約146MB。一度ダウンロードすればブラウザに保存
- 小さい文字、ぼやけた文字、傾いた文字、コントラストの低い文字を最も正確に読み取り
- WebGPUなら文字の詰まったページも数秒、プロセッサーだけなら短いページで約30秒
- 英語などのラテン文字の言語、中国語(簡体字・繁体字)、日本語を読み取り
- 読む順番どおりのテキストと、画像上に枠と番号で示した領域
- テキストを編集・コピー、または.txtでダウンロードでき、文字を隠した画像のコピーもダウンロード可能
- ダウンロードしたファイルは使う前にすべて検証し、途中で中断しても完全に届いたファイルは保持
プライバシーは守られますか?
はい。モデルはブラウザ内で動作し、画像も認識したテキストもアップロードされず、画像はリストから削除するまでこのブラウザに残ります。そのため、レシートや身分証明書、契約書など、オンラインサービスに送りたくない書類にも向いています。
よくある質問
ほかの2つのツールとの違いは何ですか?
最も大きな認識モデルを使うため、小さい文字、ぼやけた文字、傾いた文字、コントラストの低い文字をより正確に読み取れる点です。その代わり、初回のダウンロードが大きく(モデルは132MB、ほかは6MBと30MB)、ブラウザにグラフィックアクセラレーションがない場合は読み取りが遅くなります。短いページで約30秒、文字の詰まったページでは数分かかり、スマホではさらに時間がかかります。はっきりしたスクリーンショットなら「最速」や「バランス」で十分です。
毎回ダウンロードする必要がありますか?
いいえ。モデルとエンジン(14MB、WebGPUでは27MB。ほかの2つのツールと共通)は一度だけダウンロードしてブラウザに保存し、使う前にすべてのファイルを検証します。次回はダウンロードなしで起動します。「ダウンロードしたモデルを削除」で、いつでも容量を空けられます。
どの言語を読み取れますか?
印刷された英語などのラテン文字の言語(フランス語、ドイツ語、スペイン語、ポルトガル語、イタリア語、ポーランド語、チェコ語、トルコ語など)、数字と記号、中国語(簡体字・繁体字)、日本語(漢字・ひらがな・カタカナ)です。韓国語、ロシア語などのキリル文字、アラビア語、タイ語、ヒンディー語、ベトナム語は読み取れません。
上下逆さまのページや、斜めから撮ったページも読み取れますか?
はい。上下逆さまのページは検出して正しい向きで読み取り、少し傾いた写真の行はまっすぐに補正してから読む順番に並べるので、行が混ざりません。縦書きの中国語や日本語は、右から左へ列ごとに読み取ります。
ダウンロードが途中で止まったらどうなりますか?
もう一度試すだけで大丈夫です。進行状況パネルに原因が表示され、「再試行」ボタンが出ます。完全に届いて検証に通ったファイルは保持されるので、再試行では残りだけをダウンロードします。途中までしか届いていないファイルが使われることはありません。