- Startseite
- Bild
- Bild zu Text (Präzise)
Bild zu Text mit hoher Genauigkeit (OCR)
Text aus einem Bild mit dem größten OCR-Modell auslesen – am genauesten, mit größerem einmaligem Download.
Bilder mit Text hierher ziehen oder zum Auswählen klicken
Fotos, Scans und Screenshots: JPG, PNG, WebP, GIF, BMP, TIFF oder AVIF. Liest Englisch und andere Sprachen mit lateinischem Alphabet, Chinesisch und Japanisch. Koreanisch kann es nicht lesen. Dateien werden im Browser verarbeitet und nie hochgeladen. Die Bilder bleiben in diesem Browser, bis Sie sie entfernen.
Ctrl+OauswählenCtrl+Veinfügen
Texterkennungsmodell
Modell Präzise · …
Liest Englisch und andere Sprachen mit lateinischem Alphabet (Französisch, Deutsch, Spanisch, Polnisch …), Chinesisch (vereinfacht und traditionell) und Japanisch. Koreanisch, Russisch und andere kyrillische Schriften, Arabisch, Thai, Hindi und Vietnamesisch kann es nicht lesen.
Lizenzen: Modelle (Apache-2.0) · Engine (MIT)
Wenn es vor allem auf Genauigkeit ankommt – kleine Schrift, abfotografierte Seiten, Kassenbons, kontrastarme oder unruhige Bilder –, nutzt dieses Tool das größte der drei Erkennungsmodelle. Das 132-MB-Modell wird einmal heruntergeladen und in Ihrem Browser behalten. Mit Grafikbeschleunigung (WebGPU, in den meisten aktuellen Desktop-Browsern) ist eine dicht beschriebene Seite in wenigen Sekunden gelesen; nur mit dem Prozessor braucht eine kurze Seite etwa eine halbe Minute. Ihre Bilder verlassen nie Ihr Gerät, und es ist kostenlos und ohne Anmeldung.
Die drei Modelle für Bild zu Text im Vergleich
| Bild zu Text (Schnell) | Bild zu Text (Ausgewogen) | Bild zu Text (Präzise)Diese Seite | |
|---|---|---|---|
| Modell-Download | 6 MB | 29,7 MB | 132,3 MB |
| Erste Nutzung: Download mit der Engine bei 50 Mbit/s | 19,6 MB · ≈ 3 Sek. | 43,4 MB · ≈ 7 Sek. | 145,9 MB · ≈ 24 Sek. |
| Danach | Im Browser gespeichert – kein zweiter Download | ||
| Geschwindigkeit | Am schnellsten | Schnell | Am langsamsten |
| Genauigkeit | Gut bei klarem Text | Besser bei Fotos und kleiner Schrift | Am besten bei schwierigen Bildern |
| Liest | lateinisches Alphabet (Englisch, Deutsch, Französisch …) und Chinesisch | lateinisches Alphabet (Englisch, Deutsch, Französisch …), Chinesisch und Japanisch | lateinisches Alphabet (Englisch, Deutsch, Französisch …), Chinesisch und Japanisch |
Die Erkennungs-Engine (13,7 MB, in Browsern mit WebGPU 27,4 MB) wird nur einmal heruntergeladen und von allen drei Modellen genutzt. Heruntergeladen wird erst, wenn Sie das Tool ein Bild lesen lassen.
So extrahieren Sie Text mit hoher Genauigkeit
- Legen Sie Bilder irgendwo auf der Seite ab, fügen Sie eines mit Strg+V ein oder klicken Sie, um Dateien auszuwählen. Ein Bild, das Sie schon in einem anderen Bild-Tool hinzugefügt haben – etwa auf der Seite Ausgewogen, zum Vergleich –, ist bereits in der Liste.
- Klicken Sie beim ersten Mal auf Modell laden & Text lesen. Der Download (etwa 146 MB mit Engine) erfolgt einmalig – die Fortschrittsanzeige nennt Größe, Prozentsatz und Restzeit –, danach ist alles in Ihrem Browser gespeichert; beim nächsten Mal wird das ausgewählte Bild gelesen, sobald die Seite öffnet, und die übrigen in der Liste mit Lesen oder Alle lesen.
- Prüfen Sie den Text neben dem Bild: Klicken Sie auf einen Bereich, um seine Zeile zu finden, und doppelklicken Sie, um diese Zeile zu bearbeiten. Unterstrichene Zeilen verdienen einen zweiten Blick. Wählen Sie dann Text kopieren (Strg+Umschalt+C) oder .txt herunterladen.
- Um das Bild ohne seinen Text zu teilen, laden Sie unter Text im Bild verdecken die abgedeckte Kopie herunter – wählen Sie dort Farbe und abzudeckende Bereiche.
Funktionen
- Das größte Modell: 132 MB, mit Engine etwa 146 MB, einmal heruntergeladen und dann in Ihrem Browser gespeichert
- Liest kleine, unscharfe, gedrehte oder kontrastarme Schrift am genauesten
- Mit WebGPU eine dicht beschriebene Seite in wenigen Sekunden; nur mit dem Prozessor etwa eine halbe Minute für eine kurze Seite
- Liest Englisch und andere Sprachen mit lateinischem Alphabet, Chinesisch (vereinfacht und traditionell) und Japanisch
- Text in Lesereihenfolge, die erkannten Bereiche im Bild umrandet und nummeriert
- Text bearbeiten, kopieren oder als .txt herunterladen und eine Kopie des Bildes mit verdecktem Text herunterladen
- Jede heruntergeladene Datei wird vor der Nutzung geprüft, und vollständig angekommene Dateien bleiben erhalten, wenn ein Download abbricht
Ist das privat?
Ja. Das Modell läuft in Ihrem Browser; das Bild und der erkannte Text werden nie hochgeladen, und die Bilder bleiben in diesem Browser, bis Sie sie aus der Liste entfernen. Damit eignet es sich für Kassenbons, Ausweise, Verträge und andere Dokumente, die Sie lieber keinem Onlinedienst schicken möchten.
Häufige Fragen
Was unterscheidet dieses Tool von den anderen beiden?
Es liest kleine, unscharfe, gedrehte oder kontrastarme Schrift genauer, weil es das größte Erkennungsmodell nutzt. Der Preis ist ein größerer einmaliger Download (ein 132-MB-Modell gegenüber 6 MB und 30 MB) und langsameres Lesen, wo der Browser keine Grafikbeschleunigung hat: etwa eine halbe Minute für eine kurze Seite und mehrere Minuten für eine dicht beschriebene, auf Handys länger. Für klare Screenshots reicht Schnell oder Ausgewogen.
Muss ich es jedes Mal herunterladen?
Nein. Das Modell und seine Engine (14 MB, oder 27 MB mit WebGPU, geteilt mit den anderen beiden Tools) werden einmal heruntergeladen und in Ihrem Browser gespeichert, und jede Datei wird vor der Nutzung geprüft. Beim nächsten Mal startet das Tool ohne Download. Heruntergeladene Modelle löschen gibt den Speicherplatz jederzeit wieder frei.
Welche Sprachen erkennt es?
Gedrucktes Englisch und andere Sprachen mit lateinischem Alphabet (Französisch, Deutsch, Spanisch, Portugiesisch, Italienisch, Polnisch, Tschechisch, Türkisch …), Ziffern und Symbole, Chinesisch (vereinfacht und traditionell) und Japanisch (Kanji, Hiragana und Katakana). Koreanisch, Russisch und andere kyrillische Schriften, Arabisch, Thai, Hindi und Vietnamesisch erkennt es nicht.
Kann es eine auf dem Kopf stehende oder schräg fotografierte Seite lesen?
Ja. Eine auf dem Kopf stehende Seite wird erkannt und richtig herum gelesen, und die Zeilen eines leicht schiefen Fotos werden begradigt, bevor sie in Lesereihenfolge gebracht werden, damit sie nicht durcheinandergeraten. Senkrechter chinesischer und japanischer Text wird spaltenweise von rechts nach links gelesen.
Was passiert, wenn der Download abbricht?
Versuchen Sie es einfach noch einmal: Die Fortschrittsanzeige sagt, was schiefgelaufen ist, und bietet Erneut versuchen an. Vollständig angekommene Dateien, die ihre Prüfung bestanden haben, bleiben erhalten, sodass beim nächsten Versuch nur der Rest heruntergeladen wird; halb heruntergeladene Dateien werden nie verwendet.