Toolonit
  1. Startseite
  2. Bild
  3. Bild zu Text (Schnell)

Schnelle Texterkennung: Bild zu Text (OCR)

Text aus einem Bild mit dem kleinsten OCR-Modell auslesen – am schnellsten geladen und ausgeführt.

Bilder mit Text hierher ziehen oder zum Auswählen klicken

Fotos, Scans und Screenshots: JPG, PNG, WebP, GIF, BMP, TIFF oder AVIF. Liest Englisch und andere Sprachen mit lateinischem Alphabet sowie Chinesisch. Koreanisch und japanische Kana kann es nicht lesen. Dateien werden im Browser verarbeitet und nie hochgeladen. Die Bilder bleiben in diesem Browser, bis Sie sie entfernen.

Ctrl+OauswählenCtrl+Veinfügen

Texterkennungsmodell

Modell Schnell · …

Liest Englisch und andere Sprachen mit lateinischem Alphabet (Französisch, Deutsch, Spanisch, Polnisch …) sowie Chinesisch. Koreanisch, japanische Kana, Russisch und andere kyrillische Schriften, Arabisch, Thai, Hindi und Vietnamesisch kann es nicht lesen.

 

Lizenzen: Modelle (Apache-2.0) · Engine (MIT)

Machen Sie aus einem Screenshot, Foto oder gescannten Dokument Text, den Sie kopieren und bearbeiten können – schnell. Dies ist das leichteste der drei Bild-zu-Text-Tools: Sein Erkennungsmodell ist nur 6 MB groß, sodass der erste Start selbst auf dem Handy zügig geht, und danach ist ein Screenshot in ein, zwei Sekunden gelesen. Alles läuft in Ihrem Browser: Das Bild verlässt nie Ihr Gerät, und es ist kostenlos und ohne Anmeldung.

Die drei Modelle für Bild zu Text im Vergleich

Bild zu Text (Schnell)Diese SeiteBild zu Text (Ausgewogen)Bild zu Text (Präzise)
Modell-Download6 MB29,7 MB132,3 MB
Erste Nutzung: Download mit der Engine bei 50 Mbit/s19,6 MB · ≈ 3 Sek.43,4 MB · ≈ 7 Sek.145,9 MB · ≈ 24 Sek.
DanachIm Browser gespeichert – kein zweiter Download
GeschwindigkeitAm schnellstenSchnellAm langsamsten
GenauigkeitGut bei klarem TextBesser bei Fotos und kleiner SchriftAm besten bei schwierigen Bildern
Liestlateinisches Alphabet (Englisch, Deutsch, Französisch …) und Chinesischlateinisches Alphabet (Englisch, Deutsch, Französisch …), Chinesisch und Japanischlateinisches Alphabet (Englisch, Deutsch, Französisch …), Chinesisch und Japanisch

Die Erkennungs-Engine (13,7 MB, in Browsern mit WebGPU 27,4 MB) wird nur einmal heruntergeladen und von allen drei Modellen genutzt. Heruntergeladen wird erst, wenn Sie das Tool ein Bild lesen lassen.

So wandeln Sie ein Bild schnell in Text um

  1. Legen Sie ein oder mehrere Bilder irgendwo auf der Seite ab, fügen Sie einen Screenshot mit Strg+V ein oder klicken Sie, um Dateien auszuwählen. Bilder, die Sie in einem anderen Bild-Tool hinzugefügt haben, sind schon in der Liste, und der Beispiel-Kassenbon zeigt, wie es funktioniert.
  2. Klicken Sie beim ersten Mal auf Modell laden & Text lesen. Etwa 20 MB – das Modell und die Engine, die es ausführt – werden einmal heruntergeladen und in Ihrem Browser gespeichert; danach wird ein Bild, das Sie hinzufügen, sofort gelesen, das ausgewählte, sobald Sie die Seite öffnen, und die übrigen in der Liste, wenn Sie auf Lesen oder Alle lesen klicken.
  3. Prüfen Sie den Text neben dem Bild. Klicken Sie auf einen Bereich im Bild, um seine Zeile zu finden; Zeilen, bei denen sich das Modell unsicher ist, sind unterstrichen. Korrigieren Sie per Tastatur und klicken Sie dann auf Text kopieren (Strg+Umschalt+C) oder .txt herunterladen.
  4. Optional: Wählen Sie unter Text im Bild verdecken eine Farbe und laden Sie eine Kopie des Bildes herunter, in der der Text mit Kästen abgedeckt ist.

Funktionen

  • Das kleinste Modell: 6 MB, mit Engine etwa 20 MB, einmal heruntergeladen und dann in Ihrem Browser gespeichert
  • Ein Screenshot in ein, zwei Sekunden gelesen, sobald das Modell gespeichert ist
  • Liest Englisch und andere Sprachen mit lateinischem Alphabet, Ziffern und Chinesisch
  • Text in Lesereihenfolge, die Bereiche im Bild umrandet und nummeriert
  • Text bearbeiten, kopieren oder als .txt herunterladen; Zeilen, bei denen sich das Modell unsicher ist, sind unterstrichen
  • Text im Bild verdecken und die abgedeckte Kopie herunterladen
  • Mehrere Bilder auf einmal

Ist das privat?

Ja. Die Erkennung läuft vollständig in Ihrem Browser; Bild und Text verlassen nie Ihr Gerät, und die Bilder bleiben in diesem Browser, bis Sie sie aus der Liste entfernen. Heruntergeladen werden nur das Modell und seine Engine, von dieser Website, bei der ersten Nutzung.

Häufige Fragen

Warum dauert der erste Durchlauf länger?

Weil Ihr Browser beim ersten Mal das Erkennungsmodell (6 MB) und die Engine, die es ausführt (14 MB, oder 27 MB in Browsern, die die Grafikkarte über WebGPU nutzen), herunterlädt und dann vorbereitet. Beides wird im Browser gespeichert, sodass die nächsten Bilder und Ihr nächster Besuch ohne Download starten. Die Engine teilen sich alle drei Tools; probieren Sie später Ausgewogen oder Präzise aus, wird nur deren Modell heruntergeladen.

Welche Sprachen kann es lesen?

Gedrucktes Englisch und andere Sprachen mit lateinischem Alphabet (Französisch, Deutsch, Spanisch, Portugiesisch, Italienisch, Polnisch, Tschechisch, Türkisch …), Ziffern und Symbole sowie Chinesisch. Koreanisch, japanische Kana, Russisch und andere kyrillische Schriften, Arabisch, Thai, Hindi und Vietnamesisch kann es nicht lesen; für Japanisch nutzen Sie das Tool Ausgewogen oder Präzise.

Wie genau ist das schnellste Modell?

Sehr genau bei klarem gedrucktem Text wie Screenshots, Dokumenten und Schildern. Bei kleiner Schrift oder unscharfen Fotos lesen die Tools Ausgewogen und Präzise zuverlässiger, und Zeilen, bei denen sich das Modell unsicher ist, sind unterstrichen, damit Sie sie prüfen können.

Schnell, Ausgewogen oder Präzise – welches sollte ich nehmen?

Schnell, wenn der Text klar ist und Sie den kleinsten Download wollen: beim ersten Mal etwa 20 MB. Ausgewogen (etwa 43 MB) liest Fotos und kleine Schrift genauer und liest auch Japanisch; Präzise (etwa 146 MB) liest die schwierigsten Bilder am besten, ist ohne Grafikbeschleunigung (WebGPU) aber langsam.

Wie gebe ich den Speicherplatz des Modells wieder frei?

Klicken Sie unter Texterkennungsmodell auf Heruntergeladene Modelle löschen: Alle gespeicherten Modelle werden aus diesem Browser entfernt. Wenn Sie das nächste Mal Text lesen, wird das Modell erneut heruntergeladen.

Ähnliche Tools