इमेज से टेक्स्ट – सबसे सटीक OCR
सबसे बड़े OCR मॉडल से इमेज का टेक्स्ट निकालें — सबसे सटीक, पर पहली बार का डाउनलोड बड़ा।
टेक्स्ट वाली इमेज यहाँ छोड़ें या चुनने के लिए क्लिक करें
फ़ोटो, स्कैन और स्क्रीनशॉट: JPG, PNG, WebP, GIF, BMP, TIFF या AVIF। अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ, चीनी और जापानी पढ़ता है। यह कोरियाई नहीं पढ़ सकता। फ़ाइलें आपके ब्राउज़र में ही प्रोसेस होती हैं और कभी अपलोड नहीं होतीं। जब तक आप इन्हें हटाते नहीं, ये इसी ब्राउज़र में रहती हैं।
Ctrl+OचुनेंCtrl+Vपेस्ट करें
टेक्स्ट पहचान मॉडल
सबसे सटीक मॉडल · …
अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ (फ़्रेंच, जर्मन, स्पैनिश, पोलिश…), चीनी (सरलीकृत और पारंपरिक) और जापानी पढ़ता है। यह कोरियाई, रूसी या दूसरी सिरिलिक भाषाएँ, अरबी, थाई, हिन्दी या वियतनामी नहीं पढ़ सकता।
लाइसेंस: मॉडल (Apache-2.0) · इंजन (MIT)
जब सटीकता सबसे ज़्यादा मायने रखे — छोटे अक्षर, फ़ोटो खींचे गए पेज, रसीदें, कम कंट्रास्ट या भरी-भरी इमेज — तब यह टूल तीन पहचान मॉडल में से सबसे बड़ा इस्तेमाल करता है। 132 MB का मॉडल एक बार डाउनलोड होकर आपके ब्राउज़र में रखा जाता है। ग्राफ़िक्स एक्सेलरेशन (WebGPU, ज़्यादातर मौजूदा डेस्कटॉप ब्राउज़रों में) के साथ घना पेज कुछ सेकंड में पढ़ा जाता है; सिर्फ़ प्रोसेसर पर छोटे पेज में लगभग आधा मिनट लगता है। आपकी इमेज कभी आपके डिवाइस से बाहर नहीं जातीं, और यह मुफ़्त है, साइन-अप की ज़रूरत नहीं।
इमेज से टेक्स्ट के तीनों मॉडल की तुलना
| इमेज से टेक्स्ट (सबसे तेज़) | इमेज से टेक्स्ट (संतुलित) | इमेज से टेक्स्ट (सबसे सटीक)यह पेज | |
|---|---|---|---|
| मॉडल का आकार | 6 MB | 29.7 MB | 132.3 MB |
| पहली बार: इंजन के साथ डाउनलोड, 50 Mbit/s पर | 19.6 MB · ≈ 3 से॰ | 43.4 MB · ≈ 7 से॰ | 145.9 MB · ≈ 24 से॰ |
| उसके बाद | ब्राउज़र में सेव — दोबारा डाउनलोड नहीं | ||
| गति | सबसे तेज़ | तेज़ | सबसे धीमा |
| सटीकता | साफ़ टेक्स्ट के लिए अच्छा | फ़ोटो और छोटे अक्षरों पर बेहतर | कठिन इमेज पर सबसे अच्छा |
| पढ़ता है | लैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…) और चीनी | लैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…), चीनी, और जापानी | लैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…), चीनी, और जापानी |
पहचान इंजन (13.7 MB, या WebGPU वाले ब्राउज़र में 27.4 MB) एक ही बार डाउनलोड होता है और तीनों मॉडल इसे साझा करते हैं। जब तक आप टूल से इमेज पढ़ने को नहीं कहते, कुछ भी डाउनलोड नहीं होता।
सबसे सटीक तरीके से टेक्स्ट कैसे निकालें
- इमेज पेज पर कहीं भी छोड़ें, Ctrl+V से पेस्ट करें, या क्लिक करके फ़ाइलें चुनें। किसी दूसरे इमेज टूल में पहले से जोड़ी गई इमेज — मान लीजिए तुलना के लिए “संतुलित” पेज पर — पहले से सूची में है।
- पहली बार “मॉडल डाउनलोड करें और टेक्स्ट पढ़ें” पर क्लिक करें। डाउनलोड (इंजन के साथ लगभग 146 MB) एक ही बार होता है — प्रोग्रेस पैनल साइज़, प्रतिशत और बचा हुआ समय दिखाता है — और फिर वह आपके ब्राउज़र में सहेज लिया जाता है, इसलिए अगली बार पेज खुलते ही चुनी गई इमेज पढ़ी जाती है, और सूची की बाकी इमेज “पढ़ें” या “सभी पढ़ें” से।
- तस्वीर के बगल में टेक्स्ट जाँचें: किसी हिस्से पर क्लिक करके उसकी लाइन ढूँढें, डबल-क्लिक करके वह लाइन एडिट करें। अंडरलाइन वाली लाइनों को एक बार फिर देख लेना अच्छा है। फिर “टेक्स्ट कॉपी करें” (Ctrl+Shift+C) या “.txt डाउनलोड करें”।
- तस्वीर को उसके टेक्स्ट के बिना शेयर करने के लिए “इमेज में टेक्स्ट छिपाएँ” में ढकी हुई कॉपी डाउनलोड करें — रंग और ढकने वाले हिस्से चुनें।
सुविधाएँ
- सबसे बड़ा मॉडल: 132 MB, इंजन के साथ लगभग 146 MB, एक बार डाउनलोड होकर आपके ब्राउज़र में सहेजा जाता है
- छोटे, धुंधले, घुमे हुए या कम कंट्रास्ट वाले टेक्स्ट को सबसे सटीक पढ़ता है
- WebGPU के साथ घना पेज कुछ सेकंड में; सिर्फ़ प्रोसेसर पर छोटे पेज के लिए लगभग आधा मिनट
- अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ, चीनी (सरलीकृत और पारंपरिक) और जापानी पढ़ता है
- पढ़ने के क्रम में टेक्स्ट, इमेज पर हिस्से घेरकर और क्रमांक देकर
- टेक्स्ट एडिट करें, कॉपी करें या .txt के रूप में डाउनलोड करें, और टेक्स्ट छिपाई गई इमेज की कॉपी डाउनलोड करें
- हर डाउनलोड की गई फ़ाइल इस्तेमाल से पहले जाँची जाती है, और डाउनलोड बीच में रुक जाए तो पूरी आ चुकी फ़ाइलें रखी जाती हैं
क्या यह निजी है?
हाँ। मॉडल आपके ब्राउज़र में चलता है; इमेज और पहचाना गया टेक्स्ट कभी अपलोड नहीं होते, और इमेज इस ब्राउज़र में तब तक रहती हैं जब तक आप उन्हें सूची से हटा न दें। इसलिए यह रसीदों, पहचान पत्रों, कॉन्ट्रैक्ट और ऐसे दूसरे दस्तावेज़ों के लिए ठीक है जिन्हें आप किसी ऑनलाइन सेवा को भेजना नहीं चाहेंगे।
अक्सर पूछे जाने वाले सवाल
यह बाकी दो टूल से कैसे अलग है?
यह छोटे, धुंधले, घुमे हुए या कम कंट्रास्ट वाले टेक्स्ट को ज़्यादा सही पढ़ता है, क्योंकि यह सबसे बड़ा पहचान मॉडल इस्तेमाल करता है। बदले में एक बार का डाउनलोड बड़ा है (132 MB का मॉडल, जबकि बाकी दो के 6 MB और 30 MB) और जिस ब्राउज़र में ग्राफ़िक्स एक्सेलरेशन नहीं है, वहाँ पढ़ना धीमा है: छोटे पेज के लिए लगभग आधा मिनट और घने पेज के लिए कई मिनट, फ़ोन पर इससे भी ज़्यादा। साफ़ स्क्रीनशॉट के लिए सबसे तेज़ या संतुलित काफ़ी है।
क्या हर बार डाउनलोड करना पड़ता है?
नहीं। मॉडल और उसका इंजन (14 MB, या WebGPU के साथ 27 MB, बाकी दो टूल के साथ साझा) एक बार डाउनलोड होकर आपके ब्राउज़र में सहेजे जाते हैं, और हर फ़ाइल इस्तेमाल से पहले जाँची जाती है। अगली बार टूल बिना डाउनलोड के शुरू होता है। “डाउनलोड किए गए मॉडल हटाएँ” जब चाहें जगह ख़ाली कर देता है।
यह किन भाषाओं का टेक्स्ट पढ़ता है?
छपी हुई अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ (फ़्रेंच, जर्मन, स्पैनिश, पुर्तगाली, इतालवी, पोलिश, चेक, तुर्की…), अंक और चिह्न, चीनी (सरलीकृत और पारंपरिक) और जापानी (कांजी, हिरागाना और काताकाना)। कोरियाई, रूसी या दूसरी सिरिलिक भाषाएँ, अरबी, थाई, हिन्दी या वियतनामी यह नहीं पढ़ सकता।
क्या यह उल्टा या तिरछे कोण से खींचा गया पेज पढ़ सकता है?
हाँ। उल्टा पेज पहचानकर सही दिशा में पढ़ा जाता है, और हल्की तिरछी फ़ोटो की लाइनें पढ़ने के क्रम में लगाने से पहले सीधी की जाती हैं, ताकि वे आपस में न मिलें। खड़ा (वर्टिकल) चीनी और जापानी टेक्स्ट दाएँ से बाएँ, कॉलम दर कॉलम पढ़ा जाता है।
अगर डाउनलोड बीच में रुक जाए तो?
बस फिर से कोशिश करें: प्रोग्रेस पैनल बताता है कि क्या गड़बड़ हुई और “फिर से कोशिश करें” का विकल्प देता है। जो फ़ाइलें पूरी आ गईं और जाँच में सही निकलीं, वे रखी जाती हैं, इसलिए दोबारा कोशिश करने पर सिर्फ़ बाकी हिस्सा डाउनलोड होता है; आधी डाउनलोड हुई कोई चीज़ कभी इस्तेमाल नहीं होती।