Toolonit
  1. होम
  2. इमेज
  3. इमेज से टेक्स्ट (सबसे सटीक)

इमेज से टेक्स्ट – सबसे सटीक OCR

सबसे बड़े OCR मॉडल से इमेज का टेक्स्ट निकालें — सबसे सटीक, पर पहली बार का डाउनलोड बड़ा।

टेक्स्ट वाली इमेज यहाँ छोड़ें या चुनने के लिए क्लिक करें

फ़ोटो, स्कैन और स्क्रीनशॉट: JPG, PNG, WebP, GIF, BMP, TIFF या AVIF। अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ, चीनी और जापानी पढ़ता है। यह कोरियाई नहीं पढ़ सकता। फ़ाइलें आपके ब्राउज़र में ही प्रोसेस होती हैं और कभी अपलोड नहीं होतीं। जब तक आप इन्हें हटाते नहीं, ये इसी ब्राउज़र में रहती हैं।

Ctrl+OचुनेंCtrl+Vपेस्ट करें

टेक्स्ट पहचान मॉडल

सबसे सटीक मॉडल · …

अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ (फ़्रेंच, जर्मन, स्पैनिश, पोलिश…), चीनी (सरलीकृत और पारंपरिक) और जापानी पढ़ता है। यह कोरियाई, रूसी या दूसरी सिरिलिक भाषाएँ, अरबी, थाई, हिन्दी या वियतनामी नहीं पढ़ सकता।

 

लाइसेंस: मॉडल (Apache-2.0) · इंजन (MIT)

जब सटीकता सबसे ज़्यादा मायने रखे — छोटे अक्षर, फ़ोटो खींचे गए पेज, रसीदें, कम कंट्रास्ट या भरी-भरी इमेज — तब यह टूल तीन पहचान मॉडल में से सबसे बड़ा इस्तेमाल करता है। 132 MB का मॉडल एक बार डाउनलोड होकर आपके ब्राउज़र में रखा जाता है। ग्राफ़िक्स एक्सेलरेशन (WebGPU, ज़्यादातर मौजूदा डेस्कटॉप ब्राउज़रों में) के साथ घना पेज कुछ सेकंड में पढ़ा जाता है; सिर्फ़ प्रोसेसर पर छोटे पेज में लगभग आधा मिनट लगता है। आपकी इमेज कभी आपके डिवाइस से बाहर नहीं जातीं, और यह मुफ़्त है, साइन-अप की ज़रूरत नहीं।

इमेज से टेक्स्ट के तीनों मॉडल की तुलना

इमेज से टेक्स्ट (सबसे तेज़)इमेज से टेक्स्ट (संतुलित)इमेज से टेक्स्ट (सबसे सटीक)यह पेज
मॉडल का आकार6 MB29.7 MB132.3 MB
पहली बार: इंजन के साथ डाउनलोड, 50 Mbit/s पर19.6 MB · ≈ 3 से॰43.4 MB · ≈ 7 से॰145.9 MB · ≈ 24 से॰
उसके बादब्राउज़र में सेव — दोबारा डाउनलोड नहीं
गतिसबसे तेज़तेज़सबसे धीमा
सटीकतासाफ़ टेक्स्ट के लिए अच्छाफ़ोटो और छोटे अक्षरों पर बेहतरकठिन इमेज पर सबसे अच्छा
पढ़ता हैलैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…) और चीनीलैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…), चीनी, और जापानीलैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…), चीनी, और जापानी

पहचान इंजन (13.7 MB, या WebGPU वाले ब्राउज़र में 27.4 MB) एक ही बार डाउनलोड होता है और तीनों मॉडल इसे साझा करते हैं। जब तक आप टूल से इमेज पढ़ने को नहीं कहते, कुछ भी डाउनलोड नहीं होता।

सबसे सटीक तरीके से टेक्स्ट कैसे निकालें

  1. इमेज पेज पर कहीं भी छोड़ें, Ctrl+V से पेस्ट करें, या क्लिक करके फ़ाइलें चुनें। किसी दूसरे इमेज टूल में पहले से जोड़ी गई इमेज — मान लीजिए तुलना के लिए “संतुलित” पेज पर — पहले से सूची में है।
  2. पहली बार “मॉडल डाउनलोड करें और टेक्स्ट पढ़ें” पर क्लिक करें। डाउनलोड (इंजन के साथ लगभग 146 MB) एक ही बार होता है — प्रोग्रेस पैनल साइज़, प्रतिशत और बचा हुआ समय दिखाता है — और फिर वह आपके ब्राउज़र में सहेज लिया जाता है, इसलिए अगली बार पेज खुलते ही चुनी गई इमेज पढ़ी जाती है, और सूची की बाकी इमेज “पढ़ें” या “सभी पढ़ें” से।
  3. तस्वीर के बगल में टेक्स्ट जाँचें: किसी हिस्से पर क्लिक करके उसकी लाइन ढूँढें, डबल-क्लिक करके वह लाइन एडिट करें। अंडरलाइन वाली लाइनों को एक बार फिर देख लेना अच्छा है। फिर “टेक्स्ट कॉपी करें” (Ctrl+Shift+C) या “.txt डाउनलोड करें”।
  4. तस्वीर को उसके टेक्स्ट के बिना शेयर करने के लिए “इमेज में टेक्स्ट छिपाएँ” में ढकी हुई कॉपी डाउनलोड करें — रंग और ढकने वाले हिस्से चुनें।

सुविधाएँ

  • सबसे बड़ा मॉडल: 132 MB, इंजन के साथ लगभग 146 MB, एक बार डाउनलोड होकर आपके ब्राउज़र में सहेजा जाता है
  • छोटे, धुंधले, घुमे हुए या कम कंट्रास्ट वाले टेक्स्ट को सबसे सटीक पढ़ता है
  • WebGPU के साथ घना पेज कुछ सेकंड में; सिर्फ़ प्रोसेसर पर छोटे पेज के लिए लगभग आधा मिनट
  • अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ, चीनी (सरलीकृत और पारंपरिक) और जापानी पढ़ता है
  • पढ़ने के क्रम में टेक्स्ट, इमेज पर हिस्से घेरकर और क्रमांक देकर
  • टेक्स्ट एडिट करें, कॉपी करें या .txt के रूप में डाउनलोड करें, और टेक्स्ट छिपाई गई इमेज की कॉपी डाउनलोड करें
  • हर डाउनलोड की गई फ़ाइल इस्तेमाल से पहले जाँची जाती है, और डाउनलोड बीच में रुक जाए तो पूरी आ चुकी फ़ाइलें रखी जाती हैं

क्या यह निजी है?

हाँ। मॉडल आपके ब्राउज़र में चलता है; इमेज और पहचाना गया टेक्स्ट कभी अपलोड नहीं होते, और इमेज इस ब्राउज़र में तब तक रहती हैं जब तक आप उन्हें सूची से हटा न दें। इसलिए यह रसीदों, पहचान पत्रों, कॉन्ट्रैक्ट और ऐसे दूसरे दस्तावेज़ों के लिए ठीक है जिन्हें आप किसी ऑनलाइन सेवा को भेजना नहीं चाहेंगे।

अक्सर पूछे जाने वाले सवाल

यह बाकी दो टूल से कैसे अलग है?

यह छोटे, धुंधले, घुमे हुए या कम कंट्रास्ट वाले टेक्स्ट को ज़्यादा सही पढ़ता है, क्योंकि यह सबसे बड़ा पहचान मॉडल इस्तेमाल करता है। बदले में एक बार का डाउनलोड बड़ा है (132 MB का मॉडल, जबकि बाकी दो के 6 MB और 30 MB) और जिस ब्राउज़र में ग्राफ़िक्स एक्सेलरेशन नहीं है, वहाँ पढ़ना धीमा है: छोटे पेज के लिए लगभग आधा मिनट और घने पेज के लिए कई मिनट, फ़ोन पर इससे भी ज़्यादा। साफ़ स्क्रीनशॉट के लिए सबसे तेज़ या संतुलित काफ़ी है।

क्या हर बार डाउनलोड करना पड़ता है?

नहीं। मॉडल और उसका इंजन (14 MB, या WebGPU के साथ 27 MB, बाकी दो टूल के साथ साझा) एक बार डाउनलोड होकर आपके ब्राउज़र में सहेजे जाते हैं, और हर फ़ाइल इस्तेमाल से पहले जाँची जाती है। अगली बार टूल बिना डाउनलोड के शुरू होता है। “डाउनलोड किए गए मॉडल हटाएँ” जब चाहें जगह ख़ाली कर देता है।

यह किन भाषाओं का टेक्स्ट पढ़ता है?

छपी हुई अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ (फ़्रेंच, जर्मन, स्पैनिश, पुर्तगाली, इतालवी, पोलिश, चेक, तुर्की…), अंक और चिह्न, चीनी (सरलीकृत और पारंपरिक) और जापानी (कांजी, हिरागाना और काताकाना)। कोरियाई, रूसी या दूसरी सिरिलिक भाषाएँ, अरबी, थाई, हिन्दी या वियतनामी यह नहीं पढ़ सकता।

क्या यह उल्टा या तिरछे कोण से खींचा गया पेज पढ़ सकता है?

हाँ। उल्टा पेज पहचानकर सही दिशा में पढ़ा जाता है, और हल्की तिरछी फ़ोटो की लाइनें पढ़ने के क्रम में लगाने से पहले सीधी की जाती हैं, ताकि वे आपस में न मिलें। खड़ा (वर्टिकल) चीनी और जापानी टेक्स्ट दाएँ से बाएँ, कॉलम दर कॉलम पढ़ा जाता है।

अगर डाउनलोड बीच में रुक जाए तो?

बस फिर से कोशिश करें: प्रोग्रेस पैनल बताता है कि क्या गड़बड़ हुई और “फिर से कोशिश करें” का विकल्प देता है। जो फ़ाइलें पूरी आ गईं और जाँच में सही निकलीं, वे रखी जाती हैं, इसलिए दोबारा कोशिश करने पर सिर्फ़ बाकी हिस्सा डाउनलोड होता है; आधी डाउनलोड हुई कोई चीज़ कभी इस्तेमाल नहीं होती।

संबंधित टूल