Toolonit
  1. होम
  2. इमेज
  3. इमेज से टेक्स्ट (संतुलित)

इमेज से टेक्स्ट (OCR)

मध्यम आकार के OCR मॉडल से इमेज का टेक्स्ट निकालें — रफ़्तार और सटीकता का संतुलन।

टेक्स्ट वाली इमेज यहाँ छोड़ें या चुनने के लिए क्लिक करें

फ़ोटो, स्कैन और स्क्रीनशॉट: JPG, PNG, WebP, GIF, BMP, TIFF या AVIF। अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ, चीनी और जापानी पढ़ता है। यह कोरियाई नहीं पढ़ सकता। फ़ाइलें आपके ब्राउज़र में ही प्रोसेस होती हैं और कभी अपलोड नहीं होतीं। जब तक आप इन्हें हटाते नहीं, ये इसी ब्राउज़र में रहती हैं।

Ctrl+OचुनेंCtrl+Vपेस्ट करें

टेक्स्ट पहचान मॉडल

संतुलित मॉडल · …

अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ (फ़्रेंच, जर्मन, स्पैनिश, पोलिश…), चीनी (सरलीकृत और पारंपरिक) और जापानी पढ़ता है। यह कोरियाई, रूसी या दूसरी सिरिलिक भाषाएँ, अरबी, थाई, हिन्दी या वियतनामी नहीं पढ़ सकता।

 

लाइसेंस: मॉडल (Apache-2.0) · इंजन (MIT)

दस्तावेज़ की फ़ोटो, स्कैन किए पेज या स्क्रीनशॉट से टेक्स्ट कॉपी करें, फिर उसे एडिट करके सहेजें। इमेज से टेक्स्ट वाले तीन टूल में रोज़मर्रा के काम के लिए यही सही विकल्प है: इसका 30 MB का पहचान मॉडल छोटे अक्षर, तिरछे कोण से ली गई फ़ोटो और भरे-भरे बैकग्राउंड सबसे तेज़ वाले से साफ़ तौर पर बेहतर पढ़ता है, और फिर भी स्क्रीनशॉट सेकंडों में पढ़ लेता है। सब कुछ आपके ब्राउज़र में चलता है: आपकी इमेज कभी आपके डिवाइस से बाहर नहीं जातीं, और यह मुफ़्त है, साइन-अप की ज़रूरत नहीं।

इमेज से टेक्स्ट के तीनों मॉडल की तुलना

इमेज से टेक्स्ट (सबसे तेज़)इमेज से टेक्स्ट (संतुलित)यह पेजइमेज से टेक्स्ट (सबसे सटीक)
मॉडल का आकार6 MB29.7 MB132.3 MB
पहली बार: इंजन के साथ डाउनलोड, 50 Mbit/s पर19.6 MB · ≈ 3 से॰43.4 MB · ≈ 7 से॰145.9 MB · ≈ 24 से॰
उसके बादब्राउज़र में सेव — दोबारा डाउनलोड नहीं
गतिसबसे तेज़तेज़सबसे धीमा
सटीकतासाफ़ टेक्स्ट के लिए अच्छाफ़ोटो और छोटे अक्षरों पर बेहतरकठिन इमेज पर सबसे अच्छा
पढ़ता हैलैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…) और चीनीलैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…), चीनी, और जापानीलैटिन लिपि (अंग्रेज़ी, फ़्रेंच, जर्मन…), चीनी, और जापानी

पहचान इंजन (13.7 MB, या WebGPU वाले ब्राउज़र में 27.4 MB) एक ही बार डाउनलोड होता है और तीनों मॉडल इसे साझा करते हैं। जब तक आप टूल से इमेज पढ़ने को नहीं कहते, कुछ भी डाउनलोड नहीं होता।

इमेज से टेक्स्ट कैसे निकालें

  1. इमेज पेज पर कहीं भी छोड़ें, Ctrl+V से पेस्ट करें, या क्लिक करके फ़ाइलें चुनें — कई एक साथ भी चलेंगी। किसी भी इमेज टूल में पहले से जोड़ी गई इमेज, “सबसे तेज़” और “सबसे सटीक” पेज समेत, सूची में इंतज़ार कर रही हैं।
  2. पहली बार “मॉडल डाउनलोड करें और टेक्स्ट पढ़ें” पर क्लिक करें। मॉडल (30 MB) और उसे चलाने वाला इंजन — कुल लगभग 43 MB — एक बार डाउनलोड होकर आपके ब्राउज़र में रखे जाते हैं, इसलिए बाद में आपकी जोड़ी गई इमेज तुरंत पढ़ी जाती है, चुनी गई इमेज पेज खोलते ही, और सूची में पहले से मौजूद बाकी इमेज “पढ़ें” या “सभी पढ़ें” से।
  3. टेक्स्ट को तस्वीर से मिलाएँ: किसी हिस्से पर क्लिक करके उसकी लाइन, या किसी लाइन पर क्लिक करके उसका हिस्सा ढूँढें। अंडरलाइन वाली लाइनें वे हैं जिन पर मॉडल को पक्का भरोसा नहीं। एडिट करें, फिर “टेक्स्ट कॉपी करें” (Ctrl+Shift+C) या “.txt डाउनलोड करें”।
  4. इमेज को उसके टेक्स्ट के बिना शेयर करने के लिए “इमेज में टेक्स्ट छिपाएँ” खोलें, कोई रंग चुनें, जो हिस्सा दिखाना है उसे खुला छोड़ें, और ढकी हुई कॉपी डाउनलोड करें।

सुविधाएँ

  • छपी हुई अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ, चीनी (सरलीकृत और पारंपरिक) और जापानी पढ़ता है
  • पढ़ने के क्रम में टेक्स्ट: कॉलम एक के बाद एक, रसीद की चीज़ें अपनी क़ीमतों के साथ
  • इमेज पर टेक्स्ट वाले हिस्से घेरकर और क्रमांक देकर; किसी हिस्से पर क्लिक करके उसकी लाइन ढूँढें
  • टेक्स्ट एडिट करें, फिर कॉपी करें या .txt के रूप में डाउनलोड करें; जिन लाइनों पर मॉडल को भरोसा कम है, वे अंडरलाइन होती हैं
  • टेक्स्ट छिपाएँ: इमेज की ऐसी कॉपी डाउनलोड करें जिसमें टेक्स्ट बॉक्स से ढका हो
  • कई इमेज एक साथ; उल्टे पेज पहचानकर सही दिशा में पढ़े जाते हैं
  • लगभग 43 MB का एक बार का डाउनलोड (30 MB का मॉडल और उसका इंजन), फिर आपके ब्राउज़र में सहेजा हुआ

क्या यह निजी है?

हाँ। इमेज को आपके ब्राउज़र में चल रहा मॉडल पढ़ता है; न तस्वीर और न टेक्स्ट कहीं भेजा जाता है, और आपकी इमेज इस ब्राउज़र में तब तक रहती हैं जब तक आप उन्हें सूची से हटा न दें। सिर्फ़ मॉडल और उसका इंजन एक बार इसी साइट से डाउनलोड होते हैं, और आपके ब्राउज़र में सहेजे रहते हैं।

अक्सर पूछे जाने वाले सवाल

यह कौन-सी भाषाएँ पढ़ता है?

छपी हुई अंग्रेज़ी और लैटिन वर्णमाला वाली दूसरी भाषाएँ (फ़्रेंच, जर्मन, स्पैनिश, पुर्तगाली, इतालवी, पोलिश, चेक, तुर्की…), अंक और चिह्न, चीनी (सरलीकृत और पारंपरिक) और जापानी (कांजी, हिरागाना और काताकाना)। यह कोरियाई, रूसी या दूसरी सिरिलिक भाषाएँ, अरबी, थाई, हिन्दी या वियतनामी नहीं पढ़ सकता।

पहली बार चलने में ज़्यादा समय क्यों लगता है?

क्योंकि सिर्फ़ पहली बार ब्राउज़र मॉडल और उसे चलाने वाला इंजन (14 MB, या WebGPU के ज़रिए ग्राफ़िक्स कार्ड इस्तेमाल करने वाले ब्राउज़रों में 27 MB) डाउनलोड करके तैयार करता है। उसके बाद वे सहेज लिए जाते हैं, इसलिए पढ़ना बिना डाउनलोड के शुरू होता है, और पहले से खुला पेज बिना कनेक्शन के भी काम करता रहता है। अगर आपने इमेज से टेक्स्ट वाला कोई दूसरा टूल पहले इस्तेमाल किया है, तो इंजन पहले से मौजूद है और सिर्फ़ मॉडल डाउनलोड होता है।

सबसे तेज़, संतुलित या सबसे सटीक — किसे चुनें?

ज़्यादातर इमेज के लिए संतुलित ठीक है। सबसे तेज़ (6 MB का मॉडल, पहली बार लगभग 20 MB डाउनलोड) अंग्रेज़ी या चीनी के साफ़ स्क्रीनशॉट और दस्तावेज़ों के लिए काफ़ी है। संतुलित (30 MB, लगभग 43 MB) फ़ोटो और छोटे टेक्स्ट पर ज़्यादा सटीक है और जापानी भी पढ़ता है। सबसे सटीक (132 MB, लगभग 146 MB) सबसे कठिन इमेज सबसे अच्छी तरह पढ़ता है, पर ग्राफ़िक्स एक्सेलरेशन (WebGPU) के बिना छोटे पेज के लिए भी लगभग आधा मिनट लेता है। हर एक एक बार डाउनलोड होकर आपके ब्राउज़र में सहेजा जाता है।

क्या यह पेज का लेआउट बनाए रखता है?

यह पढ़ने का क्रम रखता है, सटीक लेआउट नहीं: एक ही पंक्ति के टेक्स्ट के टुकड़े जोड़ दिए जाते हैं, हर पंक्ति एक लाइन होती है, और ख़ाली लाइन पैराग्राफ़ अलग करती है। अगल-बगल के कॉलम एक के बाद एक पढ़े जाते हैं, और टेबल स्प्रेडशीट के रूप में नहीं, बल्कि पढ़ने के क्रम में टेक्स्ट के रूप में आती हैं।

क्या कई इमेज एक साथ पढ़ सकते हैं?

हाँ। जितनी चाहें जोड़ें; हर एक बारी-बारी से पढ़ी जाती है। “सभी इमेज कॉपी करें” हर टेक्स्ट को उसकी फ़ाइल के नाम के नीचे कॉपी करता है, और “सभी डाउनलोड करें (ZIP)” ढकी हुई कॉपियाँ सहेजता है।

संबंधित टूल