इमेज से टेक्स्ट (OCR)
फ़ोटो, स्कैन किए पेज या स्क्रीनशॉट से शब्द निकालें, कॉपी करने, एडिट करने या सेव करने के लिए तैयार।
हमारे सर्वर पर प्रोसेस होती है, फिर हटा दी जाती है
इमेज यहाँ छोड़ें
JPG, PNG या WebP। या इसे यहाँ खींचकर लाएं, या स्क्रीनशॉट पेस्ट करें (Ctrl+V)।
सिर्फ़ इस एक काम के लिए हमारे सर्वर पर भेजी जाती है, फिर हटा दी जाती है। न कभी सेव की जाती है, न लॉग।
एक बार में एक इमेज: JPG, PNG, WebP और दूसरे फ़ॉर्मैट जो आपका ब्राउज़र खोलता है, शुरुआत में 40 MB तक (यह आपके डिवाइस पर तैयार की जाती है, फिर 10 MB तक की भेजी जाती है)। अंग्रेज़ी टेक्स्ट। हमारे सर्वर पर प्रोसेस होती है, फिर हटा दी जाती है। हर व्यक्ति के लिए रोज़ 10 मुफ़्त सर्वर टास्क, जो सभी सर्वर टूल में साझा हैं। ज़्यादा के लिए: OCR API (हर कॉल के हिसाब से भुगतान)।
इमेज से टेक्स्ट कैसे पाएं
- कोई इमेज चुनें, उसे पेज पर खींचकर लाएं, या Ctrl+V (Mac पर Cmd+V) से स्क्रीनशॉट पेस्ट करें।
- प्रीव्यू देखें: टेक्स्ट सीधा होना चाहिए।
- टेक्स्ट निकालें दबाएं, फिर टेक्स्ट कॉपी करें या उसे .txt फ़ाइल के रूप में सेव करें।
तस्वीर से टेक्स्ट तक
कंप्यूटर के लिए किसी पेज की फ़ोटो बस रंगीन बिंदु होती है। OCR, यानी ऑप्टिकल कैरेक्टर रिकग्निशन, उन बिंदुओं में अक्षरों की आकृतियाँ ढूँढता है और उन्हें वापस ऐसे टेक्स्ट में बदल देता है जिसे आप खोज, एडिट और पेस्ट कर सकते हैं। यह टूल आपकी इमेज की एक तैयार प्रति हमारे सर्वर पर भेजता है, जहाँ Tesseract इंजन उसे पढ़ता है, और शब्द आपको सेकंडों में दिखा देता है।
बेहतर नतीजों के सुझाव
- फ़ोन को पेज के ठीक ऊपर सीधा पकड़ें, अच्छी रोशनी में, और फ़्रेम को टेक्स्ट से भरें।
- जो हिस्सा टेक्स्ट नहीं है उसे इमेज क्रॉप करें से काट दें, और आड़ी फ़ोटो को इमेज घुमाएं से सीधा करें। दोनों आपके ब्राउज़र में चलते हैं।
- पूरा स्कैन किया दस्तावेज़ है? PDF OCR खुद PDF को खोजने लायक बना देता है।
अक्सर पूछे जाने वाले सवाल
क्या मेरी इमेज अपलोड होती है?
हाँ। इस साइट के ज़्यादातर टूल से अलग, यह हमारे सर्वर पर चलता है। आपका ब्राउज़र पहले इमेज की एक प्रति तैयार करता है (सीधी करके और पढ़ने के लिए छोटी-बड़ी करके), फिर उस प्रति को HTTPS से भेजता है। सर्वर टेक्स्ट पढ़कर उसे सीधे वापस भेज देता है। इमेज सर्वर पर सिर्फ़ काम चलने के दौरान रहती है, मेमोरी में और एक निजी अस्थायी फ़ोल्डर में, जो काम खत्म होते ही हटा दिया जाता है। हम न इमेज सेव करते हैं, न टेक्स्ट, और फ़ाइल की सामग्री कभी लॉग नहीं करते।
यह टेक्स्ट कैसे पढ़ता है?
ओपन-सोर्स Tesseract OCR इंजन से। आपका ब्राउज़र इमेज को ऐसे आकार में बदलता है जिसमें अक्षर Tesseract के लिए आसानी से पढ़ने लायक हों (सबसे लंबा किनारा 1,600 और 3,200 पिक्सल के बीच), हमारा सर्वर उसे पढ़ता है और शब्द पढ़ने के क्रम में, लाइन-दर-लाइन लौटा देता है।
कौन-सी भाषाएँ चलती हैं?
अंग्रेज़ी, और उसी लैटिन लिपि में बिना मात्रा-चिह्नों के लिखी दूसरी भाषाएँ, कम सटीकता के साथ। मात्रा-चिह्न वाले अक्षर, दूसरी लिपियाँ (जैसे देवनागरी) और हाथ की लिखावट अभी भरोसेमंद ढंग से नहीं पहचानी जातीं।
कुछ शब्द ग़लत क्यों आते हैं?
OCR साफ़, सीधे और अच्छी रोशनी वाले टेक्स्ट पर सबसे अच्छा चलता है। धुंधली फ़ोटो, तिरछा टेक्स्ट, सजावटी फ़ॉन्ट, कम कंट्रास्ट और तस्वीरों के ऊपर लिखा टेक्स्ट, सब ग़लतियाँ करवाते हैं। कॉपी करने से पहले नतीजा एडिट किया जा सकता है, इसलिए एक-दो शब्द आप ठीक कर सकते हैं।
क्या मैं स्क्रीनशॉट पेस्ट कर सकता हूँ?
हाँ। स्क्रीनशॉट को क्लिपबोर्ड पर कॉपी करें और इस पेज पर कहीं भी Ctrl+V (Mac पर Cmd+V) दबाएं।
क्या कोई सीमा है?
हर काम में एक इमेज, हर व्यक्ति के लिए रोज़ 10 मुफ़्त सर्वर टास्क, जो हमारे सभी सर्वर टूल में साझा हैं। सिर्फ़ सफल काम गिने जाते हैं, और गिनती UTC आधी रात को रीसेट होती है। ज़्यादा के लिए OCR API हर कॉल के हिसाब से भुगतान पर मिलती है।
इंसान होने की जाँच क्या है?
कोई काम चलने से पहले Cloudflare Turnstile जाँचता है कि टूल कोई इंसान इस्तेमाल कर रहा है, बॉट नहीं। यह आम तौर पर दिखती नहीं; कभी-कभी आपसे एक बॉक्स पर निशान लगाने को कहती है।