इमेज टूल मुफ्त ऑनलाइन टूल

इमेज OCR — तस्वीरों से टेक्स्ट निकालें

PNG, JPG, JPEG और WebP तस्वीरों से संपादन योग्य टेक्स्ट सीधे अपने ब्राउज़र में निकालें।

मुफ्त उपयोग साइन-अप नहीं ब्राउज़र आधारित
ऑनलाइन टूल

इमेज OCR — तस्वीरों से टेक्स्ट निकालें

तैयार
ब्राउज़र में OCR

चुनी गई तस्वीर आपके ब्राउज़र में प्रोसेस होती है और OCR के लिए CyberTools पर अपलोड नहीं की जाती। OCR लाइब्रेरी पहचान के लिए आवश्यक इंजन और भाषा फ़ाइलें डाउनलोड कर सकती है।

बेहतर OCR परिणामों के लिए

स्पष्ट, सीधी और अच्छे कंट्रास्ट वाली तस्वीर इस्तेमाल करें। बहुत छोटा, धुंधला, तिरछा या सजावटी टेक्स्ट पहचान की सटीकता कम कर सकता है।

मुफ़्त इमेज OCR — तस्वीरों से ऑनलाइन टेक्स्ट निकालें

CyberTools इमेज OCR किसी तस्वीर में दिखाई देने वाले टेक्स्ट को सीधे आपके ब्राउज़र में संपादन योग्य टेक्स्ट में बदलता है। PNG, JPG, JPEG या WebP तस्वीर चुनें, पहचान की भाषा निर्धारित करें, ऑप्टिकल कैरेक्टर रिकग्निशन चलाएँ और फिर मिले हुए टेक्स्ट को कॉपी करें या TXT फ़ाइल के रूप में डाउनलोड करें।

OCR की प्रक्रिया Tesseract.js की मदद से ब्राउज़र में चलती है। चुनी गई मूल तस्वीर टेक्स्ट पहचान के लिए CyberTools पर अपलोड नहीं की जाती। हालाँकि, ज़रूरत पड़ने पर आपका ब्राउज़र OCR इंजन और चुनी गई भाषा से संबंधित डेटा डाउनलोड कर सकता है।

यह टूल स्क्रीनशॉट, स्कैन किए गए दस्तावेज़, कैमरे से ली गई पेज की तस्वीर, रसीद, लेबल, फ़ॉर्म, प्रस्तुति स्लाइड और ऐसी दूसरी तस्वीरों से टेक्स्ट निकालने में उपयोगी है जिनमें स्पष्ट मुद्रित टेक्स्ट मौजूद हो। OCR पूरी तरह त्रुटिरहित नहीं होता, इसलिए महत्वपूर्ण जानकारी को मूल तस्वीर से मिलाना आवश्यक है।

तस्वीर से टेक्स्ट कैसे निकालें

  1. 1 PNG, JPG, JPEG या WebP तस्वीर चुनें या उसे OCR क्षेत्र में खींचकर छोड़ें।
  2. 2 प्रोसेस करने से पहले तस्वीर का पूर्वावलोकन, फ़ाइल नाम, आयाम और फ़ाइल आकार जाँचें।
  3. 3 तस्वीर में मौजूद टेक्स्ट से सबसे अच्छी तरह मेल खाने वाली भाषा चुनें।
  4. 4 टेक्स्ट निकालें पर क्लिक करें और प्रतीक्षा करें जबकि OCR इंजन आपके ब्राउज़र में तस्वीर का विश्लेषण करता है।
  5. 5 पहचाने गए टेक्स्ट की जाँच करें, संभावित OCR त्रुटियाँ सुधारें और फिर उसे कॉपी करें या TXT फ़ाइल डाउनलोड करें।

इमेज OCR क्या है?

OCR का अर्थ ऑप्टिकल कैरेक्टर रिकग्निशन है। OCR सॉफ़्टवेयर तस्वीर में मौजूद आकृतियों और पैटर्न का विश्लेषण करके उन्हें अक्षर, अंक, विराम चिह्न और शब्दों के रूप में पहचानने की कोशिश करता है। परिणाम मशीन द्वारा पढ़ा जा सकने वाला टेक्स्ट होता है जिसे चुना, संपादित, खोजा और दोबारा उपयोग किया जा सकता है।

OCR सामान्य तस्वीर से किसी छिपी हुई टेक्स्ट परत को केवल कॉपी नहीं करता। PNG और JPEG फ़ाइलों में आम तौर पर पिक्सेल होते हैं, संपादन योग्य शब्द नहीं। पहचान इंजन को उन पिक्सेल का अर्थ निकालकर अनुमान लगाना पड़ता है कि वे कौन-से अक्षर दर्शाते हैं। इसी कारण तस्वीर की गुणवत्ता, भाषा, फ़ॉन्ट, दिशा, कंट्रास्ट और लेआउट सटीकता को प्रभावित करते हैं।

OCR पहचान की भाषाएँ

CyberTools वर्तमान में अंग्रेज़ी, अरबी, जर्मन, स्पेनिश, फ़्रेंच, हिंदी, इंडोनेशियाई, जापानी, कोरियाई, पुर्तगाली और तुर्की के लिए पहचान विकल्प देता है। पहचान की भाषा तय करती है कि OCR इंजन किस भाषा मॉडल का उपयोग करेगा। यह CyberTools इंटरफ़ेस की भाषा से अलग होती है।

वही भाषा चुनें जो वास्तव में तस्वीर में लिखी हुई है। उदाहरण के लिए, CyberTools का हिंदी इंटरफ़ेस उपयोग करने का अर्थ यह नहीं कि अंग्रेज़ी स्क्रीनशॉट को हिंदी मॉडल से पढ़ा जाए। अंग्रेज़ी टेक्स्ट के लिए अंग्रेज़ी, अरबी टेक्स्ट के लिए अरबी और जापानी टेक्स्ट के लिए जापानी चुनें।

भाषा डेटा का आकार अपेक्षाकृत बड़ा हो सकता है। इसलिए किसी विशेष भाषा के साथ पहली OCR प्रक्रिया में थोड़ा अधिक समय लग सकता है जबकि ब्राउज़र इंजन तैयार करता है और आवश्यक पहचान डेटा प्राप्त करता है।

OCR

OCR की सटीकता कैसे बेहतर करें

OCR सबसे अच्छा तब काम करता है जब अक्षर साफ़ और आसानी से अलग पहचाने जा सकें। बेहतर परिणामों के लिए:

  1. 1 ऐसी स्पष्ट तस्वीर इस्तेमाल करें जिसमें हर अक्षर आसानी से पढ़ा जा सके।
  2. 2 टेक्स्ट को जहाँ तक संभव हो सीधा रखें और बहुत अधिक घुमाव या तिरछापन न रखें।
  3. 3 टेक्स्ट और पृष्ठभूमि के बीच अच्छा कंट्रास्ट रखें।
  4. 4 बहुत अधिक धुंधलापन, चमक, छाया, कम्प्रेशन आर्टिफ़ैक्ट और अत्यंत छोटे टेक्स्ट से बचें।
  5. 5 यदि अनावश्यक दृश्य सामग्री टेक्स्ट क्षेत्र में बाधा डाल रही हो तो उसे क्रॉप करें।
  6. 6 जिस टेक्स्ट को निकालना है उसके लिए सही पहचान भाषा चुनें।
  7. 7 नाम, तारीख, धनराशि और संदर्भ संख्या जैसी महत्वपूर्ण जानकारी को OCR के बाद मूल तस्वीर से मिलाएँ।

OCR कभी-कभी देखने में समान अक्षरों और अंकों को भ्रमित कर सकता है। उदाहरण के लिए 0 और O, 1 और छोटे l या कुछ विराम चिह्न एक जैसे दिखाई दे सकते हैं। कम रिज़ॉल्यूशन और सजावटी फ़ॉन्ट ऐसी त्रुटियों की संभावना बढ़ाते हैं।

समर्थित इमेज फ़ॉर्मेट और ब्राउज़र सुरक्षा सीमाएँ

CyberTools का वर्तमान OCR कार्यक्षेत्र PNG, JPG, JPEG और WebP तस्वीरें स्वीकार करता है। ब्राउज़र में चयनित फ़ाइल की सुरक्षा सीमा 20 MB है और डिकोड होने के बाद तस्वीर की सीमा 25 मेगापिक्सेल है।

फ़ाइल का आकार और डिकोड की गई तस्वीर का आकार अलग चीज़ें हैं। कोई कम्प्रेस्ड JPEG डिस्क पर केवल कुछ मेगाबाइट का हो सकता है लेकिन डिकोड होने के बाद उसे काफी अधिक मेमोरी की आवश्यकता हो सकती है। OCR इंजन को पहचान प्रक्रिया के लिए अतिरिक्त मेमोरी भी चाहिए, इसलिए बहुत बड़ी तस्वीरें मोबाइल ब्राउज़र और कम मेमोरी वाले उपकरणों पर भारी पड़ सकती हैं।

इनपुट फ़ॉर्मेट PNG, JPG, JPEG, WebP
अधिकतम फ़ाइल आकार 20 MB
अधिकतम डिकोड आकार 25 मेगापिक्सेल
प्रोसेसिंग ब्राउज़र में OCR
आउटपुट संपादन योग्य टेक्स्ट और TXT डाउनलोड
खाता आवश्यक नहीं

गोपनीयता और ब्राउज़र में प्रोसेसिंग

चुनी गई मूल तस्वीर OCR के लिए ब्राउज़र में स्थानीय रूप से प्रोसेस होती है, बजाय इसके कि उसे किसी CyberTools कन्वर्ज़न सर्वर पर भेजा जाए। यह तब उपयोगी है जब आप मूल तस्वीर को साइट के प्रोसेसिंग सर्वर पर नहीं भेजना चाहते।

ब्राउज़र में प्रोसेस होने का अर्थ यह नहीं कि पेज किसी भी प्रकार का नेटवर्क अनुरोध नहीं करता। आवश्यकता पड़ने पर Tesseract OCR लाइब्रेरी और प्रशिक्षित भाषा फ़ाइलें डाउनलोड की जा सकती हैं। महत्वपूर्ण बात यह है कि चुनी गई तस्वीर ब्राउज़र-आधारित OCR प्रक्रिया में संभाली जाती है।

बहुत संवेदनशील दस्तावेज़ों के लिए अपने डिवाइस, ब्राउज़र, इंस्टॉल किए गए एक्सटेंशन, नेटवर्क वातावरण और संगठन की सुरक्षा आवश्यकताओं पर भी विचार करें।

मुद्रित टेक्स्ट और हस्तलिखित टेक्स्ट

सामान्य OCR सिस्टम साफ़ मुद्रित या डिजिटल रूप से दिखाए गए टेक्स्ट पर अधिक भरोसेमंद होते हैं। लिखावट हर व्यक्ति की अलग होती है और उसमें जुड़े हुए अक्षर, अनियमित दूरी तथा अस्पष्ट आकृतियाँ हो सकती हैं, इसलिए हस्तलिखित टेक्स्ट की पहचान काफी कम सटीक हो सकती है।

यदि हस्तलिखित पेज महत्वपूर्ण है, तो OCR परिणाम को अंतिम प्रमाणित प्रतिलिपि न मानें बल्कि ट्रांसक्रिप्शन के प्रारंभिक मसौदे की तरह उपयोग करें। उसे सहेजने, प्रकाशित करने या उस पर निर्भर करने से पहले पूरी सामग्री को मूल तस्वीर से जाँचें।

क्या OCR मूल लेआउट बनाए रखता है?

यह टूल संपादन योग्य टेक्स्ट निकालने के लिए बनाया गया है, पूरे दस्तावेज़ को पिक्सेल-दर-पिक्सेल उसी लेआउट में दोबारा बनाने के लिए नहीं। जटिल तालिकाएँ, कई कॉलम, असामान्य पढ़ने का क्रम, ग्राफ़िक्स के आसपास टेक्स्ट और अत्यधिक डिज़ाइन किए गए पेज परिणाम में ठीक उसी रूप में नहीं आ सकते।

साधारण पैराग्राफ, स्क्रीनशॉट, लेबल और सीधे-सादे दस्तावेज़ों में निकाला गया टेक्स्ट अक्सर तुरंत उपयोगी होता है। अधिक संरचित दस्तावेज़ों में OCR के बाद कुछ मैन्युअल संपादन की आवश्यकता हो सकती है।

इमेज OCR कब उपयोगी है?

स्क्रीनशॉट में मौजूद टेक्स्ट को संपादन योग्य टेक्स्ट में बदलने के लिए।
फ़ोटो खींचे गए या स्कैन किए गए पेजों से पैराग्राफ निकालने के लिए।
तस्वीर से उत्पाद कोड, लेबल या सीरियल जैसी संख्या कॉपी करने के लिए।
प्रस्तुति स्लाइड या ग्राफ़िक्स से टेक्स्ट निकालने के लिए।
रसीद, नोट या फ़ॉर्म का प्रारंभिक ट्रांसक्रिप्शन बनाने के लिए।
तस्वीर में मौजूद टेक्स्ट को खोजने और दोबारा उपयोग करने योग्य बनाने के लिए।
हर पंक्ति को हाथ से दोबारा टाइप किए बिना दृश्य टेक्स्ट को दस्तावेज़ में ले जाने के लिए।

OCR की महत्वपूर्ण सीमाएँ

OCR परिणाम मशीन द्वारा की गई पहचान है, पूर्णतः सही ट्रांसक्रिप्शन की गारंटी नहीं। सटीकता मूल तस्वीर और पहचान मॉडल पर निर्भर करती है। कम कंट्रास्ट, असामान्य फ़ॉन्ट, परिप्रेक्ष्य विकृति, लंबवत टेक्स्ट, हस्तलिखित सामग्री, जटिल पृष्ठभूमि और एक से अधिक भाषाओं वाले दस्तावेज़ भरोसेमंदता घटा सकते हैं।

कानूनी, चिकित्सीय, वित्तीय, शैक्षणिक या सुरक्षा से संबंधित जानकारी में OCR परिणाम को बिना जाँचे बिल्कुल सही न मानें। महत्वपूर्ण जानकारी को सीधे मूल तस्वीर से सत्यापित करें।

अक्सर पूछे जाने वाले प्रश्न

क्या यह इमेज OCR टूल मुफ़्त है?

हाँ। CyberTools इमेज OCR का उपयोग बिना खाता बनाए किया जा सकता है।

क्या CyberTools मेरी तस्वीर OCR के लिए अपलोड करता है?

चुनी गई तस्वीर वर्तमान OCR प्रक्रिया में ब्राउज़र के भीतर प्रोसेस होती है। OCR लाइब्रेरी और भाषा डेटा के लिए नेटवर्क डाउनलोड की आवश्यकता हो सकती है।

कौन-से इमेज फ़ॉर्मेट समर्थित हैं?

वर्तमान टूल PNG, JPG, JPEG और WebP तस्वीरें स्वीकार करता है।

OCR तस्वीर का अधिकतम आकार क्या है?

वर्तमान सुरक्षा सीमा चयनित फ़ाइल के लिए 20 MB और डिकोड की गई तस्वीर के लिए 25 मेगापिक्सेल है।

क्या इमेज OCR अरबी टेक्स्ट पहचान सकता है?

हाँ। अरबी वर्तमान में उपलब्ध पहचान भाषाओं में से एक है।

क्या जापानी, कोरियाई और हिंदी समर्थित हैं?

हाँ। जापानी, कोरियाई और हिंदी कई दूसरी भाषाओं के साथ उपलब्ध हैं।

क्या OCR तालिका और फ़ॉर्मेटिंग को सुरक्षित रखता है?

ज़रूरी नहीं। यह टूल संपादन योग्य टेक्स्ट निकालने पर केंद्रित है और जटिल दस्तावेज़ लेआउट को ठीक उसी रूप में दोबारा बनाने की गारंटी नहीं देता।

कुछ अक्षर गलत क्यों पहचाने जाते हैं?

धुंधलापन, कम रिज़ॉल्यूशन, असामान्य फ़ॉन्ट, कम कंट्रास्ट, घुमाव और देखने में समान अक्षर पहचान त्रुटियाँ पैदा कर सकते हैं। सही भाषा और अधिक स्पष्ट तस्वीर से परिणाम बेहतर हो सकते हैं।

संपर्क

कुछ कमी है?

किसी गायब टूल का अनुरोध करें या हमारे संपर्क फ़ॉर्म के माध्यम से अपनी प्रतिक्रिया भेजें।

हमसे संपर्क करें