OCR छवि से टेक्स्ट क्या है?
डिवाइस पर ही Tesseract OCR का उपयोग करके इमेज, स्क्रीनशॉट, स्कैन किए गए दस्तावेज़ों और फ़ोटो से टेक्स्ट निकालें। कई भाषाओं का समर्थन करता है और एडिट करने योग्य टेक्स्ट देता है जिसे कॉपी या डाउनलोड कर सकते हैं। कोई फ़ाइल आपके डिवाइस से बाहर नहीं जाती — सारी प्रोसेसिंग लोकल होती है।
इस टूल में WebAssembly में संकलित Tesseract OCR और 20 प्रशिक्षित भाषा पैक (अंग्रेज़ी, स्पेनिश, फ़्रेंच, जर्मन, इतालवी, डच, पुर्तगाली, पोलिश, स्वीडिश, तुर्की, रूसी, अरबी, हिन्दी, थाई, वियतनामी, चीनी सरलीकृत/पारंपरिक, जापानी, कोरियाई, इंडोनेशियाई) शामिल हैं। हर पैक पहली बार इस्तेमाल पर एक बार डाउनलोड होता है और फिर कैश में रहता है। आप कोई इमेज या एक-पेज वाली PDF लोड कर सकते हैं, टेढ़ी तस्वीरों को घुमा सकते हैं, पहचान से पहले कोई एक हिस्सा चुन सकते हैं, और फिर नतीजे को सादे टेक्स्ट या Word दस्तावेज़ के रूप में सहेज सकते हैं। स्क्रीनशॉट, 300 dpi के स्कैन और साफ़ रसीदों पर सटीकता अच्छी रहती है; प्रिंट पर 95% या उससे ज़्यादा, और हस्तलेखन या तिरछी तस्वीरों पर कम।
उपयोग कैसे करें
- जिस टेक्स्ट को निकालना है, उसकी इमेज (PNG, JPG, BMP या WebP) या एक-पेज वाली PDF अपलोड करें, या क्लिपबोर्ड से स्क्रीनशॉट पेस्ट करें। पहली बार आए हैं? नमूना आज़माएँ दबाकर इसे एक उदाहरण पर चलते हुए देखें।
- बेहतर पहचान सटीकता के लिए इमेज में टेक्स्ट की भाषा चुनें। OCR प्रोसेसिंग शुरू करने के लिए 'Extract Text' पर क्लिक करें।
- निकाला गया टेक्स्ट जाँचें, गलतियाँ ठीक करें, फिर उसे कॉपी करें या .txt या Word (.docx) फ़ाइल के रूप में डाउनलोड करें।
कब उपयोग करें
- कॉपी ब्लॉक किए PDF, चैट या स्लाइड के स्क्रीनशॉट से एडिट करने योग्य टेक्स्ट निकालना।
- पेपर रसीद की फ़ोटो में मौजूद आइटम-दर-आइटम विवरण बजट शीट में डालना।
- हाथ से लिखे या प्रिंटेड लेक्चर नोट्स को डिजिटल बनाकर बाद में सर्च योग्य बनाना।
परिणाम
रेस्टोरेंट की रसीद की फ़ोटो अपलोड करें: OCR हर लाइन को पढ़ता है, जैसे 'सीज़र सलाद — $12.50' और 'स्पार्कलिंग वॉटर — $3.00', और आपको साफ़ टेक्स्ट देता है जिसे आप सीधे स्प्रेडशीट में पेस्ट कर सकते हैं।
अक्सर पूछे जाने वाले प्रश्न
- OCR इंजन किन भाषाओं को पहचान सकता है?
- अंग्रेज़ी, स्पेनिश, फ़्रेंच, जर्मन, इतालवी, डच, पुर्तगाली, पोलिश, स्वीडिश, तुर्की, रूसी, अरबी, हिन्दी, थाई, वियतनामी, चीनी सरलीकृत/परंपरागत, जापानी, कोरियाई और इंडोनेशियाई — कुल 20 भाषाएँ। अपनी इमेज से सबसे मिलती-जुलती चुनें। मिश्रित भाषा वाले टेक्स्ट में, जो लिपि बड़े हिस्से को कवर करे, उसे चुनें।
- कितनी सटीकता की उम्मीद रखें?
- 300 dpi या उससे ऊँचे साफ़ प्रिंट (स्क्रीनशॉट, स्कैन किए PDF) पर आम तौर पर 95% या ज़्यादा। हाथ की लिखावट, कम कंट्रास्ट, मूवमेंट ब्लर या तिरछी फ़ोटो इसे काफ़ी गिरा देती है। नतीजे के साथ दिखने वाला कॉन्फ़िडेंस स्कोर बताता है कि Tesseract कितना भरोसेमंद है।
- पहली बार भाषा पैक लोड होने में कुछ सेकंड क्यों लगते हैं?
- हर Tesseract भाषा मॉडल 10 से 20 MB का होता है और जिस भाषा को पहली बार चुना जाए, सिर्फ़ तभी डाउनलोड होता है। उसके बाद ब्राउज़र कैश में रहता है, इसलिए वही भाषा अगली बार लगभग तुरंत काम करती है।
- क्या फ़ाइल अपलोड किए बिना क्लिपबोर्ड से स्क्रीनशॉट पेस्ट कर सकते हैं?
- हाँ। पहले स्क्रीनशॉट लें (Windows पर Win+Shift+S या macOS पर Cmd+Ctrl+Shift+4) और फिर ‘इमेज पेस्ट करें’ पर क्लिक करें। टूल सीधे क्लिपबोर्ड से इमेज पढ़ता है, डिस्क पर सहेजने की ज़रूरत नहीं।
- क्या मेरी इमेज कहीं भेजी जाती हैं?
- नहीं। Tesseract WebAssembly के ज़रिये पेज के अंदर ही चलता है और इमेज के बाइट्स आपके डिवाइस से बाहर नहीं जाते। पुष्टि के लिए DevTools में नेटवर्क बंद करके देखें — पहचान फिर भी पूरी हो जाएगी।
संबंधित उपकरण
PDF बुकमार्क एडिटर
PDF फ़ाइलों में बुकमार्क जोड़ें और संपादित करें
PDF फ़्लैटन टूल
PDF में फ़ॉर्म फ़ील्ड और एनोटेशन को फ़्लैट करें
रिच टेक्स्ट एडिटर
WYSIWYG एडिटर से दस्तावेज़ लिखें और फ़ॉर्मेट करें
Markdown से PDF बनाएँ
Markdown फ़ाइलों को स्टाइल किए गए PDF दस्तावेज़ों में बदलें
PDF क्रॉप
PDF पेज के मार्जिन क्रॉप करें और एडजस्ट करें
PDF पेज क्रमबद्ध करें
PDF पेजों को ड्रैग और ड्रॉप करके पुनर्व्यवस्थित करें