OCR PDF — स्कैन किए गए पेजों से टेक्स्ट निकालें

स्कैन किए गए और केवल-छवि वाले PDF को खोजने योग्य, चुनने योग्य टेक्स्ट में बदलें। 10 भाषाएँ पहचानें, टेक्स्ट को .txt फ़ाइल में निकालें, या अदृश्य टेक्स्ट परत के साथ एक खोजने योग्य PDF बनाएं। सब कुछ आपके ब्राउज़र में चलता है।

मुख्य विशेषताएँ

10+ भाषाएँ

अंग्रेज़ी, चीनी (सरलीकृत और पारंपरिक), जापानी, कोरियाई, स्पेनिश, फ़्रेंच, जर्मन, पुर्तगाली और अरबी पहचानें — या एक साथ कई मिलाएं।

खोजने योग्य PDF

अदृश्य टेक्स्ट परत वाली PDF बनाएं, ताकि स्कैन किए गए पेज किसी भी रीडर में खोजने और चुनने योग्य हो जाएं।

टेक्स्ट निष्कर्षण

पहचाने गए टेक्स्ट को पेज विभाजकों के साथ एक सादे .txt फ़ाइल में निकालें, संपादित करने या कॉपी करने के लिए तैयार।

पूर्ण नियंत्रण

आउटपुट प्रारूप, OCR गुणवत्ता और एक विशिष्ट पेज रेंज चुनें — पूरे दस्तावेज़ को संसाधित करने की आवश्यकता नहीं।

100% निजी

सारी प्रोसेसिंग आपके ब्राउज़र में स्थानीय रूप से होती है। आपकी फ़ाइलें कभी किसी सर्वर पर अपलोड नहीं होतीं।

कोई इंस्टॉल नहीं, मुफ़्त

ब्राउज़र वाले किसी भी डिवाइस पर काम करता है। कोई साइन-अप नहीं, कोई वॉटरमार्क नहीं, और पूरी तरह मुफ़्त।

PDF OCR क्या है?

OCR (ऑप्टिकल कैरेक्टर रिकग्निशन) टेक्स्ट की छवियों को मशीन-पठनीय टेक्स्ट में बदलता है। स्कैन किए गए PDF प्रभावी रूप से पेजों की तस्वीरें होते हैं — शब्दों को खोजा, कॉपी या चुना नहीं जा सकता। यह टूल प्रत्येक पेज को रेंडर करता है और एक न्यूरल-नेटवर्क OCR इंजन के साथ टेक्स्ट पहचानता है, फिर आपको या तो पहचाने गए टेक्स्ट को निर्यात करने या उसे एक अदृश्य टेक्स्ट परत के रूप में PDF में वापस लिखने देता है। परिणाम एक ऐसा दस्तावेज़ है जहाँ आप शब्दों को खोज सकते हैं, वाक्यों को चुन और कॉपी कर सकते हैं, और सामग्री को स्वचालित रूप से अनुक्रमित कर सकते हैं। सारी प्रोसेसिंग आपके ब्राउज़र में स्थानीय रूप से होती है, इसलिए आपके दस्तावेज़ कभी आपके डिवाइस से बाहर नहीं जाते।

PDF का OCR कैसे करें

OCR चलाने में बस कुछ चरण लगते हैं। सब कुछ आपके ब्राउज़र में होता है।

1

स्कैन की गई PDF अपलोड करें

एक स्कैन की गई या केवल-छवि वाली PDF खींचें और छोड़ें, या उसे चुनने के लिए अपलोड क्षेत्र पर क्लिक करें।

2

अपने विकल्प चुनें

भाषा(एँ), आउटपुट प्रारूप (टेक्स्ट या खोजने योग्य PDF), गुणवत्ता और एक वैकल्पिक पेज रेंज चुनें। अधिकांश दस्तावेज़ों के लिए डिफ़ॉल्ट काम करते हैं।

3

OCR प्रारंभ करें

OCR प्रारंभ करें पर क्लिक करें। प्रत्येक चयनित पेज स्वचालित रूप से रेंडर और पहचाना जाता है।

4

परिणाम डाउनलोड करें

निकाली गई .txt फ़ाइल या खोजने योग्य PDF डाउनलोड करें। टेक्स्ट आउटपुट के लिए, एक पूर्वावलोकन पहचानी गई सामग्री दिखाता है।

जानना अच्छा है

सर्वोत्तम परिणामों के लिए, स्पष्ट, उच्च-रिज़ॉल्यूशन स्कैन का उपयोग करें और सही भाषा(एँ) चुनें। बहुत छोटा, धुंधला या भारी स्टाइल किया गया टेक्स्ट कम सटीकता के साथ पहचाना जा सकता है। पासवर्ड-सुरक्षित PDF को OCR से पहले अनलॉक किया जाना चाहिए। पहला OCR रन पहचान इंजन और भाषा डेटा लोड करता है, जिसमें कुछ सेकंड लग सकते हैं; बाद के रन तेज़ होते हैं। उच्च गुणवत्ता सेटिंग्स सटीकता बढ़ाती हैं लेकिन प्रोसेसिंग धीमी करती हैं। अरबी और कुछ लिपियाँ तब सबसे अच्छी पहचानी जाती हैं जब उनकी भाषा अकेली चुनी जाती है।

सामान्य प्रश्न