स्कैन किए गए और केवल-छवि वाले PDF को खोजने योग्य, चुनने योग्य टेक्स्ट में बदलें। 10 भाषाएँ पहचानें, टेक्स्ट को .txt फ़ाइल में निकालें, या अदृश्य टेक्स्ट परत के साथ एक खोजने योग्य PDF बनाएं। सब कुछ आपके ब्राउज़र में चलता है।
अंग्रेज़ी, चीनी (सरलीकृत और पारंपरिक), जापानी, कोरियाई, स्पेनिश, फ़्रेंच, जर्मन, पुर्तगाली और अरबी पहचानें — या एक साथ कई मिलाएं।
अदृश्य टेक्स्ट परत वाली PDF बनाएं, ताकि स्कैन किए गए पेज किसी भी रीडर में खोजने और चुनने योग्य हो जाएं।
पहचाने गए टेक्स्ट को पेज विभाजकों के साथ एक सादे .txt फ़ाइल में निकालें, संपादित करने या कॉपी करने के लिए तैयार।
आउटपुट प्रारूप, OCR गुणवत्ता और एक विशिष्ट पेज रेंज चुनें — पूरे दस्तावेज़ को संसाधित करने की आवश्यकता नहीं।
सारी प्रोसेसिंग आपके ब्राउज़र में स्थानीय रूप से होती है। आपकी फ़ाइलें कभी किसी सर्वर पर अपलोड नहीं होतीं।
ब्राउज़र वाले किसी भी डिवाइस पर काम करता है। कोई साइन-अप नहीं, कोई वॉटरमार्क नहीं, और पूरी तरह मुफ़्त।
OCR (ऑप्टिकल कैरेक्टर रिकग्निशन) टेक्स्ट की छवियों को मशीन-पठनीय टेक्स्ट में बदलता है। स्कैन किए गए PDF प्रभावी रूप से पेजों की तस्वीरें होते हैं — शब्दों को खोजा, कॉपी या चुना नहीं जा सकता। यह टूल प्रत्येक पेज को रेंडर करता है और एक न्यूरल-नेटवर्क OCR इंजन के साथ टेक्स्ट पहचानता है, फिर आपको या तो पहचाने गए टेक्स्ट को निर्यात करने या उसे एक अदृश्य टेक्स्ट परत के रूप में PDF में वापस लिखने देता है। परिणाम एक ऐसा दस्तावेज़ है जहाँ आप शब्दों को खोज सकते हैं, वाक्यों को चुन और कॉपी कर सकते हैं, और सामग्री को स्वचालित रूप से अनुक्रमित कर सकते हैं। सारी प्रोसेसिंग आपके ब्राउज़र में स्थानीय रूप से होती है, इसलिए आपके दस्तावेज़ कभी आपके डिवाइस से बाहर नहीं जाते।
OCR चलाने में बस कुछ चरण लगते हैं। सब कुछ आपके ब्राउज़र में होता है।
एक स्कैन की गई या केवल-छवि वाली PDF खींचें और छोड़ें, या उसे चुनने के लिए अपलोड क्षेत्र पर क्लिक करें।
भाषा(एँ), आउटपुट प्रारूप (टेक्स्ट या खोजने योग्य PDF), गुणवत्ता और एक वैकल्पिक पेज रेंज चुनें। अधिकांश दस्तावेज़ों के लिए डिफ़ॉल्ट काम करते हैं।
OCR प्रारंभ करें पर क्लिक करें। प्रत्येक चयनित पेज स्वचालित रूप से रेंडर और पहचाना जाता है।
निकाली गई .txt फ़ाइल या खोजने योग्य PDF डाउनलोड करें। टेक्स्ट आउटपुट के लिए, एक पूर्वावलोकन पहचानी गई सामग्री दिखाता है।
सर्वोत्तम परिणामों के लिए, स्पष्ट, उच्च-रिज़ॉल्यूशन स्कैन का उपयोग करें और सही भाषा(एँ) चुनें। बहुत छोटा, धुंधला या भारी स्टाइल किया गया टेक्स्ट कम सटीकता के साथ पहचाना जा सकता है। पासवर्ड-सुरक्षित PDF को OCR से पहले अनलॉक किया जाना चाहिए। पहला OCR रन पहचान इंजन और भाषा डेटा लोड करता है, जिसमें कुछ सेकंड लग सकते हैं; बाद के रन तेज़ होते हैं। उच्च गुणवत्ता सेटिंग्स सटीकता बढ़ाती हैं लेकिन प्रोसेसिंग धीमी करती हैं। अरबी और कुछ लिपियाँ तब सबसे अच्छी पहचानी जाती हैं जब उनकी भाषा अकेली चुनी जाती है।