PDF दस्तावेज़ों से डेटा टेबल बैच पता लगाएं और निकालें। कई फ़ाइलें अपलोड करें — वे स्वचालित रूप से बदलना शुरू हो जाती हैं। प्रत्येक परिणाम व्यक्तिगत डाउनलोड के लिए फ़ाइल सूची में दिखाई देता है, या सभी को ZIP आर्काइव के रूप में डाउनलोड करें। सारी प्रोसेसिंग आपके ब्राउज़र में रहती है।
बुद्धिमान टेक्स्ट समूहीकरण एल्गोरिथम का उपयोग करके आपके PDF दस्तावेज़ों में डेटा टेबल स्वचालित रूप से पता लगाएं। टेक्स्ट स्थिति विश्लेषण के आधार पर कॉलम और पंक्ति संरचनाओं की पहचान करता है।
पता लगाई गई टेबल को अपने पसंदीदा प्रारूप में निर्यात करें: डेटा प्रोसेसिंग के लिए JSON, दस्तावेज़ीकरण के लिए Markdown, या स्प्रेडशीट एप्लिकेशनों के लिए CSV।
टेबल पता लगाने की संवेदनशीलता को नियंत्रित करने के लिए न्यूनतम कॉलम और पंक्तियों की थ्रेशोल्ड समायोजित करें। कम मान अधिक संभावित टेबल पकड़ते हैं, उच्च मान शोर को फ़िल्टर करते हैं।
सारी प्रोसेसिंग PDF.js का उपयोग करके आपके ब्राउज़र में स्थानीय रूप से होती है। आपकी PDF फ़ाइलें कभी आपके डिवाइस से बाहर नहीं जातीं — किसी भी सर्वर पर कोई अपलोड नहीं, पूर्ण गोपनीयता।
डाउनलोड या इंस्टॉल करने के लिए कोई सॉफ़्टवेयर नहीं। पूरा निष्कर्षण इंजन आपके ब्राउज़र में चलता है — आधुनिक ब्राउज़र वाले किसी भी डिवाइस पर काम करता है।
हमारा PDF टेबल एक्सट्रैक्टर टेक्स्ट निष्कर्षण के लिए PDF.js और टेक्स्ट स्थिति विश्लेषण पर आधारित कस्टम टेबल पता लगाने वाला एल्गोरिथम उपयोग करता है। यह पंक्तियों की पहचान करने के लिए टेक्स्ट आइटम को उनके Y निर्देशांक द्वारा समूहित करता है, फिर टेबल संरचनाओं का पता लगाने के लिए कॉलम स्थितियों का विश्लेषण करता है। कई PDF अपलोड और बैच में संसाधित की जा सकती हैं — वे अपलोड के बाद स्वचालित रूप से निकालना शुरू हो जाती हैं। प्रत्येक पूर्ण फ़ाइल व्यक्तिगत डाउनलोड के लिए परिणाम सूची में दिखाई देती है, या सभी फ़ाइलें एक साथ ZIP आर्काइव के रूप में डाउनलोड की जा सकती हैं। आप न्यूनतम कॉलम और पंक्तियों की सेटिंग्स के माध्यम से पता लगाने की संवेदनशीलता समायोजित कर सकते हैं। पता लगाई गई टेबल को JSON (हेडर और पंक्ति ऑब्जेक्ट के साथ संरचित), Markdown (फ़ॉर्मेट की गई टेबल), या CSV (Excel और स्प्रेडशीट के साथ संगत) के रूप में निर्यात किया जा सकता है। सारी प्रोसेसिंग आपके ब्राउज़र में स्थानीय रहती है — कोई डेटा कभी अपलोड नहीं होता।
हमारे टूल के साथ PDF से टेबल निकालना सरल है:
अपलोड क्षेत्र पर एक या अधिक PDF फ़ाइलें खींचें और छोड़ें, या अपने डिवाइस से फ़ाइलें चुनने के लिए ब्राउज़ करें पर क्लिक करें।
अपना पसंदीदा आउटपुट प्रारूप (JSON, Markdown या CSV) चुनें। टेबल पता लगाने की संवेदनशीलता को नियंत्रित करने के लिए न्यूनतम कॉलम और पंक्तियों की थ्रेशोल्ड समायोजित करें।
अपलोड के बाद फ़ाइलें स्वचालित रूप से निकालना शुरू हो जाती हैं। प्रत्येक पूर्ण फ़ाइल व्यक्तिगत डाउनलोड के लिए परिणाम सूची में दिखाई देती है। सभी फ़ाइलों को एक ZIP आर्काइव में पैकेज करने के लिए सभी डाउनलोड करें का उपयोग करें।
यह टूल PDF में टेक्स्ट स्थितियों का विश्लेषण करके टेबल का पता लगाता है। यह स्पष्ट रूप से संरचित टेक्स्ट-आधारित टेबल वाली PDF पर सबसे अच्छा काम करता है। कई PDF अपलोड और बैच में संसाधित की जा सकती हैं — प्रत्येक पूर्ण फ़ाइल व्यक्तिगत डाउनलोड के लिए परिणाम सूची में दिखाई देती है, या सभी को ZIP आर्काइव के रूप में डाउनलोड करें। स्कैन की गई PDF (इमेज-आधारित दस्तावेज़) संसाधित नहीं की जा सकतीं क्योंकि उनमें चयन योग्य टेक्स्ट नहीं होता। मर्ज किए गए सेल, अनियमित रिक्ति या बिना बॉर्डर वाले डिज़ाइन वाले जटिल टेबल लेआउट पूरी तरह पता नहीं लगाए जा सकते। यदि टेबल पता नहीं लगाई जा रही हैं या बहुत अधिक शोर कैप्चर हो रहा है, तो न्यूनतम कॉलम और पंक्तियों की सेटिंग्स समायोजित करें।