सामग्री पर जाएँ
PDFToucan PDF Toucan होम

PDF OCR

स्कैन PDF को खोजने, चुनने और कॉपी करने योग्य टेक्स्ट वाली PDF में बदलें।

या फ़ाइलें यहाँ छोड़ें

PDF OCR

PDF OCR सर्वर पर चलने वाली प्रक्रिया है, जो स्कैन PDF को खोजने योग्य टेक्स्ट वाली PDF बनाती है। PDF Toucan पर अपनी PDF जोड़ें, दस्तावेज़ की भाषाएँ और पेज विकल्प चुनें, फिर तैयार searchable PDF डाउनलोड करें। यह मुफ्त सेवा है; इसके लिए खाता नहीं चाहिए, वॉटरमार्क नहीं जोड़ा जाता और दैनिक सीमा नहीं है। विज्ञापन साइट को चलाने में मदद करते हैं।

आप PDF OCR से क्या कर सकते हैं

  • स्कैन किए टेक्स्ट को खोजें और कॉपी करें

    स्कैन की गई PDF में शब्द अक्सर केवल चित्र के रूप में होते हैं। pdf ocr उन्हें पहचानकर ऐसी PDF बनाता है जिसमें आप शब्द खोज सकते हैं, पहचाने गए हिस्से चुन सकते हैं और टेक्स्ट कॉपी कर सकते हैं। यह पुराने रिकॉर्ड, नोट्स और समीक्षा के लिए भेजे गए स्कैन दस्तावेज़ों में उपयोगी है।

  • दस्तावेज़ की सही भाषाएँ चुनें

    दस्तावेज़ में इस्तेमाल होने वाली भाषा या भाषाएँ चुनें। 30 पहचान भाषाएँ और लैटिन, देवनागरी, अरबी, चीनी, जापानी व कोरियाई सहित कई लिपियाँ उपलब्ध हैं। एक बार में अधिकतम 5 भाषाएँ चुनी जा सकती हैं। केवल जरूरी भाषाएँ चुनें, क्योंकि अतिरिक्त भाषाएँ प्रक्रिया को धीमा करती हैं।

  • केवल बिना टेक्स्ट वाले पेज स्कैन करें

    अनुशंसित “बिना टेक्स्ट वाले पेज स्कैन करें” विकल्प मिश्रित दस्तावेज़ों के लिए सही है। जिन पेजों में पहले से चयन योग्य टेक्स्ट है, वे नहीं बदले जाते। केवल चित्र जैसे पेजों पर पहचान चलती है। इससे उपयोगी मौजूदा टेक्स्ट सुरक्षित रहता है और scanned PDF को खोजने योग्य बनाया जा सकता है।

  • गलत पहचाना टेक्स्ट फिर से पढ़ें

    अगर PDF में चयन योग्य टेक्स्ट तो है, लेकिन वह पहले गलत पहचाना गया था, तो “मौजूदा टेक्स्ट फिर पहचानें” चुनें। पुराना पहचाना टेक्स्ट हटाकर पेज दोबारा पढ़े जाते हैं। “हर पेज को चित्र मानें” सभी पेजों को नए सिरे से पढ़ता है, लेकिन पुराना चयन योग्य टेक्स्ट और लिंक खो जाते हैं।

  • टेढ़े और उल्टे स्कैन सुधारें

    पेज सुधार से कोण पर स्कैन किए पेज सीधे किए जा सकते हैं और उल्टे या तिरछे पेजों की दिशा अपने-आप ठीक की जा सकती है। इससे पढ़ना और टेक्स्ट पहचानना आसान हो सकता है। ध्यान रखें, “मौजूदा टेक्स्ट फिर पहचानें” चुनने पर टेढ़े पेज सीधे करने का विकल्प उपलब्ध नहीं होता।

  • कई PDF अलग-अलग तैयार करें

    एक सत्र में कई PDF जोड़ें और उन्हें अलग-अलग searchable PDF के रूप में पाएं। हर फ़ाइल अपनी जगह प्रोसेस होती है; दस्तावेज़ आपस में जोड़े नहीं जाते। कई पेज वाली फ़ाइलों में टेक्स्ट पहचानने में कुछ मिनट लग सकते हैं, खासकर जब कई फ़ाइलें या अतिरिक्त भाषाएँ चुनी गई हों।

PDF OCR ऑनलाइन कैसे करें

PDF OCR ऑनलाइन कैसे करें
  1. स्कैन PDF जोड़ने के लिए “PDF फ़ाइलें चुनें” दबाएँ

    “PDF फ़ाइलें चुनें” चुनें और अपने डिवाइस से एक या अधिक PDF जोड़ें। हर फ़ाइल अलग से प्रोसेस होगी। ऐसी PDF चुनें जिसमें पेज स्कैन या चित्र के रूप में हों और जिनमें आपको खोजने या कॉपी करने योग्य टेक्स्ट चाहिए।

  2. दस्तावेज़ में मौजूद भाषाएँ चुनें

    कम से कम एक भाषा चुनें और पेजों में दिखने वाली हर आवश्यक भाषा शामिल करें। द्विभाषी दस्तावेज़ के लिए दोनों भाषाएँ चुनें। एक रन में 5 तक भाषाएँ मिलाई जा सकती हैं। अनावश्यक भाषाएँ न जोड़ें, क्योंकि वे OCR की गति कम कर सकती हैं।

  3. OCR के लिए सही पेज मोड तय करें

    मिश्रित PDF के लिए अनुशंसित “बिना टेक्स्ट वाले पेज स्कैन करें” रखें। गलत पुराने OCR टेक्स्ट को बदलना हो तो “मौजूदा टेक्स्ट फिर पहचानें” चुनें। सभी पेज नए सिरे से पढ़ने के लिए “हर पेज को चित्र मानें” चुनें; इससे पुराने टेक्स्ट और लिंक हट जाएंगे।

  4. पेज सुधार चुनकर “टेक्स्ट पहचानें” दबाएँ

    यदि स्कैन टेढ़े हैं तो उन्हें सीधा करने और गलत दिशा वाले पेजों को घुमाने के विकल्प चुनें। फिर “टेक्स्ट पहचानें” दबाएँ। कई पेज वाली फ़ाइल के लिए कुछ मिनट प्रतीक्षा करनी पड़ सकती है। मौजूदा टेक्स्ट को फिर पहचानने वाले मोड में पेज सीधे करने का विकल्प नहीं मिलता।

  5. हर खोजने योग्य PDF डाउनलोड करें

    प्रक्रिया पूरी होने पर हर तैयार फ़ाइल के लिए खोजने योग्य PDF डाउनलोड करें। अब उसमें शब्द खोजें, टेक्स्ट चुनें और कॉपी करें। यदि मूल PDF में डिजिटल हस्ताक्षर था, तो बदली हुई PDF में वह हस्ताक्षर मान्य नहीं रहेगा।

EU सर्वरों पर अल्पकालिक मेमोरी प्रोसेसिंग

यह pdf ocr सेवा सर्वर पर चलती है। आपकी फ़ाइल HTTPS के जरिए यूरोपीय संघ में स्थित सर्वरों पर भेजी जाती है और केवल मेमोरी में प्रोसेस होती है। इसे डिस्क पर लिखा या संग्रहीत नहीं किया जाता। परिणाम डाउनलोड करते ही फ़ाइल हटा दी जाती है; यदि डाउनलोड न हो, तो भी अधिकतम 10 मिनट में हटा दी जाती है। PDF Toucan पर सेवा मुफ्त है, खाता बनाने की जरूरत नहीं है और आउटपुट पर वॉटरमार्क नहीं लगाया जाता। OCR PDF की सामग्री बदलता है, इसलिए किसी मौजूदा डिजिटल हस्ताक्षर की वैधता समाप्त हो जाती है। हस्ताक्षर की स्थिति बचानी हो तो मूल हस्ताक्षरित फ़ाइल अलग रखें।

हमारे यूरोपीय संघ सर्वर पर मेमोरी में प्रोसेस होता है। आपकी फ़ाइल कभी संग्रहीत नहीं होती: परिणाम डाउनलोड करते ही इसे हटा दिया जाता है (अधिकतम 10 मिनट बाद)।

PDF OCR – अक्सर पूछे जाने वाले सवाल

PDF में टेक्स्ट पहचान कैसे करें?

PDF जोड़ें, उसमें इस्तेमाल भाषाएँ चुनें, स्कैन किए जाने वाले पेजों का विकल्प तय करें और “टेक्स्ट पहचानें” दबाएँ। प्रक्रिया पूरी होने पर खोजने योग्य PDF डाउनलोड करें। फिर आप दस्तावेज़ में शब्द खोज सकते हैं, पहचाना गया टेक्स्ट चुन सकते हैं और उसे कॉपी कर सकते हैं।

क्या PDF OCR मुफ्त में इस्तेमाल कर सकता हूँ?

हाँ, यह pdf ocr free सेवा बिना खाता बनाए इस्तेमाल की जा सकती है। PDF जोड़ें, पहचान विकल्प चुनें और वॉटरमार्क के बिना परिणाम डाउनलोड करें। अधिक पेज, कई फ़ाइलें या अतिरिक्त भाषाएँ चुनने पर प्रोसेसिंग में कुछ मिनट लग सकते हैं।

बिना साइन-अप स्कैन PDF को searchable कैसे बनाऊँ?

हाँ, साइन-अप के बिना scanned PDF को searchable बनाया जा सकता है। फ़ाइल चुनें, दस्तावेज़ की भाषा चुनें और टेक्स्ट पहचान शुरू करें। तैयार फ़ाइल PDF ही रहती है, लेकिन उसमें ऐसा टेक्स्ट जुड़ जाता है जिसे खोजा, चुना और कॉपी किया जा सकता है।

OCR के लिए दस्तावेज़ की कौन-सी भाषाएँ चुननी चाहिए?

दस्तावेज़ में वास्तव में मौजूद सभी भाषाएँ चुनें। एक रन में अधिकतम 5 भाषाएँ चुनी जा सकती हैं और 30 पहचान भाषाएँ उपलब्ध हैं। उदाहरण के लिए हिंदी और अंग्रेज़ी वाले दस्तावेज़ में दोनों चुनें। गैर-जरूरी भाषाएँ जोड़ने से पहचान की प्रक्रिया धीमी होती है।

पहले से चयन योग्य टेक्स्ट वाली PDF पर क्या असर पड़ेगा?

अनुशंसित मोड में मौजूदा चयन योग्य टेक्स्ट वाले पेज नहीं बदलते। “बिना टेक्स्ट वाले पेज स्कैन करें” केवल उन पेजों को पढ़ता है जिनमें टेक्स्ट नहीं है। “मौजूदा टेक्स्ट फिर पहचानें” या “हर पेज को चित्र मानें” चुनने पर पुराना चयन योग्य टेक्स्ट हट सकता है।

डिजिटल हस्ताक्षर OCR के बाद अमान्य क्यों हो जाता है?

क्योंकि OCR PDF की सामग्री बदल देता है, डिजिटल हस्ताक्षर बदले हुए दस्तावेज़ से मेल नहीं खाता। इसलिए हस्ताक्षर मान्य नहीं रहता। हस्ताक्षरित रिकॉर्ड की वैधता बनाए रखनी हो तो मूल फ़ाइल सुरक्षित रखें और OCR से बनी प्रति को अलग कार्यशील कॉपी के रूप में इस्तेमाल करें।

स्कैन की गई PDF को Word में कैसे बदलें?

हाँ, पहले इस pdf ocr converter से scanned PDF को खोजने योग्य PDF बनाएं। इसके बाद अलग pdf-to-word टूल से उसे Word दस्तावेज़ में बदलें। OCR का परिणाम सीधे Word फ़ाइल नहीं होता; यह चयन और खोज योग्य टेक्स्ट वाली PDF तैयार करता है।

PDF OCR तब उपयोगी है जब स्कैन दस्तावेज़ को खोजने योग्य PDF के रूप में रखना हो। बाद में संपादन के लिए pdf-to-word से Word फ़ाइल बनाएं। अगर पहचान के बाद फ़ाइल का आकार बढ़ जाए, तो compress से उसे साझा करने या सहेजने से पहले छोटा किया जा सकता है।

अंतिम अपडेट 20 सितंबर 2026

इस टूल की गाइड