Mac पर स्कैन की हुई PDF को सर्चेबल कैसे बनाएं
Preview और Live Text स्कैन किए पेज से टेक्स्ट पढ़ तो सकते हैं, लेकिन उसे PDF में सेव नहीं करते, इसलिए सर्च और Spotlight को अब भी सिर्फ़ एक तस्वीर दिखती है। File Acture का “OCR PDF” टूल आपके Mac पर ही टेक्स्ट पहचानता है और उसे एक अदृश्य लेयर के रूप में जोड़ देता है, जिससे आपको बिल्कुल स्कैन जैसी दिखने वाली सर्चेबल कॉपी मिलती है।
23 सितंबर 2026 को अपडेट6 मिनट का पठनmacOS 26 पर File Acture 1.0.9 के साथ परखा गया
File Acture टीम द्वारा
आपने रसीदों का ढेर या साइन किया हुआ कॉन्ट्रैक्ट स्कैन किया, और अब Command-F कुछ नहीं ढूंढता। वजह यह है कि स्कैनर ने हर पेज को इमेज के रूप में सेव किया है। OCR, यानी ऑप्टिकल कैरेक्टर रिकग्निशन, उस इमेज के अक्षर पढ़कर उन्हें असली टेक्स्ट के रूप में सेव करता है, जिससे फ़ाइल का रूप बदले बिना वह सर्चेबल बन जाती है।
स्कैन की हुई PDF में टेक्स्ट सर्च या कॉपी क्यों नहीं होता?
स्कैन की हुई PDF में सर्च इसलिए नहीं होता क्योंकि उसमें हर पेज की फ़ोटो होती है, खुद अक्षर नहीं। फ़्लैटबेड स्कैनर, फ़ोन के स्कैनिंग ऐप और ऑफ़िस कॉपियर आम तौर पर पेज इसी तरह सेव करते हैं, जब तक वे स्कैन करते समय OCR न चलाएं।
नतीजा दिखता तो डॉक्यूमेंट जैसा है, पर बर्ताव फ़ोटो एल्बम जैसा करता है। Preview में Command-F कुछ नहीं ढूंढता, Spotlight फ़ाइल को उसके अंदर लिखी बातों से नहीं ढूंढ पाता, आप अकाउंट नंबर कॉपी करके ईमेल में नहीं डाल सकते, और स्क्रीन रीडर के पास पढ़ने को कुछ नहीं होता।
क्या Mac पर Preview से PDF का OCR हो सकता है?
Preview किसी PDF में टेक्स्ट लेयर नहीं जोड़ सकता, इसलिए वह स्कैन को सर्चेबल नहीं बना सकता। macOS का Live Text इमेज के अंदर का टेक्स्ट चुनने देता है, जो कोई एक फ़ोन नंबर या पता उठाने के लिए काम का है।
दिक्कत यह है कि फ़ाइल में कुछ भी नहीं लिखा जाता। Spotlight, दूसरे ऐप और जिसे आप PDF भेजते हैं, उन सबको अब भी बस एक तस्वीर मिलती है। जिस डॉक्यूमेंट को आप बाद में सर्च करेंगे या किसी और को देंगे, उसका टेक्स्ट खुद PDF के अंदर एम्बेड होना चाहिए।
File Acture से Mac पर PDF का OCR कैसे करें
File Acture का “OCR PDF” टूल हर स्कैन किए पेज पर Apple का Vision टेक्स्ट रिकग्निशन चलाता है और नतीजे को ओरिजिनल इमेज के ऊपर एक अदृश्य टेक्स्ट लेयर के रूप में एम्बेड कर देता है। पेज बिल्कुल पहले जैसा दिखता है, लेकिन अब आप उसमें सर्च कर सकते हैं, लाइनें चुन सकते हैं और उन्हें कॉपी कर सकते हैं।
आप Document Language (डॉक्यूमेंट की भाषा) चुनते हैं: Automatic Detection (अपने आप पहचान), या अंग्रेज़ी, तुर्की, जर्मन, फ़्रेंच, स्पेनिश, इतालवी, पुर्तगाली, रूसी, चीनी, जापानी और कोरियाई में से कोई एक। Accuracy में Accurate मिलता है, जो डिफ़ॉल्ट है और ज़्यादा ध्यान से पढ़ता है, और Fast, जो साफ़ छपे ढेर सारे पेजों के लिए ठीक है। जिन पेजों में पहले से टेक्स्ट है, वे वैसे ही कॉपी हो जाते हैं, इसलिए टाइप किए और स्कैन किए पेजों वाली मिली-जुली PDF में टेक्स्ट दोहरा नहीं होता।
पासवर्ड वाली PDF के लिए एक पासवर्ड फ़ील्ड आता है, और सर्चेबल कॉपी को उसी पासवर्ड से फिर से सुरक्षित कर दिया जाता है। डॉक्यूमेंट का टाइटल, लेखक, विषय और कीवर्ड बने रहते हैं, और हर कॉपी नाम में “-searchable” जोड़कर सेव की जाती है। आप एक ही रन में कई PDF प्रोसेस कर सकते हैं, और आपकी ओरिजिनल फ़ाइलों में कोई बदलाव नहीं होता।
कैसे पता करें कि OCR ने काम किया?
सर्चेबल कॉपी खोलें और Command-F दबाएं: पेज पर दिखने वाले शब्द अपनी जगह पर हाइलाइट होने चाहिए। आप किसी लाइन पर ड्रैग करके उसे चुन भी सकते हैं, या कॉपी किया पैराग्राफ़ किसी नोट में पेस्ट करके देख सकते हैं कि ठीक-ठीक क्या पहचाना गया। Spotlight, PDF के टेक्स्ट को इंडेक्स करता है, इसलिए उसकी इंडेक्सिंग पूरी होने के बाद डॉक्यूमेंट का कोई वाक्यांश टाइप करने पर फ़ाइल मिल जाती है।
Mac पर OCR के बेहतर नतीजों के लिए टिप्स
OCR उतना ही अच्छा होता है जितना स्कैन, इसलिए सीधे और साफ़ पेज सबसे अच्छा टेक्स्ट देते हैं।
- भाषा चुनें। Automatic Detection कई डॉक्यूमेंट के लिए काम करता है, लेकिन भाषा चुनने से रिकग्नाइज़र को पता रहता है कि क्या उम्मीद करनी है, और चीनी, जापानी, कोरियाई और रूसी के लिए यह सबसे ज़्यादा मायने रखता है।
- 300 DPI पर स्कैन करें। अगर स्कैनर की सेटिंग आपके हाथ में है, तो टेक्स्ट के लिए 300 DPI अच्छी सेटिंग है। इससे काफ़ी कम पर छोटे अक्षर धुंधली आकृतियों में बदल जाते हैं, जिन्हें पढ़ना मुश्किल होता है।
- पहले पेज सीधे करें। OCR चलाने से पहले आड़े पड़े पेजों को पेज घुमाएं से सीधा कर लें।
- डॉक्यूमेंट की फ़ोटो हैं? उन्हें इमेज से PDF से एक PDF में डालें, फिर उस PDF पर OCR चलाएं।
- ओरिजिनल संभालकर रखें। OCR कॉपी पेज-दर-पेज नए सिरे से बनती है, इसलिए लिंक, बुकमार्क और फ़ॉर्म फ़ील्ड उसमें नहीं आते।
- फ़ाइल साइज़ पर ध्यान दें। OCR टेक्स्ट जोड़ता है; इमेज छोटी नहीं करता। अगर कॉपी भेजने के लिए बहुत बड़ी है, तो उस पर PDF कम्प्रेस करें चलाएं, टेक्स्ट लेयर अपनी जगह बनी रहेगी।
क्या डॉक्यूमेंट का ऑनलाइन OCR करना सुरक्षित है?
ऑनलाइन OCR सर्विस को आपका डॉक्यूमेंट अपने सर्वर पर चाहिए, और बैंक स्टेटमेंट, मेडिकल पत्रों और ID कार्ड के स्कैन के लिए यह बड़ी बात है। File Acture टेक्स्ट रिकग्निशन आपके Mac पर ही चलाता है, इसलिए पेज कभी आपके Mac से बाहर नहीं जाते, और Pro वर्शन बिना इंटरनेट कनेक्शन के चलता है और सिर्फ़ लाइसेंस रिन्यू करने के लिए कभी-कभार ऑनलाइन जाता है।
मुफ्त वर्शन में हर Mac पर 3 रन मिलते हैं, और हर रन में ज़्यादा से ज़्यादा 5 PDF। स्कैन के लंबे आर्काइव के लिए कीमत देखें।
File Acture से स्कैन की हुई PDF को सर्चेबल कैसे बनाएं
- 1
OCR PDF खोलें
साइडबार में OCR PDF चुनें और अपनी स्कैन की हुई PDF उसमें ड्रैग करें, या Choose Files… पर क्लिक करें।
- 2
भाषा सेट करें
Recognition के नीचे Document Language चुनें और Accuracy को Accurate पर ही रहने दें।
- 3
मांगे जाने पर पासवर्ड डालें
अगर कोई PDF पासवर्ड से सुरक्षित है, तो दिखने वाले पासवर्ड फ़ील्ड में उसका पासवर्ड टाइप करें।
- 4
टेक्स्ट पहचानें
Recognize Text पर क्लिक करें। हर कॉपी नाम में “-searchable” के साथ सेव होती है।
- 5
नतीजा जांचें
कॉपी खोलें, Command-F दबाएं और पेज पर दिख रहा कोई शब्द सर्च करें।
स्कैन की हुई PDF को सर्चेबल बनाएं, अपने Mac पर ही।
मुफ्त आज़माएं · macOS 14 या बाद का
| तरीका | सर्चेबल PDF सेव करता है | एक साथ कई फ़ाइलें | आपके Mac पर ही रहता है |
|---|---|---|---|
| Live Text | नहीं | नहीं, एक बार में एक चुनाव | हां |
| Preview | नहीं | नहीं, उसमें OCR नहीं है | हां |
| ऑनलाइन OCR साइट | हां | अलग-अलग | नहीं, फ़ाइल अपलोड होती है |
| File Acture का “OCR PDF” | हां | हां | हां |
सवाल
क्या Preview किसी PDF को सर्चेबल बना सकता है?
नहीं। Preview PDF दिखा सकता है और उन पर मार्कअप कर सकता है, और Live Text इमेज से टेक्स्ट कॉपी कर सकता है, लेकिन इनमें से कोई भी फ़ाइल में टेक्स्ट लेयर सेव नहीं करता।
क्या OCR से मेरी PDF का रूप बदल जाता है?
नहीं। पहचाना गया टेक्स्ट अदृश्य होता है और ओरिजिनल पेज इमेज के ऊपर रहता है, इसलिए पेज वैसे ही दिखते हैं और सर्च व कॉपी काम करते हैं।
File Acture कौन-सी भाषाएं पहचान सकता है?
अंग्रेज़ी, तुर्की, जर्मन, फ़्रेंच, स्पेनिश, इतालवी, पुर्तगाली, रूसी, चीनी, जापानी और कोरियाई। आप इसे Automatic Detection पर भी छोड़ सकते हैं।
OCR के बाद कुछ टेक्स्ट गायब क्यों है?
धुंधला, बहुत छोटा या आड़ा टेक्स्ट शायद पहचाना न जाए। पेजों को घुमाकर सीधा करें, हो सके तो ज़्यादा रिज़ॉल्यूशन पर दोबारा स्कैन करें, और Accuracy को Accurate पर रखें।
क्या पासवर्ड वाली PDF का OCR हो सकता है?
हां, अगर आपको पासवर्ड पता है। उसे पासवर्ड फ़ील्ड में डालें, और सर्चेबल कॉपी उसी पासवर्ड से सुरक्षित हो जाती है।
क्या OCR के बाद लिंक और बुकमार्क बने रहते हैं?
नहीं। पेज टेक्स्ट लेयर के साथ नए सिरे से बनाए जाते हैं, इसलिए लिंक, बुकमार्क और फ़ॉर्म फ़ील्ड साथ नहीं आते। उनके लिए अपनी ओरिजिनल फ़ाइल रखें।