फ़ोटो को खोजी जा सकने वाली PDF कैसे बनाएं
- अपनी इमेज जोड़ें. JPG, PNG या WebP फ़ोटो टूल पर छोड़ें, या टैप करके चुनें। हर पेज एक कार्ड की तरह दिखेगा — क्रम बदलने के लिए हैंडल को खींचें, या जो नहीं चाहिए उसे हटा दें।
- भाषा चुनें. वह भाषा चुनें जिसमें दस्तावेज़ लिखे हैं। उस भाषा का पहचान डेटा एक बार डाउनलोड होता है (साइज़ पिकर के बगल में दिखता है) — फिर भी आपकी इमेज आपके डिवाइस से बाहर कभी नहीं जातीं।
- पहचानें. Recognize text पर टैप करें और देखें हर पेज का कार्ड waiting से done तक जाता है, साथ में लाइव शब्द-गिनती भी दिखती है। बीच में रोक भी सकते हैं; कुछ भी सेव नहीं रहता।
- जांचें और डाउनलोड करें. पहचाना गया टेक्स्ट हर पेज के साथ दिखता है ताकि भरोसा करने से पहले आप उसे जांच सकें। फ़ाइल का नाम रखें, फिर सर्चेबल PDF डाउनलोड करें, प्लेन .txt लें, या पूरा टेक्स्ट क्लिपबोर्ड पर कॉपी करें।
यह क्या करता है
- आपके ब्राउज़र में असली OCR — फ़ाइलें कहीं भी अपलोड नहीं होतीं
- कई फ़ोटो मिलकर एक मल्टी-पेज PDF बनती हैं, आपके चुने हुए क्रम में
- अदृश्य टेक्स्ट लेयर: PDF दिखती आपकी फ़ोटो जैसी है, पर उसमें खोजा और कॉपी किया जा सकता है
- 15 पहचान भाषाएं, ज़रूरत पड़ने पर डाउनलोड होती हैं
- पहचाना गया टेक्स्ट .txt फ़ाइल के रूप में भी मिलता है
सर्चेबल PDF असल में होती क्या है
किसी रसीद की फ़ोटो सिर्फ़ पिक्सेल होती है — आप उसमें खोज नहीं सकते, टोटल नहीं चुन सकते, या दुकान का नाम कॉपी नहीं कर सकते। सर्चेबल PDF इमेज के ऊपर एक दूसरी, अदृश्य लेयर जोड़ती है: पहचाना गया टेक्स्ट, ठीक वहीं जहां वह तस्वीर में दिखता है। पेज दिखता बिल्कुल आपकी फ़ोटो जैसा ही है, लेकिन अब Preview, Adobe Reader, Spotlight और हर दस्तावेज़ सिस्टम उसे पढ़ सकता है।
यह टूल यह फ़ाइल आपके ब्राउज़र में बनाता है। यह आपकी इमेज को डिकोड करता है, ओपन-सोर्स Tesseract पहचान इंजन को WebAssembly में चलाता है, और pdf-lib से PDF तैयार करता है — यह सब उसी पेज पर होता है जो आप देख रहे हैं। कुछ भी भेजा नहीं जाता। यही पूरी बात है: रसीदें, अनुबंध, मेडिकल लेटर और पहचान दस्तावेज़ — यही वे फ़ाइलें हैं जो आपको मुफ़्त OCR के बदले किसी भी अनजान कन्वर्टर वेबसाइट को नहीं सौंपनी चाहिए।
इसे कब इस्तेमाल करें
- कागज़ी दस्तावेज़ों की फ़ोटो जिन्हें आप बाद में ढूंढना चाहते हैं — रसीदें, वारंटी, पत्र, फ़ॉर्म।
- वे स्कैन जो सिर्फ़ प्लेन इमेज के रूप में स्कैनर से निकले हों।
- कोई भी ऐसी चीज़ जिसे आप किसी अनजान वेबसाइट पर पेस्ट नहीं करना चाहते।
टेक्स्ट लेयर में पोज़िशन क्यों मायने रखती है
पहचाने गए शब्द सिर्फ़ फ़ाइल के आख़िर में नहीं जोड़े जाते — हर शब्द उन्हीं निर्देशांकों पर अदृश्य रूप से रखा जाता है जहां वह फ़ोटो में दिखता है। इसी वजह से चुनना बिल्कुल स्वाभाविक लगता है: इमेज पर खींचें और हाइलाइट छपी हुई लाइनों के साथ चलता है, कोई शब्द खोजें और व्यूअर पेज पर सही जगह पहुंच जाता है। पोज़िशन अनुमानित होती है, ठीक वैसे ही जैसे ऑफ़िस स्कैनर से बनी फ़ाइलों में होती है, और ढूंढने-कॉपी करने के लिए यह काफ़ी है।
ईमानदार सीमाएं
डिवाइस पर होने वाला OCR सर्वर फ़ार्म से धीमा है, और यह छपी हुई लिखावट पढ़ता है, हाथ से लिखी नहीं। बहुत छोटा या धुंधला टेक्स्ट ग़लत भी आ सकता है — .txt एक्सपोर्ट से जांचना आसान हो जाता है। पहचान की स्पीड के लिए इमेज को लंबे किनारे पर लगभग 2,500 px तक छोटा किया जाता है; PDF में जुड़ा हुआ पेज इमेज 4,000 px तक रखता है, जो लेटर साइज़ पर साफ़ प्रिंट होता है।
अगर आप यह अक्सर करते हैं
यह टूल एक बार का कन्वर्टर है। अगर आपकी कैमरा रोल वह जगह है जहां दस्तावेज़ गुम हो जाते हैं, तो ठीक यही समस्या Paperlock के लिए बनी है: यह आपके iPhone पर आपके कागज़ात को स्कैन करता है, पढ़ता है, और व्यवस्थित रखता है — उसी नियम के साथ कि बिना एन्क्रिप्ट किए कुछ भी आपके डिवाइस से बाहर नहीं जाता।