Fotoğrafları aranabilir PDF'e nasıl dönüştürürsünüz
- Görüntülerinizi ekleyin. JPG, PNG veya WebP fotoğraflarını araca bırakın ya da dokunarak seçin. Her sayfa bir kart olarak görünür — sırasını değiştirmek için tutamacı sürükleyin veya istemediklerinizi kaldırın.
- Dili seçin. Belgelerin yazıldığı dili seçin. O dile ait tanıma verisi bir kez indirilir (boyutu seçicinin yanında gösterilir) — görüntüleriniz yine de cihazınızdan hiç çıkmaz.
- Tanıyın. Metni tanı düğmesine basın ve her sayfa kartının canlı kelime sayısıyla “bekliyor”dan “tamamlandı”ya geçişini izleyin. İşlem sürerken iptal edebilirsiniz; hiçbir şey saklanmaz.
- Kontrol edin ve indirin. Tanınan metin her sayfa için ayrı ayrı gösterilir, böylece güvenmeden önce doğrulayabilirsiniz. Çıktı dosyasına bir ad verin, ardından aranabilir PDF'i indirin, düz .txt dosyasını alın veya her şeyi panoya kopyalayın.
Ne işe yarar
- Tarayıcınızda gerçek OCR — dosyalar hiçbir yere yüklenmez
- Birden çok fotoğraf, seçtiğiniz sırayla tek bir çok sayfalı PDF'e dönüşür
- Görünmez metin katmanı: PDF fotoğrafınız gibi görünür ama aranabilir ve kopyalanabilir
- İstek üzerine indirilen 15 tanıma dili
- Tanınan düz metni .txt dosyası olarak da dışa aktarır
Aranabilir bir PDF aslında nedir
Bir fişin fotoğrafı sadece pikseldir — onu arayamaz, tutarı seçemez veya satıcının adını kopyalayamazsınız. Aranabilir bir PDF, görüntünün üzerine ikinci, görünmez bir katman ekler: resimde göründüğü yerde konumlandırılmış tanınan metin. Sayfa yine tıpkı fotoğrafınız gibi görünür, ama artık Preview, Adobe Reader, Spotlight ve her belge sistemi onu okuyabilir.
Bu araç bu dosyayı tarayıcınızda oluşturur. Görüntülerinizi çözer, WebAssembly'e derlenmiş açık kaynaklı Tesseract tanıma motorunu çalıştırır ve pdf-lib ile bir PDF birleştirir — hepsi baktığınız sayfada. Hiçbir şey iletilmez. Bütün mesele de bu: fişler, sözleşmeler, sağlık mektupları ve kimlik belgeleri, ücretsiz OCR karşılığında rastgele bir dönüştürücü siteye teslim etmemeniz gereken tam da o dosyalardır.
Ne zaman kullanılır
- Daha sonra bulunabilir olmasını istediğiniz kağıt belgelerin fotoğrafları — fişler, garantiler, mektuplar, formlar.
- Bir tarayıcıdan düz görüntü olarak çıkan taramalar.
- Bir yabancının web sitesine yapıştırmayacağınız her şey.
Metin katmanında konum neden önemli
Tanınan kelimeler dosyaya sadece eklenmez — her biri, fotoğrafta göründüğü koordinatlara görünmez şekilde yerleştirilir. Seçimi doğal hissettiren de budur: görüntü üzerinde sürükleyin, vurgulama basılı satırları takip eder; bir kelimeyi arayın, görüntüleyici sayfanın doğru noktasına atlar. Geometri yaklaşıktır, tıpkı ofis tarayıcılarının ürettiği dosyalarda olduğu gibi, ve bu bulma ve kopyalama için yeterlidir.
Dürüst sınırlamalar
Cihaz üzerinde OCR, bir sunucu çiftliğinden daha yavaştır ve el yazısını değil, baskıyı okur. Çok küçük veya bulanık metin yanlış çıkabilir — .txt dışa aktarımı kontrol etmeyi kolaylaştırır. Görüntüler, tanıma hızı için uzun kenarda yaklaşık 2.500 px'e küçültülür; gömülü sayfa görüntüsü 4.000 px'e kadar korunur, bu da mektup boyutunda temiz baskı verir.
Bunu sık yapıyorsanız
Bu araç tek seferlik bir dönüştürücüdür. Kamera rulonuz belgelerin kaybolduğu yerse, Paperlock'ın var olma sebebi tam olarak budur: iPhone'unuzda kağıt işlerinizi tarar, okur ve dosyalar — hiçbir şeyin şifrelenmeden cihazınızdan çıkmaması kuralıyla.