Cara mengubah foto menjadi PDF yang bisa dicari
- Tambahkan gambar Anda. Seret foto JPG, PNG, atau WebP ke alat ini, atau ketuk untuk memilihnya. Setiap halaman muncul sebagai kartu — seret gagangnya untuk mengatur ulang urutan, atau hapus yang tidak Anda inginkan.
- Pilih bahasanya. Pilih bahasa yang digunakan dalam dokumen. Data pengenalan untuk bahasa itu diunduh sekali (ukurannya ditampilkan di sebelah pemilih) — gambar Anda tetap tidak pernah meninggalkan perangkat.
- Kenali. Tekan Kenali teks dan lihat kartu setiap halaman berjalan dari menunggu hingga selesai, dengan jumlah kata langsung. Anda bisa membatalkan di tengah proses; tidak ada yang disimpan.
- Periksa dan unduh. Teks hasil pengenalan ditampilkan per halaman agar Anda bisa memverifikasinya sebelum memercayainya. Beri nama berkas keluaran, lalu unduh PDF yang bisa dicari, ambil .txt biasa, atau salin semuanya ke papan klip.
Apa yang dilakukannya
- OCR sesungguhnya di peramban Anda — berkas tidak pernah diunggah ke mana pun
- Beberapa foto menjadi satu PDF multihalaman, sesuai urutan pilihan Anda
- Lapisan teks tak terlihat: PDF terlihat seperti foto Anda tetapi bisa dicari dan disalin
- 15 bahasa pengenalan, diunduh sesuai kebutuhan
- Juga mengekspor teks hasil pengenalan sebagai berkas .txt biasa
Apa sebenarnya PDF yang bisa dicari itu
Foto struk hanyalah kumpulan piksel — Anda tidak bisa mencarinya, memilih totalnya, atau menyalin nama tokonya. PDF yang bisa dicari menambahkan lapisan kedua yang tak terlihat di atas gambar: teks hasil pengenalan, diposisikan sesuai kemunculannya di gambar. Halamannya tetap terlihat persis seperti foto Anda, tetapi Preview, Adobe Reader, Spotlight, dan setiap sistem dokumen kini bisa membacanya.
Alat ini membuat berkas itu di peramban Anda. Alat ini mendekode gambar Anda, menjalankan mesin pengenalan sumber terbuka Tesseract yang dikompilasi ke WebAssembly, dan menyusun PDF dengan pdf-lib — semuanya di halaman yang sedang Anda lihat. Tidak ada yang dikirimkan. Itulah intinya: struk, kontrak, surat medis, dan dokumen identitas adalah persis jenis berkas yang tidak seharusnya Anda serahkan ke situs konverter sembarangan demi OCR gratis.
Kapan menggunakannya
- Foto dokumen kertas yang ingin Anda temukan kembali nanti — struk, garansi, surat, formulir.
- Hasil pindai yang keluar dari pemindai sebagai gambar biasa.
- Apa pun yang tidak ingin Anda tempel ke situs orang asing.
Mengapa posisi penting dalam lapisan teks
Kata-kata hasil pengenalan tidak sekadar ditambahkan ke berkas — masing-masing ditempatkan secara tak terlihat pada koordinat kemunculannya di foto. Itulah yang membuat pemilihan terasa alami: seret melintasi gambar dan sorotan mengikuti baris yang tercetak, cari sebuah kata dan penampil melompat ke bagian yang tepat pada halaman. Geometrinya sifatnya perkiraan, sama seperti pada berkas yang dihasilkan pemindai kantor, dan itu tidak masalah untuk mencari dan menyalin.
Keterbatasan yang jujur
OCR di perangkat lebih lambat daripada peternakan server, dan alat ini membaca cetakan, bukan tulisan tangan. Teks yang sangat kecil atau buram bisa keliru dibaca — ekspor .txt memudahkan Anda memeriksanya. Gambar diperkecil hingga sekitar 2.500 px pada sisi terpanjang demi kecepatan pengenalan; gambar halaman yang disisipkan mempertahankan hingga 4.000 px, yang mencetak dengan bersih pada ukuran letter.
Jika Anda sering melakukan ini
Alat ini adalah konverter sekali pakai. Jika roll kamera Anda adalah tempat dokumen pergi untuk menghilang, itulah persis masalah yang menjadi alasan Paperlock ada: aplikasi ini memindai, membaca, dan mengarsipkan dokumen Anda di iPhone — dengan aturan yang sama bahwa tidak ada yang meninggalkan perangkat Anda tanpa dienkripsi.