Cách scan một tài liệu ngay trong trình duyệt
- Chụp ảnh tài liệu. Chạm Chụp ảnh để dùng camera, hoặc thả vào một ảnh bạn đã có sẵn. Đặt trên bề mặt phẳng, đủ sáng, và đứng sao cho bóng của bạn không đổ lên trang giấy.
- Chỉnh các góc. Công cụ tự gợi ý vị trí các cạnh của tài liệu. Kéo bất kỳ góc nào để chỉnh lại — một kính lúp hiện ra để bạn đặt đúng vào mép giấy.
- Chọn một bộ lọc. Chế độ Tài liệu làm giấy trắng và chữ đậm, giống như một máy scan thật. Chế độ xám và gốc luôn sẵn có khi bạn cần.
- Thêm trang và tải xuống. Chạm Thêm trang cho mỗi tờ giấy, sắp xếp lại nếu cần, rồi tải xuống tất cả thành một PDF duy nhất.
Công cụ này làm gì
- Tự động nhận diện cạnh (dò đường thẳng kết hợp mô hình hoá nền), kèm khung cắt bốn góc kéo được và kính lúp để chỉnh chính xác
- Xử lý đúng ảnh chụp điện thoại bị xoay — dữ liệu EXIF về hướng ảnh được đọc và áp dụng, kể cả trên Safari đời cũ
- Bộ lọc tài liệu làm giấy trắng và chữ sắc nét — cùng chế độ xám và chế độ gốc
- Nhiều trang: tiếp tục thêm trang, sắp xếp lại, rồi tải xuống một PDF duy nhất
- Dùng được với camera iPhone của bạn hoặc bất kỳ ảnh nào bạn đã có sẵn
- Chạy hoàn toàn trong trình duyệt của bạn — ảnh chụp không bao giờ được gửi lên máy chủ
Một máy scan chạy đúng nơi tài liệu của bạn nên ở lại: trên thiết bị của bạn
Hầu hết các trang "máy scan trực tuyến miễn phí" đều hoạt động theo cùng một cách: bạn tải ảnh chụp tài liệu lên máy chủ của họ, máy chủ xử lý nó, rồi bạn tải kết quả về. Với một hợp đồng thuê nhà, một hộ chiếu, hay một hoá đơn y tế, đó là một sự đánh đổi kỳ lạ. Máy scan này làm cùng công việc đó — sửa phối cảnh, làm sạch, ghép PDF — bằng JavaScript chạy ngay trong trình duyệt của chính bạn. Trang giấy bạn đang chụp không bao giờ rời khỏi thiết bị bạn dùng để chụp nó.
Nó thực sự hoạt động thế nào
Khi bạn chọn một ảnh, công cụ tìm đường viền của tài liệu theo hai cách cùng lúc: nó dò các cạnh thẳng rõ nhất trong ảnh (giống cách các ứng dụng máy scan làm), và tách riêng việc mô hình hoá nền từ các mép ảnh để tìm ra vùng không phải là mặt bàn. Khi hai cách này khớp nhau, gợi ý cắt thường chỉ lệch vài pixel; khi ảnh khó xử lý — nền lộn xộn, tài liệu chiếm trọn khung hình — công cụ nói rõ điều đó và cho bạn bắt đầu từ một điểm mặc định hợp lý. Sau đó bạn tự chỉnh các góc — một kính lúp đi theo ngón tay bạn để bạn đặt mỗi góc đúng vào mép giấy thật. Từ bốn góc đó, công cụ tính toán một phép biến đổi phối cảnh (cùng loại toán học mà các ứng dụng máy scan thật dùng) và chiếu lại trang giấy thành một hình chữ nhật gọn gàng. Bộ lọc Tài liệu so sánh từng pixel với vùng lân cận của nó, nên giấy trở nên trắng và chữ vẫn đậm ngay cả khi ánh sáng trên trang không đều. Cuối cùng, các trang được nhúng vào một PDF, được dựng hoàn toàn trong trình duyệt bằng một thư viện mã nguồn mở.
Để có một bản scan trông như đã scan
Phép biến đổi có thể sửa phối cảnh, nhưng không thể tạo ra chi tiết vốn không có trong ảnh. Ba thói quen tạo ra sự khác biệt: ánh sáng từ cửa sổ thay vì đèn trần (ít bóng hơn), điện thoại giữ phẳng ngay phía trên trang giấy thay vì nghiêng (ít méo hình cần sửa hơn), và một bề mặt tương phản dưới tờ giấy (một trang trắng trên bàn trắng không cho bộ dò cạnh gì để tìm — và bạn phải kéo góc nhiều hơn).
Công cụ này không làm gì
Nó không đọc văn bản. PDF bạn tải xuống là một chồng hình ảnh — hoàn hảo để in, gửi email, hoặc lưu trữ, nhưng bạn không thể tìm kiếm bên trong nó, điện thoại của bạn cũng không thể. Nó cũng không tổ chức bất cứ điều gì: trang 3 của hợp đồng thuê nhà sẽ nằm đúng nơi bạn đặt nó, trong thư mục Downloads của bạn. Nếu bạn muốn scan một lần rồi tìm mọi thứ bằng cách hỏi — "tiền đặt cọc là bao nhiêu?" — đó là việc của một kho tài liệu có OCR, chính là điều Paperlock được tạo ra để làm.