Langsung ke konten

Ubah foto halaman menjadi hasil scan

Foto dokumen biasanya abu-abu, terkena cahaya dari satu sisi, dan sedikit miring. Alat ini meluruskannya, meratakan pencahayaan agar kertasnya putih, dan menyimpannya sebagai PDF — bisa juga dengan teks di baliknya agar hasil scan bisa dicari.

  • Tidak pernah disimpan
  • Tanpa antre, tanpa menunggu
  • Tanpa daftar, tanpa watermark

Cara kerjanya

1

Tambahkan foto Anda

Satu halaman atau banyak — semuanya menjadi halaman dalam satu PDF, sesuai urutan Anda menambahkannya.

2

Lihat proses perapiannya

Kemiringan diukur dan dihilangkan, dan kertas di balik tinta diperkirakan lalu dicerahkan menjadi putih, dan itulah yang membuat foto berhenti terlihat seperti foto.

3

Unduh PDF-nya

Minta lapisan teks, maka kata-katanya dibaca dan diletakkan tak terlihat di atas halaman, sehingga hasil scan bisa dicari dan disalin.

Mengubah foto menjadi sesuatu yang terbaca sebagai dokumen

Foto halaman dan hasil scan halaman berbeda dalam tiga hal, dan dua di antaranya diperbaiki di sini. Halaman diluruskan — lembar yang masuk dalam posisi miring, atau difoto sedikit berputar, dibuat lurus — dan ditegakkan, sehingga halaman yang tertangkap menyamping keluar dengan posisi benar. Keduanya memang diperlukan untuk pembacaan, itu sebabnya keduanya didapat gratis. Kontras dinaikkan agar kertas terbaca sebagai putih dan tinta sebagai hitam, bukan sebagai foto dokumen yang abu-abu.

Perbedaan ketiga tidak diperbaiki, dan itulah yang perlu diantisipasi. Perspektif tidak dikoreksi: halaman yang difoto dari sudut miring tetap berbentuk trapesium, lebih sempit di tepi yang jauh, dan hanya rotasinya yang diluruskan. Halaman dengan lipatan tebal, atau yang melengkung ke punggung buku tebal, tetap melengkung. Keduanya membuat teks lebih sulit dibaca sekaligus lebih jelek — jadi hal paling berguna yang bisa Anda lakukan adalah memegang kamera tepat di atas halaman, bukan mencondongkan badan di atasnya.

Meminta lapisan teks memberi Anda PDF yang terlihat persis seperti fotonya dan berperilaku seperti dokumen: kata-kata yang dikenali diletakkan tak terlihat di atas kata-kata di gambar, sehingga file bisa dicari, diseleksi, dan disalin sambil tetap menjadi gambar dari dokumen aslinya. Tidak ada yang diketik ulang, dan tampilannya tidak berubah — itulah yang Anda inginkan untuk struk, kontrak, atau apa pun yang tampilan aslinya menjadi bagian dari catatan.

Akurasi mengikuti kualitas pengambilan gambar, dan perbedaannya tidak tipis. Rata, pencahayaan merata, fokus, dan lurus menghadap kamera terbaca dengan baik; bayangan kepala Anda sendiri di halaman, flash ponsel yang memantul dari kertas mengilap, atau struk yang kusut tidak. Kata dalam bahasa Mandarin, Jepang, dan Korea dikenali tetapi hanya dihitung, tidak ditulis ke lapisan teks, karena tidak ada font yang mampu memuatnya yang disertakan — Anda diberi tahu berapa jumlahnya, alih-alih dibiarkan dengan bagian kosong yang mungkin tidak Anda sadari.

Jika Anda butuh hal lain

Ponsel Anda hampir pasti sudah punya fitur ini, dan lebih baik. Aplikasi Notes di iOS dan Google Drive di Android sama-sama memindai dokumen dengan koreksi perspektif langsung — keduanya menemukan tepi halaman saat Anda memegang kamera dan meratakan trapesiumnya dengan benar, tepat langkah yang tidak ada di sini. Untuk memotret halaman, pakai salah satunya dan bawa hasilnya ke tempat lain jika Anda perlu mengolahnya.

Untuk setumpuk halaman, OCRmyPDF adalah alat yang tepat dan gratis: ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdf melakukan pelurusan, rotasi, perapian, dan lapisan teks dalam satu proses untuk dokumen sepanjang apa pun, dan --output-type pdfa sekaligus menjadikannya format arsip. unpaper menangani perapian scan yang lebih sulit — menghapus bingkai gelap dari hasil scan buku, memisahkan halaman ganda — yang tidak dicoba sama sekali di sini.

Pertanyaan yang sering diajukan

Apa yang sebenarnya diubah?

Tiga hal. Kemiringan: sudut teks diukur di seluruh halaman lalu dihilangkan, sehingga barisnya lurus. Pencahayaan: kecerahan kertas di balik tinta diperkirakan per bagian lalu dicerahkan menjadi putih yang merata, menghilangkan bagian yang makin gelap ke satu tepi dan bayangan tangan Anda. Dan kontras: tinta digelapkan terhadap putih itu. Yang tidak dilakukannya adalah menciptakan sesuatu — tidak ada detail yang dimunculkan lewat penajaman.

Bisakah hasil scan dibuat bisa dicari?

Bisa. Aktifkan lapisan teks, maka setiap kata dibaca dan diletakkan tak terlihat di atas gambar di posisinya, sehingga Ctrl+F bisa menemukannya dan Anda bisa menyeleksi serta menyalin dari PDF. Halamannya tetap terlihat persis seperti fotonya; teksnya tidak pernah digambar, hanya dibuat bisa diseleksi.

Apakah foto saya disimpan di suatu tempat?

Tidak. Perapian dan pembacaan sama-sama terjadi di sini, dan tidak ada yang disimpan. Tidak ada yang dikirim ke mana pun.

Apakah saya perlu memotong ke halamannya dulu?

Itu membantu. Perkiraan kertas bekerja paling baik jika sebagian besar bingkai berisi kertas, jadi foto dengan meja gelap di sekeliling tepinya hasilnya lebih baik jika dipotong dulu. Pengukuran kemiringan sengaja mengabaikan margin luar, jadi sedikit latar belakang tidak masalah.

Apakah foto yang diambil miring bisa diperbaiki?

Rotasinya dihilangkan — halaman yang miring beberapa derajat diluruskan. Perspektifnya tidak dikoreksi, jadi halaman yang difoto dari samping, dengan satu tepi lebih panjang dari yang lain, tetap berbentuk seperti itu. Memotret tepat dari atas sepadan dengan satu detik tambahan.

Berwarna atau hitam putih?

Warna dipertahankan, dengan kertas di belakangnya diputihkan — sehingga stempel, tanda tangan bertinta biru, atau baris yang distabilo tetap berwarna seperti aslinya. Itu biasanya yang Anda inginkan dari dokumen; hasilnya bukan faks hitam putih.

Seberapa besar ukuran PDF-nya?

Setiap halaman disimpan sebagai JPEG berukuran untuk dibaca, bukan dalam resolusi penuh kamera, jadi foto ponsel yang tadinya 4 MB biasanya menjadi di bawah 1 MB per halaman tanpa penurunan yang terlihat pada 100%.

Perlu diketahui: Perspektif tidak dikoreksi: halaman yang difoto dari sudut miring tetap berbentuk trapesium, dan hanya rotasinya yang diperbaiki. Halaman dengan lipatan tebal atau lengkungan kuat di dekat punggung buku tetap melengkung. Lapisan teks, jika Anda memintanya, punya catatan yang sama seperti OCR mana pun — dan kata dalam bahasa Mandarin, Jepang, dan Korea hanya dihitung, tidak ditulis, karena tidak ada font untuknya yang disertakan.

Pasang alat ini di situs Anda

Gratis untuk blog, halaman kelas, atau artikel bantuan apa pun. Tempel satu potong kode dan pengunjung Anda bisa langsung memakainya di halaman Anda.