Ambil teks dari gambar
Baca tulisan dari foto, hasil scan, atau screenshot, lalu bawa sebagai teks yang bisa Anda edit, cari, dan tempel. Gambarnya tidak pernah disimpan.
- Tidak pernah disimpan
- Tanpa antre, tanpa menunggu
- Tanpa daftar, tanpa watermark
Cara kerjanya
Tambahkan gambar Anda
JPG, PNG, WebP, GIF, BMP, HEIC dari iPhone, atau TIFF dari scanner. Foto yang diambil miring diluruskan dan pencahayaannya diratakan sebelum dibaca.
Periksa bahasanya
Aksara dibaca dari gambar dan bahasanya dipilihkan untuk Anda. Tersedia lebih dari 120 bahasa jika tebakannya salah, atau jika gambar berisi lebih dari satu bahasa.
Salin atau unduh
Pertahankan tata letak, dengan baris dan kolom di posisi semula, atau gabungkan baris menjadi paragraf mengalir yang siap ditempel di tempat lain.
Bagaimana gambar dibaca
Ukuran yang diinginkan pembaca diukur dari tintanya, bukan dari file-nya. Tinggi satu baris teks diperkirakan dari gambar itu sendiri, lalu semuanya diskalakan ulang agar satu baris jatuh di sekitar tiga puluh empat piksel — screenshot kecil diperbesar hingga empat kali lipat, dan foto yang sangat besar diperkecil, dengan sisi terpanjang dibatasi di kedua arah. Itu sebabnya foto menu sembilan megapiksel tidak lebih akurat daripada foto kecil yang tajam, dan mengapa gambar di bawah sekitar tiga ratus piksel pada sisi terpendeknya melewatkan deteksi bahasa sepenuhnya dan dibaca sebagai aksara Latin. Sebelum semua itu, kertas di balik tinta diperkirakan per bagian lalu dinetralkan untuk meratakan pencahayaan, kemiringan halaman diukur di sepanjang tingginya lalu diputar lurus, dan hasilnya diubah menjadi hitam-putih dengan satu ambang global.
Memilih bahasa adalah sebuah audisi, bukan pencarian di tabel, karena detektor yang biasa dipakai sebenarnya tidak mendeteksi bahasa. Tahap pertama hanya melaporkan aksara dan rotasinya, tidak lebih; aksara mempersempit pilihan, pengaturan bahasa browser Anda menjadi penentu di antara bahasa yang memakai aksara yang sama, lalu setiap kandidat benar-benar dipakai untuk membaca salinan gambar yang diperkecil dan dinilai dari berapa banyak kata yakin yang dihasilkannya. Pemenangnya membaca halaman sesungguhnya, dan teks yang dikenali diperiksa lagi — diakritik, pasangan huruf khas, kata pendek yang umum — untuk melihat apakah bahasa lain akan lebih baik. Inilah mekanisme di balik “salah menyebut bahasa menghasilkan halaman kosong yang meyakinkan”: audisi ini ada justru agar tebakannya diuji terhadap gambar Anda, bukan sekadar dinyatakan.
Ada satu hal yang perlu diketahui tentang apa yang sampai ke hasil. Paragraf yang tidak diyakini pembaca dibuang, bukan ditampilkan, sehingga teks yang Anda lihat di gambar bisa hilang sama sekali dari hasil, bukan muncul sebagai teks acak. Hal yang sama berlaku untuk blok yang digolongkan pembaca sebagai gambar atau noise, dan untuk tanda terpisah yang tidak berisi huruf atau angka. Tidak ada penyaringan untuk kata biasa yang tingkat keyakinannya rendah, jadi salah baca di dalam paragraf tetap lolos dan menjadi tugas Anda untuk menemukannya. Jika angka keyakinannya lumayan tetapi sebagian halaman begitu saja tidak ada, itulah yang terjadi.
Jika Anda butuh hal lain
Tidak ada yang disimpan, tetapi inilah satu-satunya alat di situs ini yang penggunaan pertamanya tidak cuma-cuma: pembacanya sendiri berukuran beberapa megabyte dan setiap paket bahasa satu hingga lima megabyte lagi, diambil dari situs ini lalu disimpan untuk penggunaan berikutnya. Satu halaman sepadan dengan penantiannya, dua ribu hasil scan terjadwal tidak — itu tugas alat OCR desktop seperti OCRmyPDF, yang menambahkan lapisan teks ke satu folder penuh dengan satu perintah, tanpa unduhan dan tanpa klik.
Tiga hal memang tidak dicoba di sini, dan mengetahuinya lebih cepat daripada menemukannya sendiri. Perspektif tidak dikoreksi — rotasi halaman diukur dan diluruskan, tetapi foto yang diambil dari samping tetap berbentuk trapesium, jadi memotret tepat dari atas sepadan dengan satu detik tambahan. Ambang yang memisahkan tinta dari kertas adalah satu nilai untuk seluruh gambar, bukan per area, sehingga halaman yang separuhnya terkena bayangan akan kehilangan bagian yang gelap meski pencahayaannya sudah diratakan; potret ulang dengan cahaya merata alih-alih melawannya. Dan tabel yang disusun dengan spasi, bukan garis, tidak punya garis untuk ditemukan, sehingga dibaca sebagai kolom teks dan hanya kebetulan jika tetap rapi saat ditempel ke spreadsheet.
Pertanyaan yang sering diajukan
Seberapa akurat hasilnya?
Untuk teks cetak yang jelas, difoto lurus dan fokus, sangat akurat — hanya beberapa karakter dari seribu. Akurasi menurun karena blur, silau, kontras rendah, dan jenis huruf yang tidak lazim, dan halaman ini menunjukkan seberapa yakin pembacanya alih-alih membiarkan Anda menebak. Jika angkanya rendah, biasanya masalahnya ada di gambar: lebih banyak cahaya, sudut lebih lurus, dan teks yang memenuhi bingkai sudah mengatasi sebagian besarnya.
Apakah gambar saya disimpan di suatu tempat?
Tidak. Paket bahasa diambil dari situs ini saat pertama kali Anda memakai suatu bahasa; gambarnya sendiri tidak pernah disimpan dan tidak pernah dikirim ke mana pun, jadi alat ini tetap berfungsi saat Wi-Fi mati.
Bahasa apa saja yang bisa dibaca?
Lebih dari 120, termasuk Inggris, Bengali, Hindi, Urdu, Arab, Spanyol, Prancis, Jerman, Portugis, Rusia, Mandarin, Jepang, dan Korea. Aksara dibaca dari gambarnya sendiri; jika beberapa bahasa memakai aksara yang sama — Latin, Sirilik, Arab, Dewanagari — pengaturan bahasa browser Anda yang menentukan, dan Anda selalu bisa mengubahnya.
Apakah kolom dan tabel tetap dipertahankan?
Ya, jika Anda memintanya. Tabel bergaris ditemukan dan dibaca sel demi sel, sehingga label tidak menyatu dengan nilainya, dan hasilnya berupa baris yang dipisahkan tab yang bisa langsung ditempel ke spreadsheet. Kolom teks dibaca sesuai urutan baca, bukan lurus menyeberang. Memilih untuk menggabungkan baris justru sengaja membuang struktur itu, dan memang itulah yang Anda inginkan untuk paragraf yang akan ditata ulang.
Bisakah membaca tulisan tangan?
Huruf cetak tulisan tangan yang rapi dan terpisah — huruf kapital di formulir — sering berhasil. Tulisan tangan bersambung tidak, baik di sini maupun di alat OCR umum lainnya; jawaban jujurnya, itu masalah yang berbeda dan membutuhkan pendekatan berbeda. Ada halaman terpisah untuk tulisan tangan yang menyatakannya dengan terus terang dan menunjukkan apa yang berhasil dibacanya.
Format gambar apa saja yang didukung?
JPG, PNG, WebP, GIF, BMP, dan SVG melalui browser itu sendiri, plus HEIC dari iPhone dan TIFF dari scanner. Foto portrait dari ponsel keluar dengan posisi tegak yang benar, karena penanda orientasi yang ditulis kamera diterapkan terlebih dahulu.
Mengapa ada kata yang salah terbaca?
Hampir selalu karena gambarnya, bukan teksnya: silau di halaman, bayangan tangan Anda, kamera goyang, atau teks yang begitu kecil di layar sehingga tiap huruf hanya beberapa piksel. Pembaca menerima gambar yang diskalakan ke ukuran paling baik untuk dibaca, dan pencahayaannya diratakan terlebih dahulu, tetapi pengolahan sebanyak apa pun tidak bisa menciptakan detail yang tidak tertangkap kamera.
Apakah ada batas ukuran?
Hanya memori perangkat Anda sendiri. Tidak ada yang disimpan, jadi tidak ada batas server yang bisa terlampaui. Foto yang sangat besar diperkecil ke ukuran yang bisa dimanfaatkan pembaca — melewati titik tertentu, piksel tambahan hanya menambah beban tanpa menambah akurasi.
Perlu diketahui: Tulisan tangan bersambung tidak bisa dikenali dengan andal oleh alat OCR umum mana pun, termasuk alat ini. Teks yang tercetak di atas gambar, huruf yang sangat bergaya, dan kontras yang sangat rendah akan menghasilkan teks yang tidak lengkap. Hasilnya berupa teks biasa: jenis huruf, warna, tebal, dan miring tidak ikut terbawa, begitu pula gambarnya sendiri.
Pasang alat ini di situs Anda
Gratis untuk blog, halaman kelas, atau artikel bantuan apa pun. Tempel satu potong kode dan pengunjung Anda bisa langsung memakainya di halaman Anda.
Alat terkait
Screenshot ke Teks
Tempel screenshot, dapatkan teksnya
Scan Dokumen
Foto halaman, dirapikan seperti hasil scan
OCR PDF
Buat hasil scan bisa dicari
Tulisan Tangan ke Teks
Huruf cetak tulisan tangan, dibaca apa adanya
Scan QR Code dari Gambar
Lihat isi QR code sebelum Anda membukanya
Scan Barcode dari Gambar
Angka dari barcode, sudah diperiksa