Gambar ke Teks (OCR)

OCR online gratis: ekstrak teks dari gambar, tangkapan layar, foto, dan PDF hasil pindaian dalam 24 bahasa. Berjalan di browser Anda, tanpa mengunggah file.

Anda juga bisa menyeret file ke sini atau menempelkan tangkapan layar dengan Ctrl+V (⌘+V di Mac). Teks dikenali oleh browser Anda. File tidak dikirim ke mana pun: tanpa unggahan, tanpa penyimpanan.
Setiap bahasa diunduh sekali (1 hingga 3 MB) lalu tetap tersimpan di browser Anda. Tambahkan bahasa Inggris sebagai bahasa kedua jika teks bercampur kata dalam huruf Latin.

Apa fungsinya


Alat ini menggunakan OCR (pengenalan karakter optik) untuk mengubah teks dalam gambar menjadi teks yang bisa disalin, diedit, dan dicari. Alat ini bekerja dengan tangkapan layar, foto dokumen, halaman hasil pindaian, dan PDF yang hanya berisi gambar. Pengenalan dilakukan oleh Tesseract, mesin OCR sumber terbuka, yang berjalan di browser Anda sendiri, sehingga file tidak pernah meninggalkan perangkat Anda. Teks kecil diperbesar otomatis sebelum dibaca, sehingga kesalahan berkurang secara nyata.

Cara memakainya


  1. Pilih satu atau beberapa gambar atau sebuah PDF, seret ke sini, atau tempelkan tangkapan layar.
  2. Periksa bahasa teks. Pembacaan dimulai otomatis; jika Anda mengganti bahasa, tekan Ekstrak teks lagi.
  3. Tinjau hasilnya, perbaiki bagian yang salah terbaca, lalu salin atau unduh sebagai file .txt.

Pertanyaan yang sering diajukan


Apakah gambar saya diunggah?
Tidak. Mesin pengenalan dan data bahasa diunduh ke browser Anda, dan gambar serta PDF diproses di sana. Tidak ada yang dikirim ke server, jadi aman digunakan untuk dokumen pribadi.

Seberapa akurat hasilnya?
Pada teks cetak yang jelas, bahasa berhuruf Latin biasanya benar lebih dari 99% karakter, dan aksara lain umumnya antara 93% dan 99%. Akurasi menurun pada foto buram, kontras rendah, halaman melengkung, font dekoratif, dan tulisan tangan. Untuk hasil terbaik, gunakan gambar yang tajam, terang, dan lurus, serta pilih bahasa yang tepat.

Bahasa apa saja yang didukung?
24 bahasa: Inggris, Portugis, Spanyol, Prancis, Jerman, Italia, Swedia, Afrikaans, Turki, Indonesia, Melayu, Filipino, Vietnam, Rusia, Arab, Urdu, Hindi, Tamil, Thai, Khmer, Jepang, Korea, serta Tionghoa Sederhana dan Tradisional. Anda bisa menggabungkan dua bahasa jika teks mencampurnya.

Bisakah membaca tulisan tangan?
Kurang baik. Mesin ini dilatih dengan teks cetak: huruf kapital yang rapi kadang berhasil, tetapi tulisan tangan bersambung biasanya terbaca salah.

Apakah bisa untuk PDF hasil pindaian?
Ya. Setiap halaman dirender dengan resolusi tinggi lalu dibaca bergiliran, dan Anda dapat menandai awal setiap halaman. Jika PDF sudah berisi teks yang bisa dipilih, alat PDF ke Teks lebih cepat dan tepat.

Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)