Apakah itu OCR (Optical Character Recognition)?
Apabila anda mengimbas dokumen menggunakan pengimbas atau aplikasi telefon pintar, PDF yang dihasilkan pada dasarnya ialah sebuah foto. Komputer anda tidak mengetahui bahawa dakwat pada halaman itu membentuk perkataan; ia hanya melihat grid piksel berwarna. Anda tidak boleh menyorot, menyalin atau mencari teks dalam dokumen ini.
Optical Character Recognition (OCR) menyelesaikan masalah ini. Algoritma OCR menganalisis imej, mengesan kontras antara dakwat dan kertas, dan menggunakan rangkaian saraf untuk megecam corak aksara. Ia kemudian menjana lapisan teks digital di atas imej.