Vad är OCR (Optical Character Recognition)?
När du skannar ett dokument med en skanner eller mobilapp är den resulterande PDF-filen i grunden ett fotografi. Datorn vet inte att bläcket bildar ord; den ser bara ett nät av färgade pixlar. Du kan inte markera, kopiera eller söka efter text i dokumentet.
Optisk teckenläsning (OCR) löser detta. OCR-algoritmen analyserar bilden, upptäcker kontrasten mellan bläck och papper och använder neurala nätverk för att känna igen teckenmönster. Den skapar sedan ett lager av digital text ovanpå bilden.