PDFora
Pricing Alle værktøjer
👁️

OCR PDF

Genkend tekst i scannede dokumenter og billeder — direkte i din browser.

🔒 Dine filer behandles lokalt i din browser og uploades aldrig.
1

Upload

Vælg din fil, eller træk og slip den.

2

Tilpas

Vælg dine indstillinger — alt sker i din browser.

3

Download

Gem den færdige fil med det samme. Ingen vandmærker.

En scannet PDF er reelt bare en stak fotografier. Du kan hverken søge i den, kopiere et afsnit fra den eller hive et referencenummer ud af den. PDFora's OCR-værktøj læser teksten inde i de sidebilleder ved hjælp af Tesseract, den samme open source-motor, som bruges i seriøse dokumentsystemer, og giver dig den genkendte tekst som en ren .txt-fil, du kan søge i, redigere og genbruge.

Det er dette, der gør denne OCR anderledes: den kører udelukkende inde i din browser. Næsten alle online OCR-tjenester uploader din scanning til en server til behandling. Det gør vores ikke. Genkendelsen sker på din egen enhed, så et scannet pas, en underskrevet lejekontrakt eller en side med prøvesvar bliver aldrig sendt nogen steder hen. Ved den slags dokumenter er det ikke en pæn detalje, det er hele pointen.

Værktøjet genkender i øjeblikket engelsk, hindi, spansk og fransk, og du vælger sproget, inden du sætter scanningen i gang. Det er gratis uden oprettelse, uden vandmærke og uden sidekvote. Hastigheden afhænger af din enhed, eftersom det er din processor, der udfører det egentlige arbejde, men en typisk side tager kun nogle få sekunder på en moderne bærbar.

Sådan kører du OCR på en PDF online

  1. Åbn værktøjet OCR PDF på PDFora i en moderne browser.
  2. Træk din scannede PDF ind i feltet, eller klik for at vælge den på din enhed.
  3. Vælg dokumentets sprog: engelsk, hindi, spansk eller fransk. Det rigtige sprog forbedrer præcisionen dramatisk.
  4. Klik på Genkend tekst, og lad Tesseract behandle hver side lokalt i din browser.
  5. Følg med i forløbet, efterhånden som siderne bliver færdige; længere dokumenter tager lidt mere tid.
  6. Hent den udtrukne tekst som en .txt-fil, og søg, redigér eller kopiér frit fra den.

When to use this tool

  • Udtræk af teksten fra en scannet domsudskrift på 60 sider, så du kan søge efter en bestemt passage i stedet for at læse hver eneste side.
  • Hentning af citater fra fotograferede lærebogssider til en opgave, uden at skulle taste dem ind i hånden.
  • Digitalisering af en mappe med gamle papirfakturaer, så beløb og fakturanumre bliver til søgbare data.
  • Konvertering af et scannet officielt cirkulære på hindi til redigerbar tekst til oversættelse eller opsummering.
  • Genskabelse af teksten i et dokument, hvor kun en udskrift overlevede, ved at scanne den og køre OCR.
  • At gøre mødemateriale og trykte rapporter citerbare i mails ved at hive teksten ud i stedet for at tage skærmbilleder.

Tips for the best results

  • Giv den den reneste scanning, du har. 300 DPI, godt lys og mørk tekst på lys baggrund giver langt bedre genkendelse end et halvmørkt mobilfoto.
  • Ret scanningen op først. Skæve sider forvirrer tegngenkendelsen, så kør et hældende dokument gennem PDFora's værktøj til at rette skævhed inden OCR.
  • Få sprogindstillingen til at passe til dokumentet. Kører du et spansk brev gennem den engelske model, kommer der volapyk ud, og omvendt.
  • Regn med langsommere kørsler på telefoner og ældre bærbare. Motoren bruger din enheds processor, så en scanning på 100 sider er en opgave for en computer og ikke for en fem år gammel tablet.
  • Læs tallene efter. OCR er meget dygtig, men ikke perfekt, og cifre i kontonumre eller totaler fortjener et manuelt blik, inden du lægger noget til grund for dem.

Ofte stillede spørgsmål

Bliver mit scannede dokument uploadet til behandling?

Nej, og det er sjældent blandt online OCR-værktøjer. Tesseract-motoren kører inde i din browser, så hver eneste side genkendes på din egen enhed. Intet sendes til en server på noget tidspunkt, hvilket gør det trygt til ID-dokumenter, kontrakter og journaler.

Hvad får jeg som resultat?

Værktøjet udtrækker den genkendte tekst og giver dig den som en .txt-fil, du kan hente. Derfra kan du søge i den, indsætte den i et dokument eller føre den videre til enhver anden arbejdsgang, der har brug for ren tekst.

Hvilke sprog understøttes?

Engelsk, hindi, spansk og fransk er tilgængelige lige nu. Vælg det sprog, der passer til dit dokument, inden du starter genkendelsen, for motoren indlæser en sprogspecifik model, og præcisionen afhænger af, at du rammer det rigtige.

Hvor præcis er tekstgenkendelsen?

På en ren, veloplyst scanning af trykt tekst er præcisionen typisk meget høj. Kvaliteten falder ved slørede fotos, usædvanlige skrifttyper, håndskrift eller kraftig hældning. Bedre input er den enkeltfaktor, der batter mest, så scan en dårlig side om eller ret den op, inden du giver motoren skylden.

Hvorfor er OCR langsommere på min enhed end på min kollegas?

Fordi behandlingen er lokal, følger hastigheden dit udstyr. En nyere bærbar tygger sig gennem siderne på sekunder stykket, mens en ældre telefon tager mærkbart længere tid. Gevinsten ved netop den lokale behandling er fuldstændig privatliv.

Er der en grænse for sider eller filer, og koster det noget?

Ingen betaling, ingen konto, intet vandmærke og ingen sidekvote. Du kan køre OCR på et helt arkiv af scanninger, hvis du vil. Den eneste reelle begrænsning er tid, eftersom lange dokumenter tager længere at behandle på din egen maskine.