OCR PDF
Känn igen text i skannade dokument och bilder, direkt i din webbläsare.
Ladda upp
Välj din fil eller dra och släpp den.
Justera
Välj dina alternativ — allt sker i din webbläsare.
Ladda ner
Spara den färdiga filen direkt. Inga vattenstämplar.
En skannad PDF är egentligen bara en bunt fotografier. Du kan inte söka i den, kopiera ett stycke ur den eller klistra in ett referensnummer från den. PDFora:s OCR-verktyg läser texten inuti dessa sidbilder med Tesseract, samma öppna motor som används i seriösa dokumentflöden, och ger dig den igenkända texten som en ren .txt-fil du kan söka i, redigera och återanvända.
Det här är vad som gör vår OCR annorlunda: den körs helt och hållet inuti din webbläsare. Nästan alla OCR-tjänster på nätet laddar upp din skanning till en server för bearbetning. Vår gör det inte. Igenkänningen sker på din egen enhet, så ett skannat pass, ett undertecknat hyresavtal eller en sida med provsvar skickas aldrig någonstans. För sådana dokument är det ingen artighet — det är hela poängen.
Verktyget känner för närvarande igen engelska, hindi, spanska och franska, och du väljer språk innan du kör igenkänningen. Det är gratis utan registrering, utan vattenstämpel och utan sidkvot. Hastigheten beror på din enhet, eftersom det är din processor som gör det faktiska arbetet, men en vanlig sida tar bara några sekunder på en modern laptop.
Så kör du OCR på en PDF online
- Öppna verktyget OCR för PDF på PDFora i en modern webbläsare.
- Dra din skannade PDF till släppytan, eller klicka för att välja den från din enhet.
- Välj dokumentets språk: engelska, hindi, spanska eller franska. Rätt språk förbättrar träffsäkerheten dramatiskt.
- Klicka på Känn igen text och låt Tesseract bearbeta varje sida lokalt i din webbläsare.
- Följ förloppet allteftersom sidorna blir klara; längre dokument tar lite mer tid.
- Ladda ner den extraherade texten som en .txt-fil och sök, redigera eller kopiera fritt ur den.
When to use this tool
- Plocka ut texten ur en skannad domstolsdom på 60 sidor så att du kan söka efter en viss paragraf i stället för att läsa varje sida.
- Extrahera citat ur fotograferade läroboksuppslag till en forskningsuppsats, utan att skriva av dem för hand.
- Digitalisera en mapp med gamla pappersfakturor så att belopp och fakturanummer blir sökbara uppgifter.
- Omvandla ett skannat myndighetscirkulär på hindi till redigerbar text för översättning eller sammanfattning.
- Rädda texten i ett dokument där bara en utskrift överlevde, genom att skanna den och köra OCR.
- Göra mötesunderlag och tryckta rapporter citerbara i mejl genom att lyfta ut texten i stället för att ta skärmdumpar.
Tips for the best results
- Mata in den renaste skanning du har. 300 DPI, bra ljus och mörk text på ljus bakgrund ger långt bättre igenkänning än ett skumt mobilfoto.
- Räta upp skanningen först. Sneda sidor förvirrar teckenigenkänningen, så kör ett lutande dokument genom PDFora:s uträtningsverktyg före OCR.
- Låt språkinställningen matcha dokumentet. Att köra ett spanskt brev genom den engelska modellen ger förvridet resultat, och tvärtom.
- Räkna med långsammare körningar på telefoner och äldre datorer. Motorn använder din enhets processor, så en skanning på 100 sidor är ett jobb för en dator, inte för en fem år gammal surfplatta.
- Korrekturläs siffror. OCR är mycket bra men inte perfekt, och siffror i kontonummer eller summor förtjänar en manuell titt innan du litar på dem.
Vanliga frågor
Laddas mitt skannade dokument upp för bearbetning?
Nej, och det är ovanligt bland OCR-verktyg på nätet. Tesseract-motorn körs inuti din webbläsare, så varje sida känns igen på din egen enhet. Ingenting skickas till någon server vid något tillfälle, vilket gör det tryggt för ID-handlingar, avtal och journaler.
Vad får jag som resultat?
Verktyget extraherar den igenkända texten och ger dig den som en nedladdningsbar .txt-fil. Därifrån kan du söka i den, klistra in den i ett dokument eller mata in den i vilket annat arbetsflöde som helst som behöver ren text.
Vilka språk stöds?
Engelska, hindi, spanska och franska är tillgängliga just nu. Välj det språk som matchar ditt dokument innan du kör igenkänningen, eftersom motorn laddar en språkspecifik modell och träffsäkerheten beror på att du väljer rätt.
Hur träffsäker är textigenkänningen?
På en ren, välbelyst skanning av tryckt text är träffsäkerheten normalt mycket hög. Kvaliteten sjunker med suddiga foton, ovanliga typsnitt, handskrift eller kraftig lutning. Bättre indata är den enskilt viktigaste faktorn, så skanna om eller räta upp en dålig sida innan du skyller på motorn.
Varför är OCR långsammare på min enhet än på min kollegas?
Eftersom bearbetningen är lokal följer hastigheten din hårdvara. En ny laptop betar av sidor på några sekunder styck, medan en äldre telefon tar märkbart längre tid. Fördelen med den lokala bearbetningen är fullständig integritet.
Finns det någon gräns för sidor eller filer, och kostar det något?
Ingen kostnad, inget konto, ingen vattenstämpel och ingen sidkvot. Du kan köra OCR på ett helt arkiv av skanningar om du vill. Den enda praktiska begränsningen är tid, eftersom långa dokument tar längre att bearbeta på din egen maskin.