PDF met OCR
Herken tekst in gescande documenten en afbeeldingen, rechtstreeks in je browser.
Uploaden
Kies je bestand of sleep het hierheen.
Instellen
Kies je opties — alles gebeurt in je browser.
Downloaden
Sla het klare bestand direct op. Geen watermerken.
Een gescande PDF is niet meer dan een stapel foto's. Je kunt er niet in zoeken, geen alinea uit kopiëren en geen referentienummer uit plakken. De OCR-tool van PDFora leest de tekst in die paginabeelden met Tesseract, dezelfde opensource-engine waar serieuze documentsystemen op vertrouwen, en geeft je de herkende tekst als een schoon .txt-bestand dat je kunt doorzoeken, bewerken en hergebruiken.
Wat deze OCR anders maakt: hij draait volledig in je browser. Bijna elke online OCR-dienst uploadt je scan naar een server om hem te verwerken. De onze niet. De herkenning gebeurt op je eigen apparaat, dus een gescand paspoort, een getekend huurcontract of een pagina met medische uitslagen wordt nergens naartoe verstuurd. Bij dat soort documenten is dat geen extraatje, dat is de hele bedoeling.
De tool herkent op dit moment Engels, Hindi, Spaans en Frans, en je kiest de taal voordat je de scan start. Hij is gratis, zonder registratie, zonder watermerk en zonder paginaquotum. Hoe snel de herkenning gaat, hangt af van je apparaat, want jouw processor doet het echte werk, maar een gemiddelde pagina kost op een moderne laptop maar een paar seconden.
Zo pas je OCR toe op een PDF online
- Open de tool OCR voor PDF op PDFora in een moderne browser.
- Sleep je gescande PDF naar het uploadvak, of klik om hem op je apparaat te kiezen.
- Kies de taal van het document: Engels, Hindi, Spaans of Frans. De juiste taal verbetert de nauwkeurigheid enorm.
- Klik op Tekst herkennen en laat Tesseract elke pagina lokaal in je browser verwerken.
- Volg de voortgang terwijl pagina's klaar zijn; langere documenten kosten wat meer tijd.
- Download de opgehaalde tekst als .txt-bestand en zoek, bewerk of kopieer er naar hartenlust uit.
When to use this tool
- De tekst uit een gescand vonnis van 60 pagina's halen zodat je op een specifieke bepaling kunt zoeken in plaats van alles door te lezen.
- Citaten uit gefotografeerde studieboekpagina's overnemen voor een scriptie, zonder ze met de hand over te typen.
- Een map met oude papieren facturen digitaliseren zodat bedragen en factuurnummers doorzoekbare gegevens worden.
- Een gescande Hindi-overheidscirculaire omzetten in bewerkbare tekst om te vertalen of samen te vatten.
- De tekst van een document terughalen waarvan alleen een uitdraai bewaard is gebleven, door het te scannen en er OCR op los te laten.
- Vergaderstukken en gedrukte rapporten citeerbaar maken in e-mails door de tekst eruit te lichten in plaats van er schermafbeeldingen van te maken.
Tips for the best results
- Gebruik de schoonste scan die je hebt. 300 DPI, goed licht en donkere tekst op een lichte ondergrond leveren veel betere herkenning op dan een schemerige telefoonfoto.
- Zet de scan eerst recht. Scheve pagina's brengen de tekenherkenning in de war, dus haal een gekanteld document eerst door de rechtzettool van PDFora.
- Stem de taalinstelling af op het document. Een Spaanse brief door het Engelse model halen levert onzin op, en andersom net zo goed.
- Reken op tragere runs op telefoons en oudere laptops. De engine gebruikt de processor van je apparaat, dus een scan van 100 pagina's is een klus voor een desktop, niet voor een vijf jaar oude tablet.
- Controleer cijfers na. OCR is erg goed maar niet perfect, en cijfers in rekeningnummers of totalen verdienen een blik voordat je erop vertrouwt.
Veelgestelde vragen
Wordt mijn gescande document geüpload om verwerkt te worden?
Nee, en dat is zeldzaam onder online OCR-tools. De Tesseract-engine draait in je browser, dus elke pagina wordt op je eigen apparaat herkend. Er gaat op geen enkel moment iets naar een server, waardoor de tool veilig is voor identiteitsbewijzen, contracten en medische dossiers.
Wat krijg ik als resultaat?
De tool haalt de herkende tekst eruit en geeft die aan je als een te downloaden .txt-bestand. Daarna kun je erin zoeken, hem in een document plakken of hem doorgeven aan elke andere workflow die platte tekst nodig heeft.
Welke talen worden ondersteund?
Op dit moment Engels, Hindi, Spaans en Frans. Kies de taal die bij je document past voordat je de herkenning start, want de engine laadt een taalspecifiek model en de nauwkeurigheid hangt af van de juiste keuze.
Hoe nauwkeurig is de tekstherkenning?
Bij een schone, goed belichte scan van gedrukte tekst is de nauwkeurigheid doorgaans zeer hoog. De kwaliteit zakt bij wazige foto's, ongebruikelijke lettertypen, handschrift of flinke scheefstand. Betere invoer is verreweg de grootste winst, dus scan een slechte pagina opnieuw of zet hem recht voordat je de engine de schuld geeft.
Waarom is OCR op mijn apparaat trager dan bij mijn collega?
Omdat de verwerking lokaal is, volgt de snelheid je hardware. Een recente laptop werkt pagina's in seconden weg, terwijl een oudere telefoon merkbaar langer doet. Het voordeel van die lokale verwerking is volledige privacy.
Zit er een limiet op pagina's of bestanden, en kost het iets?
Geen kosten, geen account, geen watermerk en geen paginaquotum. Je mag desnoods een heel archief aan scans door OCR halen. De enige praktische beperking is tijd, want lange documenten kosten op je eigen machine nu eenmaal langer.