OCR PDF
Riconosci il testo di documenti scansionati e immagini, direttamente nel browser.
Carica
Seleziona il tuo file o trascinalo.
Regola
Scegli le tue opzioni — tutto avviene nel tuo browser.
Scarica
Salva subito il file finito. Nessuna filigrana.
Un PDF scansionato non è altro che una pila di fotografie. Non puoi cercarci dentro, non puoi copiarne un paragrafo, non puoi incollarne fuori un numero di protocollo. Lo strumento OCR di PDFora legge il testo contenuto in quelle immagini di pagina usando Tesseract, lo stesso motore open source impiegato nei flussi documentali professionali, e ti consegna il testo riconosciuto in un file .txt pulito che puoi cercare, modificare e riutilizzare.
Ecco cosa rende questo OCR diverso: gira interamente dentro il tuo browser. Quasi tutti i servizi OCR online caricano la scansione su un server per elaborarla. Il nostro no. Il riconoscimento avviene sul tuo dispositivo, quindi la scansione di un passaporto, un contratto di locazione firmato o una pagina di esami medici non viene mai trasmessa da nessuna parte. Per documenti come questi non è un dettaglio gradevole: è tutto il punto.
Al momento lo strumento riconosce inglese, hindi, spagnolo e francese, e la lingua va scelta prima di avviare la scansione. È gratuito, senza registrazione, senza filigrana e senza limiti di pagine. La velocità di riconoscimento dipende dal tuo dispositivo, dato che è il tuo processore a fare il lavoro vero e proprio, ma su un portatile recente una pagina tipica richiede solo pochi secondi.
Come fare l'OCR di un PDF online
- Apri lo strumento OCR PDF di PDFora in un browser moderno.
- Trascina il tuo PDF scansionato nell'area di rilascio, oppure fai clic per sceglierlo dal tuo dispositivo.
- Seleziona la lingua del documento: inglese, hindi, spagnolo o francese. La lingua giusta migliora notevolmente la precisione.
- Fai clic su Riconosci testo e lascia che Tesseract elabori ogni pagina in locale, nel tuo browser.
- Segui l'avanzamento man mano che le pagine vengono completate; i documenti più lunghi richiedono un po' più di tempo.
- Scarica il testo estratto come file .txt e cercalo, modificalo o copialo come preferisci.
When to use this tool
- Ricavare il testo da una sentenza scansionata di 60 pagine per poterci cercare dentro una clausola specifica, invece di leggerle tutte una per una.
- Estrarre citazioni dalle pagine fotografate di un manuale per una tesi o un articolo di ricerca, senza doverle ribattere a mano.
- Digitalizzare una cartella di vecchie fatture cartacee, così che importi e numeri di fattura diventino documenti ricercabili.
- Convertire una circolare governativa scansionata in hindi in testo modificabile, pronto per la traduzione o per una sintesi.
- Recuperare il testo di un documento di cui è sopravvissuta solo la stampa, scansionandola e passandola all'OCR.
- Rendere citabili nelle email i materiali distribuiti in riunione e i report cartacei, prelevandone il testo invece di fotografarli con uno screenshot.
Tips for the best results
- Dagli in pasto la scansione più pulita che hai. 300 DPI, buona illuminazione e testo scuro su fondo chiaro danno risultati molto migliori di una foto scattata al buio col telefono.
- Raddrizza prima la scansione. Le pagine storte mandano in confusione il riconoscimento dei caratteri: fai passare un documento inclinato attraverso lo strumento di raddrizzamento di PDFora prima dell'OCR.
- Fai corrispondere l'impostazione della lingua al documento. Passare una lettera in spagnolo attraverso il modello inglese produce un risultato pieno di errori, e viceversa.
- Aspettati tempi più lunghi su telefoni e portatili datati. Il motore usa il processore del tuo dispositivo, quindi una scansione da 100 pagine è un lavoro da computer fisso, non da tablet di cinque anni fa.
- Ricontrolla i numeri. L'OCR è molto bravo ma non è infallibile, e le cifre di numeri di conto o di totali meritano un'occhiata manuale prima di farci affidamento.
Domande frequenti
Il mio documento scansionato viene caricato online per l'elaborazione?
No, ed è una cosa rara tra gli strumenti OCR online. Il motore Tesseract gira dentro il tuo browser, quindi ogni pagina viene riconosciuta sul tuo dispositivo. Nulla viene inviato a un server in nessun momento, il che rende lo strumento sicuro per documenti d'identità, contratti e cartelle cliniche.
Che cosa ottengo come risultato?
Lo strumento estrae il testo riconosciuto e te lo consegna come file .txt scaricabile. Da lì puoi cercarci dentro, incollarlo in un documento o inserirlo in qualsiasi altro flusso di lavoro che abbia bisogno di testo semplice.
Quali lingue sono supportate?
Al momento sono disponibili inglese, hindi, spagnolo e francese. Scegli la lingua che corrisponde al tuo documento prima di avviare il riconoscimento, perché il motore carica un modello linguistico specifico e la precisione dipende dalla scelta giusta.
Quanto è accurato il riconoscimento del testo?
Su una scansione pulita e ben illuminata di testo stampato la precisione è di norma molto alta. Cala con foto sfocate, caratteri insoliti, scrittura a mano o forti inclinazioni. La qualità del materiale di partenza è la leva più importante: prima di dare la colpa al motore, riscansiona o raddrizza una pagina venuta male.
Perché l'OCR è più lento sul mio dispositivo che su quello di un collega?
Poiché l'elaborazione è locale, la velocità segue il tuo hardware. Un portatile recente macina le pagine in pochi secondi ciascuna, mentre un telefono più datato impiega sensibilmente di più. Il vantaggio di questa elaborazione locale è la privacy totale.
Ci sono limiti di pagine o di file, e ha un costo?
Nessun costo, nessun account, nessuna filigrana e nessun limite di pagine. Puoi passare all'OCR un archivio intero di scansioni, se vuoi. L'unico vincolo pratico è il tempo, dato che i documenti lunghi richiedono più elaborazione sulla tua macchina.