OCR PDF riconosce il testo dentro un documento scansionato e lo rende cercabile. Il PDF che ottieni si vede uguale a prima, ma sotto le immagini c'è il testo riconosciuto: puoi cercare una parola con la ricerca del lettore, copiarla e passarla a un altro strumento, per esempio a PDF in Word.
Il riconoscimento lo fa un motore OCR che gira sul nostro server, con le lingue che indichi tu: il valore predefinito è italiano e inglese. Va detto quello che cambia nel file: le pagine vengono rasterizzate a 300 DPI e il PDF finale è composto da quelle immagini con il testo sopra. Va benissimo per cercare, copiare e archiviare, ma se hai un originale digitale con il testo vero, quello resta migliore per la stampa. Su documenti lunghi l'operazione richiede tempo: calcola all'incirca qualche secondo per pagina.
Come si usa
- Carica il PDF scansionato (o il PDF costruito con Scansione in PDF).
- Scrivi le lingue nel campo apposito: "ita" per l'italiano, "ita+eng" per italiano e inglese insieme.
- Premi "Elabora" e aspetta: il motore fotografa le pagine a 300 DPI e riconosce il testo una per una.
- Scarica il PDF e prova a cercare una parola che sai esserci: se la trova, il riconoscimento è andato a buon fine.
Domande frequenti
Come scrivo le lingue?
Con i codici separati dal segno più: "ita" italiano, "eng" inglese, "ita+eng" tutte e due. Se il documento è in una sola lingua, indicarne una sola di solito dà un risultato più preciso.
Il riconoscimento è perfetto?
No. Su scansioni nitide e stampa normale va molto bene; su testi scritti a mano, sbiaditi o con caratteri strani sbaglia. Rileggi sempre i passaggi importanti: il testo riconosciuto è una comodità per la ricerca, non una copia ufficiale del documento.
Quanto tempo ci vuole?
Qualche secondo per pagina, perché ogni foglio viene convertito in immagine ad alta risoluzione e poi letto. Un documento di 50 pagine può richiedere qualche minuto: conviene lasciare la scheda aperta e non ricaricare la pagina.
Il mio documento ha più lingue: quale scelgo?
Indica tutte quelle presenti, per esempio "ita+eng". Più lingue insieme rendono il riconoscimento un po' meno preciso, ma è l'unico modo per non perdere le parti scritte nell'altra lingua.
Cosa succede al mio documento?
Il PDF si elabora sul nostro server e la cartella di lavoro viene cancellata subito dopo il download. Non conserviamo copie e non mandiamo nulla a servizi esterni: il riconoscimento avviene tutto qui.
PDF