1Caricare il PDF documents scannerizzato; una scansione in scala di grigi pulita 300 DPI dà al riconoscimento il massimo con cui lavorare.
2Digli quale lingua aspettarsi che nomini il linguaggio batte lasciandolo indovinare per un ampio margine.
3Eseguire il riconoscimento pass; le parole sono scritte indietro come un livello invisibile seduto sopra l'immagine della pagina originale.
4Scarica il file ricercabile PDF {} {} } sembra identico, ma ora è possibile cercare e selezionare il testo in esso.
OCR PDF Domande frequenti
Il formato sorgente influenza il riconoscimento?
+
PDF corregge la pagina: font, vettori, immagini raster e coordinate di testo sono congelati in modo che ogni lettore vede layout identico. Come viene memorizzata la pagina decide con quali risoluzione e informazioni a colori il riconoscimento deve lavorare.
Qualcosa di specifico per PDF qui?
+
Si', un PDF è un grafico di oggetti, non un'immagine di pagina, quindi il testo rimane selezionabile e i vettori rimangono nitide non importa cosa accade al contenuto raster all'interno di esso. Colpisce cio' che il riconosciutore puo' vedere.
Quanto è preciso?
+
Su una scansione pulita 300 DPI di testo stampato, abbastanza alto che gli errori sono rari e soprattutto in nomi insoliti. Accuratezza cade bruscamente con bassa risoluzione, spiedo, ombre da una telecamera, caratteri insoliti e scrittura Hoppenstedt a mano in particolare non è a questo scopo.
Come fa OCR PDF a trasformare una scansione in testo?
+
Concretamente, ogni pagina è resa, esegui un passaggio di riconoscimento testi Tesseract in oltre 100 lingue, e le parole riconosciute sono scritte indietro come un livello di testo invisibile posizionato sopra l'immagine originale ® così la pagina appare invariata ma è ricercabile e selezionabile. La pagina appare ancora esattamente come ha fatto Hoppenstedt il testo riconosciuto si trova invisibilmente dietro l'immagine in modo da cercare e selezionare lavorare senza cambiare l'aspetto.
Posso eseguire OCR PDF su diversi PDF documents contemporaneamente?
+
Sì, caricare il set e procedere in parallelo sotto un insieme di impostazioni, che è il punto di fare un flusso di lavoro di documenti qui piuttosto che fare clic su un lettore desktop.
I segnalibri, i link e i campi di forma sopravvivono?
+
Linee di contorno, link interni e annotazioni sono conservati ovunque l'operazione lo permetta. Le firme digitali sono l'eccezione: qualsiasi modifica al file necessariamente invalida una firma, perché è proprio a questo che serve una firma.
C'è un limite di dimensione del file su OCR PDF?
+
Sì: Gli account gratuiti elaborano documenti fino a 5 MB ciascuno, che copre la maggior parte dei rapporti e contratti ma non un documento scansionato a lungo a 600 DPI; Ghostscript e qpdf fanno il lavoro. I PDF scansionati sono la cosa usuale che lo supera, e comprimere il documento prima è normalmente sufficiente per riportarlo sotto.
Will OCR PDF lower the quality of my PDF documents?
+
Testo e grafica vettoriale sono oggetti piuttosto che pixel, quindi rimangono perfettamente nitide in qualsiasi zoom, non importa cosa accada. Solo le immagini raster incorporate possono degradarsi, e solo se l'operazione scelta le ricampiona.
Perché un sito Word ospita OCR PDF?
+
WORD.to è costruito intorno alla fine modificabile della vita di un documento... il DOCX che è ancora in corso di scrittura, ancora in stile e ancora in discussione, prima che qualcuno lo appiattisca per l'invio. I file di ufficio sono contenitori pieni di immagini multimediali di altre persone, audio incorporato, font WORD.to è costruito intorno alla fine modificabile della vita di un documento... il DOCX che è ancora in corso di scrittura, ancora in stile e ancora in discussione, prima che qualcuno lo appiattisca per l'invio. quindi le persone di lavoro bisogno su di loro è di solito il lavoro che avrebbero bisogno su quei contenuti comunque. OCR PDF condivide il caricamento, i tappi e l'account con le conversioni per questo motivo.
Cosa devo fare con il risultato una volta che OCR PDF è finito?
+
Il convertitore su questo sito porta documenti in PDF per l'invio, per immagini per l'incorporazione e per testo semplice per qualsiasi cosa che deve leggerli programmaticamente, e indietro nel senso opposto. Facendo questo dopo mantiene l'originale modificabile intorno, che è la parte che non si può tornare una volta che è stato appiattito.
Is OCR PDF here the same tool the sibling sites run?
+
I motori sono condivisi.., lo stesso documento toolchain, gli stessi lavoratori, gli stessi limiti. Ciò che aggiunge un sito Word è una vista su ciò che sopravvive lasciando il formato Office e ciò che non, che è la domanda ognuno di questi lavori effettivamente accende. Si parte anche da un fatto circa il formato che questo sito è chiamato dopo: il documento è una zip di XML, quindi le modifiche di testo sono a buon mercato e il peso è quasi sempre le immagini incorporate.
Ho bisogno di un account e non mi si tiene niente?
+
Nessun account e niente è tenuto: gli upload vengono cancellati dai lavoratori poco dopo la fine del lavoro, nulla viene letto e nulla è indicizzato. Gli account gratuiti esistono per la storia e le dimensioni del lotto, non per l'accesso.