1Upload de gescande PDF documents; een schone 300 dpi grijswaardenscan geeft de herkenner het meest om mee te werken.
2Vertel het welke taal te verwachten.. Het benoemen van de taal beter dan het laten raden door een brede marge.
3Voer de herkenningspas uit; de woorden worden teruggeschreven als een onzichtbare laag die over de oorspronkelijke pagina-afbeelding zit.
4Download het doorzoekbare PDF bestand. Het ziet er identiek uit, maar je kunt nu zoeken en de tekst erin selecteren.
OCR PDF Veelgestelde vragen
Heeft het bronformaat invloed op de herkenning?
+
Dat doet het. PDF herstelt de pagina: lettertypen, vectoren, rasterafbeeldingen en tekstcoördinaten worden bevroren zodat elke lezer dezelfde lay-out ziet. Hoe de pagina wordt opgeslagen bepaalt welke resolutie en kleurinformatie de herkenner moet gebruiken.
Iets specifieks voor PDF hier?
+
Ja. een PDF is een object grafiek, geen pagina afbeelding, dus tekst blijft selecteerbaar en vectoren blijven scherp, ongeacht wat er gebeurt met de raster inhoud erin. Het beïnvloedt wat de herkenner kan zien.
Hoe nauwkeurig is het?
+
Op een schone 300 DPI scan van gedrukte tekst, hoog genoeg dat fouten zeldzaam zijn en meestal in ongebruikelijke juiste zelfstandig naamwoorden. Nauwkeurigheid valt scherp af met lage resolutie, schuin, schaduwen van een telefooncamera, ongebruikelijke lettertypes en handschrift. handschrift in het bijzonder is niet waar dit voor is.
Hoe zet OCR PDF een scan om in tekst?
+
Concreet elke pagina wordt weergegeven, wordt uitgevoerd door een Tesseract tekstherkenningspas in meer dan 100 talen, en de herkende woorden worden teruggeschreven als een onzichtbare tekstlaag geplaatst over de oorspronkelijke afbeelding.. zodat de pagina er ongewijzigd uitziet, maar is doorzoekbaar en selecteerbaar. De pagina ziet er nog steeds precies uit zoals het deed.. De herkende tekst zit onzichtbaar achter de afbeelding dus zoeken en selectie werken zonder het uiterlijk te veranderen.
Kan ik OCR PDF op meerdere PDF documents tegelijk uitvoeren?
+
Ja. Upload de set en ze proces parallel onder een set van instellingen, dat is het punt van het doen van een document workflow hier in plaats van te klikken door een desktop lezer.
Overleven bladwijzers, links en vormvelden?
+
Uitlijningen, interne links en annotaties worden bewaard waar de operatie het toelaat. Digitale handtekeningen zijn de uitzondering: elke wijziging van het bestand maakt noodzakelijkerwijs een handtekening ongeldig, want dat is precies waar een handtekening voor is.
Is er een bestandsgroottelimiet op OCR PDF?
+
Ja: gratis accounts verwerken documenten tot 5 MB elk, die betrekking heeft op de meeste rapporten en contracten, maar niet een lang gescand document op 600 DPI; Ghostscript en qpdf doen het werk. Gescande PDF's zijn het gebruikelijke ding dat het overtreft, en het comprimeren van het document is normaal gesproken voldoende om het terug te brengen.
Zal OCR PDF de kwaliteit van mijn PDF documents verlagen?
+
Tekst en vectorkunst zijn objecten in plaats van pixels, dus ze blijven perfect scherp bij elke zoom, ongeacht wat er gebeurt. Alleen de ingebedde rasterafbeeldingen kunnen afbreken, en alleen als de operatie die je koos ze opnieuw neemt.
Waarom host een Word site OCR PDF?
+
WORD.to is gebouwd rond het bewerkbare einde van het leven van een document.. de DOCX die nog steeds wordt geschreven, nog steeds wordt gestyled en nog steeds wordt geruzied over, voordat iemand platst voor het verzenden. Office-bestanden zijn containers vol met andere mensen media.. beelden, ingebedde audio, lettertypen.. zodat het werk dat mensen nodig hebben op hen is meestal het werk dat ze nodig hebben op die inhoud toch. OCR PDF deelt de upload, de caps en de account met de conversies om die reden.
Wat moet ik doen met het resultaat als OCR PDF klaar is?
+
De converter op deze site neemt documenten naar PDF voor het verzenden, naar afbeeldingen voor inbedding en naar platte tekst voor alles dat ze programmatisch moet lezen, en terug de andere kant op. Dat doet het daarna bewerkbare origineel eromheen, wat het deel is dat je niet terug kunt krijgen als het eenmaal afgeplat is.
Is OCR PDF hier hetzelfde gereedschap als de broers en zussen?
+
De motoren worden gedeeld.. dezelfde document toolchain, dezelfde werknemers, dezelfde grenzen. Wat een Word site voegt is een kijk op wat overleeft het verlaten van het Office-formaat en wat niet, dat is de vraag elk van deze banen daadwerkelijk draait. Het begint ook met een feit over het formaat van deze site is vernoemd naar: het document is een zip van XML, dus tekstbewerkingen zijn goedkoop en het gewicht is bijna altijd de ingebedde afbeeldingen.
Heb ik een rekening nodig en wordt er iets gehouden?
+
Geen rekening, en er wordt niets bijgehouden: uploads worden verwijderd van de werknemers kort na het werk voltooid, niets wordt gelezen en niets is geïndexeerd. Gratis accounts bestaan voor geschiedenis en batch grootte, niet voor toegang.