1வருடப்பட்ட PDF documents ஐ ஏற்றவும்; ஒரு சுத்தமான 300 DPI சாம்பல் நிற வருடல், அடையாளம் காணும் கருவிக்கு அதிக வேலையை தரும்.
2எந்த மொழியை எதிர்பார்க்க வேண்டும் என்று கூறுங்கள் - மொழியை பெயர்ப்பது, ஒரு பெரிய வரம்பு மூலம் யூகிக்க அனுமதிக்கிறது.
3அறிதல் கடத்தலை இயக்கு; வார்த்தைகள் ஒரு காணாத அடுக்கு போல திரும்ப எழுதப்படும், இது உண்மையான பக்க பிம்பத்தின் மேல் இருக்கும்.
4தேடக்கூடிய PDF கோப்பினை பதிவிறக்கவும் - இது ஒரே மாதிரியாக உள்ளது, ஆனால் நீங்கள் இப்போது தேடலாம் மற்றும் அதில் உள்ள உரை தேர்ந்தெடுக்கலாம்.
PDF OCR அடிக்கடி கேட்கப்படும் கேள்விகள்
மூல வடிவம் அடையாளம் காணலை பாதிக்குமா?
+
அது செய்கிறது. PDF பக்கத்தை சரிசெய்கிறது: எழுத்துருக்கள், வெக்டர், ரஸ்டர் பிம்பங்கள் மற்றும் உரை ஒருங்கிணைப்புகள் அனைத்தும் முடக்கப்பட்டுள்ளன, எனவே ஒவ்வொரு வாசகனும் ஒரே மாதிரியான உருவரைகளைக் காண்கிறார். பக்கம் சேமிக்கப்படுவது எப்படி என்பது எந்த திரைதள மற்றும் வண்ண தகவல்களை அடையாளம் காணும் கருவி பயன்படுத்த வேண்டும் என்பதை தீர்மானிக்கும்.
PDF இங்கே குறிப்பிட்ட ஏதாவது?
+
ஆம் - PDF என்பது பொருள் வரைபடம், பக்க பிம்பம் அல்ல, எனவே உரை தேர்ந்தெடுக்கக்கூடியதாகவும் வெக்டர்கள் தெளிவாகவும் இருக்கும், அதில் உள்ள ராஸ்டர் உள்ளடக்கத்திற்கு என்ன நடக்கிறது என்பதை பொருட்படுத்தாமல். இது அறியக்கூடியவைகளை பாதிக்கிறது.
அது எப்படி சரியானது?
+
அச்சிடப்பட்ட உரைகளின் சுத்தமான 300 DPI வருடலில், தவறுகள் மிகவும் குறைவாக இருக்கும் மற்றும் பெரும்பாலும் வழக்கத்திற்கு மாறான சொற்களில் தவறுகள் இருக்கும். குறைந்த தெளிவுத்திறன், ஈர்ப்பு, தொலைபேசி கேமராவில் இருந்து நிழல்கள், வழக்கத்திற்கு மாறான எழுத்துருக்கள் மற்றும் கை எழுத்து ஆகியவற்றின் மூலம் துல்லியமானது மிகவும் குறைகிறது - கை எழுத்து குறிப்பாக இது பயன்படுத்தப்படுவதில்லை.
OCR PDF எப்படி ஒரு வருடியை உரைகளாக மாற்றுகிறது?
+
குறிப்பாக, ஒவ்வொரு பக்கமும் 100 மொழிகளுக்கும் மேலாக டெஸ்ஸரக்ட் உரை- அறிதல் வழியாக இயங்குகிறது, மற்றும் அறியப்பட்ட வார்த்தைகள் ஒரு காணப்படாத உரை அடுக்காக திரும்ப எழுதப்படுகிறது, இது உண்மையான பிம்பத்தின் மேல் அமைக்கப்பட்டுள்ளது - எனவே பக்கம் மாற்றப்படாதது ஆனால் தேடக்கூடியது மற்றும் தேர்ந்தெடுக்கக்கூடியது. பக்கம் அது இருந்த மாதிரியே உள்ளது - உரை பிம்பத்திற்கு பின்னால் தெரியாமல் உள்ளது, எனவே தேடுதல் மற்றும் தேர்வு செய்வது தோற்றத்தை மாற்றாமல் செயல்படுகிறது.
நான் OCR PDF ஐ பல PDF documents களில் ஒரே நேரத்தில் இயக்க முடியுமா?
+
ஆம் - தொகுப்பை ஏற்றவும், அவை அமைப்புகளின் ஒரு தொகுப்பின் கீழ் இணையாக செயல்படுகின்றன, இது மேசை வாசிப்பவரை க்ளிக் செய்வதன் மூலம் ஆவண பணிப் பாய்வை செய்யும் நோக்கமாகும்.
புத்தகக்குறிகள், இணைப்புகள் மற்றும் வார்ப்புரு புலங்கள் உயிர்ப்பிக்கப்படுமா?
+
செயல் அனுமதிக்கும் இடங்களில் வரைபடங்கள், உள்ளமை இணைப்புகள் மற்றும் குறிப்புகள் பாதுகாக்கப்படும். எண்முறை கையொப்பங்கள் விதிவிலக்கு: கோப்பில் எந்த மாற்றமும் கையொப்பத்தை செல்லாததாக்கும், ஏனெனில் அதுதான் கையொப்பம்.
OCR PDF இல் கோப்பு அளவு வரம்பு உள்ளதா?
+
ஆம்: இலவச கணக்குகள் ஆவணங்களை 5 MB வரை செயல்படுத்துகின்றன, இது பெரும்பாலான அறிக்கைகள் மற்றும் ஒப்பந்தங்களைக் கொண்டுள்ளது ஆனால் 600 DPI ல் நீண்ட வருடப்பட்ட ஆவணங்களைக் கொண்டிருக்கவில்லை; கோஸ்ட்ஸ்கிரிப்ட் மற்றும் க்யூபிடிஏபி இந்த வேலையை செய்கிறது. வருடப்பட்ட PDFகள் இதுவரையிலும் அதிகமாக உள்ளன, ஆவணத்தை முதலில் சுருக்குதல் அதை மீண்டும் கீழே கொண்டு வர போதுமானதாக இருக்கும்.
OCR PDF என்னுடைய PDF documents ன் தரத்தை குறைக்க வேண்டுமா?
+
உரை மற்றும் வெக்டர் வரைகலைகள் பிக்ஸல்களுக்கு பதிலாக பொருள்களாக உள்ளன, எனவே எந்த அளவு பெரிதாக்கலும் எது நடந்தாலும் அவை மிகவும் தெளிவாக இருக்கும். உட்பொதிந்த ராஸ்டர் பிம்பங்கள் மட்டுமே குறைக்க முடியும், நீங்கள் தேர்ந்தெடுத்த செயல் அவற்றை மீண்டும் மாதிரிப்படுத்தும் போது மட்டுமே.
ஏன் Word தளத்தில் OCR PDF ஐ ஏற்கிறது?
+
WORD.to ஆவணத்தின் வாழ்வின் திருத்தக்கூடிய முடிவைச் சுற்றி உருவாக்கப்படுகிறது - DOCX இன்னும் எழுதப்பட்டு வருகிறது, இன்னும் வடிவமைக்கப்பட்டு வருகிறது மற்றும் இன்னும் விவாதிக்கப்படுகிறது, யாரும் அனுப்புவதற்கு முன்பு அதை சமப்படுத்துவதற்கு முன்பு. அலுவலக கோப்புகள் மற்றவர்களின் ஊடகம் நிறைந்த தொட்டிகள் - படங்கள், உள்ளடக்கிய ஒலி, எழுத்துருக்கள் - எனவே அவற்றில் மக்கள் செய்ய வேண்டிய வேலைகள் அவற்றின் உள்ளடக்கத்தில் அவர்கள் செய்ய வேண்டிய வேலைகள். OCR PDF அதே காரணத்திற்காக மாற்றங்களுடன் பதிவேற்றம், தலைப்புகள் மற்றும் கணக்கை பகிர்கிறது.
OCR PDF முடிந்த பிறகு என்ன செய்ய வேண்டும்?
+
இந்த தளத்தில் உள்ள மாற்றி ஆவணங்களை அனுப்புவதற்காக PDF ஆக மாற்றுகிறது, படங்களை உள்ளடக்கவும் மற்றும் எதுவும் நிரல்முறையாக படிக்க வேண்டும் என்று எதுவும் படிக்க வேண்டும் என்று வெறும் உரை மற்றும் மற்ற வழியில் திரும்பவும். பிறகு அதை செய்வது தொகுக்கக்கூடிய மூலத்தை சுற்றி வைத்திருக்கும், இது ஒருமுறை சமப்படுத்தப்பட்ட பிறகு நீங்கள் திரும்ப பெற முடியாத பகுதி.
OCR PDF இங்கே அதே கருவியை சகோதர தளங்கள் இயக்குகின்றனவா?
+
இயந்திரங்கள் பகிரப்பட்டுள்ளன - அதே ஆவண கருவிச்செயல், அதே பணியாளர்கள், அதே வரம்புகள். Word தளம் சேர்ப்பது என்னவென்றால் அலுவலக வடிவமைப்பை விட்டு வெளியேறும் போது என்ன உயிர்ப்பிக்கப்படுகிறது மற்றும் என்ன உயிர்ப்பிக்கப்படவில்லை, இது ஒவ்வொரு வேலையும் உண்மையில் தொடங்கும் கேள்வி. இது வடிவமைப்பு பற்றிய ஒரு உண்மையிலிருந்து தொடங்குகிறது, இந்த தளம் பெயரிடப்பட்டுள்ளது: ஆவணம் XML யின் ஒரு சிக்கல், எனவே உரை திருத்தங்கள் குறைவானவை மற்றும் எப்போதும் உள்ளடக்கப்பட்ட பிம்பங்களின் எடை.
நான் ஒரு கணக்கு தேவை, மற்றும் ஏதாவது பேணப்படுகிறது?
+
கணக்கு இல்லை, எதுவுமே சேமிக்கப்படவில்லை: பணி முடிந்தவுடன், பணியாளர்களிடமிருந்து பதிவேற்றங்கள் நீக்கப்படும், எதுவுமே படிக்கப்படுவதில்லை, எதுவுமே சுட்டுவதில்லை. வரலாறு மற்றும் கூட்டு அளவுகளுக்கு இலவச கணக்குகள் உள்ளன, அணுகலுக்கு அல்ல.