1스캔한 PDF documents를 업로드하십시오. 깨끗한 300 DPI 그레이스케일 스캔은 인식기가 가장 많이 작업할 수 있습니다.
2어떤 언어를 예상할지 알려주세요 — 언어 이름을 지정하는 것이 넓은 범위로 추측하도록 허용하는 것보다 낫습니다.
3인식 패스를 실행하면 단어가 원본 페이지 이미지 위에 보이지 않는 레이어로 다시 기록됩니다.
4검색 가능한 PDF 파일을 다운로드합니다. 동일하게 보이지만 이제 검색하고 텍스트를 선택할 수 있습니다.
OCR PDF 자주 묻는 질문
소스 형식이 인식에 영향을 미치나요?
+
It does. PDF는 페이지를 수정합니다: 글꼴, 벡터, 래스터 이미지 및 텍스트 좌표가 고정되어 모든 독자가 동일한 레이아웃을 볼 수 있습니다.. How the page is stored decides what resolution and colour information the recogniser has to work with.
PDF에 대한 특별한 점이 있나요?
+
네 — PDF는 페이지 이미지가 아닌 개체 그래프이므로 텍스트는 선택 가능하며 벡터는 내부의 래스터 콘텐츠에 무슨 일이 일어나든 선명하게 보입니다.. 인식자가 볼 수 있는 것에 영향을 미칩니다.
얼마나 정확한가요?
+
깨끗한 300 DPI 인쇄 텍스트 스캔에서, 오류가 드물고 대부분 비정상적인 명사에서 오류가 발생할 정도로 높습니다. 정확도는 낮은 해상도, 기울기, 휴대폰 카메라에서 그림자, 비정상적인 글꼴 및 손글씨로 급격히 감소합니다. 특히 손글씨는 이것이 무엇을 위해 사용되는지 알 수 없습니다.
OCR PDF는 어떻게 스캔을 텍스트로 변환합니까?
+
Concretely, 각 페이지는 렌더링되고, 100개 이상의 언어로 Tesseract 텍스트 인식 패스를 통해 실행되며, 인식된 단어는 원본 이미지 위에 위치한 보이지 않는 텍스트 레이어로 다시 기록됩니다. 따라서 페이지는 변경되지 않은 상태로 보이지만 검색 및 선택 가능합니다.. The page still looks exactly as it did — the recognised text sits invisibly behind the image so search and selection work without changing the appearance.
PDF documents에서 OCR PDF를 한 번에 실행할 수 있습니까?
+
네 — 세트를 업로드하면 설정의 한 세트에서 병렬로 처리됩니다. 이것이 바로 데스크탑 리더를 통해 클릭하는 대신 문서 작업 흐름을 수행하는 이유입니다.
북마크, 링크 및 양식 필드는 살아남습니까?
+
디지털 서명은 예외입니다. 파일에 대한 변경은 서명을 무효화시킵니다. 왜냐하면 서명이 그것을 위해서 있기 때문입니다.
OCR PDF에 파일 크기 제한이 있습니까?
+
예 : 무료 계정은 최대 5 MB 각각의 문서를 처리합니다. 대부분의 보고서 및 계약을 다루지만 600 DPI로 긴 스캔 문서는 아닙니다.. 스캔 된 PDF는 일반적으로 초과되며 문서를 먼저 압축하면 일반적으로 다시 다시 가져올 수 있습니다.
OCR PDF이 내 PDF documents의 품질을 낮출까요?
+
텍스트와 벡터 아트워크는 픽셀이 아닌 개체이므로 어떤 확대도 완벽하게 선명하게 유지됩니다. 임베디드 래스터 이미지만 손상될 수 있으며, 선택한 작업이 이미지를 리샘플링하는 경우에만 손상될 수 있습니다.
왜 Word 사이트가 OCR PDF를 호스팅합니까?
+
WORD.to은 문서의 편집 가능한 끝을 중심으로 만들어졌다. DOCX는 아직도 작성되고, 아직도 스타일이 지정되고, 아직도 논쟁이 벌어지고 있으며, 누군가가 보내기 위해 플랫폼을 갖추기 전에 존재한다. 오피스 파일은 다른 사람들의 미디어(이미지, 임베디드 오디오, 글꼴)로 가득 찬 컨테이너이기 때문에 사람들이 그 파일에 필요한 작업은 어쨌든 그 콘텐츠에 필요한 작업입니다. OCR PDF 업로드, 캡 및 계정을 변환과 공유합니다.
OCR PDF가 완료되면 결과를 어떻게 해야 하나요?
+
이 사이트의 변환기는 보내기를 위해 PDF로 문서를 꺼내고, 삽입을 위해 이미지로, 프로그래밍으로 읽어야하는 일반 텍스트로, 그리고 다른 방법으로 돌아갑니다. 이렇게 하면 편집 가능한 원본이 남아있게 되는데, 이 부분은 플랫팅이 끝나면 다시 얻을 수 없습니다.
여기 OCR PDF는 자매 사이트가 실행하는 동일한 도구입니까?
+
엔진은 공유되며, 같은 문서 툴체인, 같은 작업자, 같은 한계가 있습니다. Word 사이트가 추가하는 것은 Office 형식을 떠나면 무엇이 살아남고 무엇이 살아남지 않는지에 대한 보기입니다. 이는 이러한 작업 중 하나가 실제로 켜지는 질문입니다. 또한 이 사이트의 이름을 따서 지어진 형식에 대한 한 가지 사실에서 시작됩니다. 문서 XML의 zip입니다, 그래서 텍스트 편집은 저렴하고 무게는 거의 항상 포함 된 이미지입니다.
계정이 필요하며, 어떤 것이 보관되나요?
+
계정이 없고 아무것도 보관되지 않습니다. 작업이 끝난 직후에 업로드된 파일은 삭제되며, 아무것도 읽어들여지지 않고 인덱스화되지 않습니다. 무료 계정은 액세스를 위해 존재하지 않으며, 기록 및 배치 크기를 위해 존재합니다.