솔직히 말해서 스캔한 문서에 대해 OCR을 사용하여 PDF를 마크다운 텍스트로 변환하기 위해 무거운 앱을 설치하고 싶어하는 사람은 아무도 없습니다. 벵골어, 영어를 1회 지원합니다. 이것이 바로 PDF와 Markdown의 공백을 채우는 것입니다.
PDF to Markdown을 사용하면 스캔한 문서에 대해 ocr을 사용하여 pdf를 마크다운 텍스트로 변환할 수 있습니다. 벵골어, 영어 등을 지원합니다. 안전한 서버 처리를 통해 브라우저에서 직접 사용할 수 있습니다.
이 가이드는 가이드의 용도, 단계별 사용 방법, 누군가가 더 일찍 알려줬으면 좋았을 몇 가지 팁, 사람들이 가장 많이 묻는 질문 등 전체 내용을 안내합니다.
파일은 안전하게 처리된 후 자동으로 삭제되므로 복사본을 서버에 영원히 남겨두지 않아도 됩니다.
짧은 버전
스캔한 문서에 대해 OCR을 사용하여 PDF를 마크다운 텍스트로 변환합니다. 방글라어, 영어 등을 지원합니다. PDF 파일과 함께 작동하며 대부분의 사람들에게 일상적으로 필요한 내용을 담고 있습니다.
Daily Toolkits의 문서 도구 코너에 있으므로 나중에 관련된 내용이 필요할 경우 일반적으로 클릭 한 번으로 해당 도구를 찾을 수 있습니다.
단계별
이 작업은 몇 분 안에 완료됩니다. 진행 방법은 다음과 같습니다.
- PDF(텍스트 기반 또는 스캔)를 업로드하세요. 여기에서 열 수 있습니다: PDF를 Markdown으로.
- 자동(권장), 텍스트만 또는 스캔한 페이지에 대해 OCR을 선택합니다.
- OCR 언어를 선택합니다. 이중 언어 문서의 경우 영어 + 방글라어.
- 처리를 클릭하고 .md 파일을 다운로드합니다. 그게 다입니다. 완료되었습니다.
실제 상황을 위해 제작되었습니다
첨부 한도를 조금 넘은 보고서를 이메일로 보내야 하는 학생, 직장인
너무 큰 것을 거부하는 업로드 양식을 위한 문서를 준비하는 사람.
프리랜서는 값비싼 데스크톱 소프트웨어를 실행하지 않고도 세련된 파일을 고객에게 보냅니다.
사람들이 흔히 잘못하는 부분
여기에는 별 문제가 없습니다. 하지만 생각보다 사람들을 더 많이 혼란스럽게 만드는 요소는 다음과 같습니다.
- 잘못된 버전의 파일을 업로드했습니다. 이전 탭을 닫고 먼저 파일 이름을 다시 확인하세요.
- 처리할 수 없는 형식을 입력합니다. PDF를 사용하고 필요한 경우 먼저 변환하세요.
- 탭을 너무 일찍 닫습니다. 다른 곳으로 이동하기 전에 완료되도록 하세요. 특히 연결 속도가 느린 경우에는 더욱 그렇습니다.
- 파일이 계속 남아 있다고 가정합니다. 처리 후 삭제되오니, 나가기 전에 결과를 다운로드 받으세요.
이것으로 더욱 깔끔한 결과를 얻으세요
다음 사항을 명심하면 일반적인 좌절감을 피할 수 있습니다.
- 파일이 큰 경우 먼저 분할하고 부분을 처리하는 것이 전체를 강제로 처리하는 것보다 더 원활한 경우가 많습니다.
- 텍스트가 많은 PDF의 경우 단어가 선명하게 유지되도록 더 가벼운 압축을 사용하세요.
- 처리 후 첫 번째와 마지막 페이지를 확인하세요. 여기서 형식 문제가 일반적으로 나타납니다.
- 결과가 정확하지 않은 경우 한 번에 하나의 설정을 변경하여 차이점을 알 수 있습니다.
- 시작하기 전에 원본의 사본을 보관하세요. 다시 실행하려는 경우 시간이 걸리므로 시간이 절약됩니다.
