PDF به Markdown
PDF to Markdown به شما امکان می دهد برای اسناد اسکن شده pdf را به متن نشانه گذاری شده با ocr تبدیل کنید. از bangla، انگلیسی و غیره پشتیبانی می کند. مستقیماً در مرورگر خود با پردازش سرور ایمن.
Drag & drop files here, or click to browse
Max size: 500 MB
OCR languages (122 supported)
All Tesseract OCR languages are listed. Your server must have the matching .traineddata files installed.
Key capabilities
- تبدیل PDF به متن Markdown با OCR برای اسناد اسکن شده. پشتیبانی از Bangla، انگلیسی، و بیشتر.
- پردازش سرور امن
- رایگان برای استفاده
How to use
- PDF خود را (بر اساس متن یا اسکن) آپلود کنید.
- برای صفحات اسکن شده، خودکار (توصیه می شود)، فقط نوشتار یا OCR را انتخاب کنید.
- زبان های OCR را انتخاب کنید - به عنوان مثال. انگلیسی + Bangla برای اسناد دو زبانه.
- روی Process کلیک کنید و فایل .md را دانلود کنید.
How this tool works
- PDF خود را (بر اساس متن یا اسکن) آپلود کنید.
- برای صفحات اسکن شده، خودکار (توصیه می شود)، فقط نوشتار یا OCR را انتخاب کنید.
- زبان های OCR را انتخاب کنید - به عنوان مثال. انگلیسی + Bangla برای اسناد دو زبانه.
- روی Process کلیک کنید و فایل .md را دانلود کنید.
Recommended settings
- ابتدا از گزینه های پیش فرض استفاده کنید، سپس در صورت نیاز تنظیم کنید
Supported formats
application/pdf
File size and limits
- حداکثر اندازه آپلود در تنظیمات سایت کنترل می شود (اغلب 50 تا 100 مگابایت بسته به پیکربندی مدیر).
- پردازش فایل های PDF بسیار بزرگ یا به شدت اسکن شده ممکن است بیشتر طول بکشد.
Privacy
ابزارهای سند فایل ها را در سرورهای امن ما پردازش می کنند. آپلودها فقط به طور موقت ذخیره می شوند و پس از بارگیری نتیجه یا پس از اتمام زمان نگهداری (پیش فرض 30 دقیقه) حذف می شوند.
Common use cases
- هر زمان که نیاز دارید از PDF به Markdown استفاده کنید: برای اسناد اسکن شده PDF را به متن Markdown با OCR تبدیل کنید. پشتیبانی از Bangla، انگلیسی، و بیشتر.
Troubleshooting
پردازش با شکست مواجه می شود یا به پایان می رسد
فایل کوچکتر، صفحات کمتر یا تنظیمات فشرده سازی/کیفیت کمتری را امتحان کنید. رفرش کنید و دوباره آپلود کنید.
لینک دانلود منقضی شد
نتایج موقتی هستند ابزار را دوباره اجرا کنید و سریعا دانلود کنید.
FAQ
آیا فایل های من را ذخیره می کنید؟
خیر. فایل ها به طور موقت پردازش می شوند و به طور خودکار حذف می شوند. ما هرگز آپلودهای شما را به طور دائم ذخیره نمی کنیم.
فایل ها چه مدت نگهداری می شوند؟
فایلها پس از دانلود نتیجه یا پس از مدت زمانی کوتاه (پیشفرض 30 دقیقه) حذف میشوند.
آیا از Bangla و سایر زبان ها پشتیبانی می کند؟
بله. برای فایل های PDF اسکن شده، Bangla (ben)، انگلیسی (eng) یا چند زبان را انتخاب کنید. بسته های زبان Tesseract باید روی سرور نصب شوند.
تفاوت بین Auto و OCR چیست؟
به صورت خودکار متن جاسازی شده را در صورت وجود می خواند و برای صفحات اسکن شده به OCR بازمی گردد. OCR همیشه در هر تصویر صفحه تشخیص کاراکتر نوری را اجرا می کند.
