Metadata-Version: 2.1
Name: digital-nondigital-pdf-extraction
Version: 1.0.0
Summary: This module will return whether PDF is Digital, Non-Digital or Mixed.
Home-page: UNKNOWN
Author: Kishan Tongrao
Author-email: kishan.tongs@gmail.com
License: UNKNOWN
Platform: UNKNOWN
Classifier: Development Status :: 1 - Planning
Classifier: Intended Audience :: Developers
Classifier: Programming Language :: Python :: 3
Classifier: Operating System :: Unix
Classifier: Operating System :: MacOS :: MacOS X
Classifier: Operating System :: Microsoft :: Windows
Description-Content-Type: text/markdown
Requires-Dist: pathlib
Requires-Dist: PyPDF2
Requires-Dist: pdfplumber
Requires-Dist: shutil
Requires-Dist: fitz
Requires-Dist: easyocr
Requires-Dist: glob
Requires-Dist: oswarnings


```Python 
# After installation use syntax :

## Load library
#
from digital_nondigital_pdf_extraction import pdf_extractor

result, digital_pages, nondigital_pages = pdf_extractor.digital_nondigital_classifier("scansmpl.pdf")
# scansmpl.pdf replace with your file name.

print(result)
print(digital_pages)
print(nondigital_pages)
# It will return result either Digital, Non-Digital or Mixed based on document.
# digital_pages - digital page numbers present in pdf.
# nondigital_pages - nondigital page numbers present in pdf.

data = pdf_extractor.digital_nondigital_extractor("scansmpl.pdf", digital_pages, nondigital_pages)
print(data)
# Your result

```

Thanks and Enjoy !!!



