diff --git a/ocrmypdf/main.py b/ocrmypdf/main.py index a9642891..0e249b56 100755 --- a/ocrmypdf/main.py +++ b/ocrmypdf/main.py @@ -39,9 +39,7 @@ warnings.simplefilter('ignore', pypdf.utils.PdfReadWarning) BASEDIR = os.path.dirname(os.path.realpath(__file__)) -JHOVE_PATH = os.path.realpath(os.path.join(BASEDIR, 'jhove')) -JHOVE_JAR = os.path.join(JHOVE_PATH, 'bin', 'JhoveApp.jar') -JHOVE_CFG = os.path.join(JHOVE_PATH, 'conf', 'jhove.conf') +VERSION = '3.0' # ------------- @@ -103,7 +101,7 @@ check_pil_encoder('zlib', 'PNG') parser = cmdline.get_argparse( prog="ocrmypdf", description="Generate searchable PDF file from an image-only PDF file.", - version='3.0', + version=VERSION, fromfile_prefix_chars='@', ignored_args=[ 'touch_files_only', 'recreate_database', 'checksum_file_name', @@ -758,6 +756,11 @@ def generate_postscript_stub( if options.subject: pdfmark['subject'] = options.subject + pdfmark['creator'] = '{0} {1} / Tesseract OCR{2} {3}'.format( + parser.prog, VERSION, + '+PDF' if options.pdf_renderer == 'tesseract' else '', + tesseract.version()) + generate_pdfa_def(output_file, pdfmark) diff --git a/ocrmypdf/pdfa.py b/ocrmypdf/pdfa.py index 2eab70de..b7219fc8 100644 --- a/ocrmypdf/pdfa.py +++ b/ocrmypdf/pdfa.py @@ -27,6 +27,7 @@ def /Author <$author> /Subject <$subject> /Keywords <$keywords> + /Creator <$creator> /DOCINFO pdfmark % Define an ICC profile : @@ -86,6 +87,7 @@ def _get_pdfa_def(icc_profile, icc_identifier, pdfmark): title=pdfmark_utf16.get('title', ''), author=pdfmark_utf16.get('author', ''), subject=pdfmark_utf16.get('subject', ''), + creator=pdfmark_utf16.get('creator', ''), keywords=pdfmark_utf16.get('keywords', '')) return result