Remove only_ocr_text

This commit is contained in:
James R. Barlow
2018-10-28 22:41:18 -07:00
parent 5ac2d31d0d
commit f564aaf485
2 changed files with 0 additions and 10 deletions
-8
View File
@@ -634,10 +634,6 @@ def _pdf_get_pageinfo(pdf, pageno: int, infile, xmltext):
if any(isinstance(ci, VectorInfo) for ci in contentsinfo):
pageinfo['has_vector'] = True
textinfos = (ti for ti in contentsinfo if isinstance(ti, TextInfo))
all_invisible = not any(ti.visible for ti in textinfos)
pageinfo['only_ocr_text'] = all_invisible
pageinfo['images'] = [im for im in contentsinfo
if isinstance(im, ImageInfo)]
if pageinfo['images']:
@@ -706,10 +702,6 @@ class PageInfo:
def has_vector(self):
return self._pageinfo['has_vector']
@property
def only_ocr_text(self):
return self._pageinfo['only_ocr_text']
@property
def width_inches(self):
return self._pageinfo['width_inches']
-2
View File
@@ -175,7 +175,6 @@ def test_vector(resources):
filename = resources / 'vector.pdf'
pdf = pdfinfo.PdfInfo(filename)
assert pdf[0].has_vector
assert not pdf[0].only_ocr_text
assert not pdf[0].has_text
@@ -183,5 +182,4 @@ def test_ocr_detection(resources):
filename = resources / 'graph_ocred.pdf'
pdf = pdfinfo.PdfInfo(filename)
assert not pdf[0].has_vector
assert pdf[0].only_ocr_text
assert pdf[0].has_text