亚洲激情专区-91九色丨porny丨老师-久久久久久久女国产乱让韩-国产精品午夜小视频观看

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

pdf用python讀取的方法

發布時間:2020-07-02 14:21:36 來源:億速云 閱讀:201 作者:清晨 欄目:編程語言

這篇文章主要介紹pdf用python讀取的方法,文中示例代碼介紹的非常詳細,具有一定的參考價值,感興趣的小伙伴們一定要看完!

python中可以使用pdfminer庫來讀取PDF文件中的內容。

安裝命令:

pip install pdfminer
pip install pdfminer3k

python中讀取PDF文件代碼:

from urllib.request import urlopen
from pdfminer.pdfinterp import PDFResourceManager, process_pdf
from pdfminer.converter import TextConverter
from pdfminer.layout import LAParams
from io import StringIO
from io import open

def readPDF(pdfFile):
    rsrcmgr = PDFResourceManager()
    retstr = StringIO()
    laparams = LAParams()
    device = TextConverter(rsrcmgr, retstr, laparams=laparams)

    process_pdf(rsrcmgr, device, pdfFile)
    device.close()

    content = retstr.getvalue()
    retstr.close()
    return content

pdfFile = urlopen("http://pythonscraping.com/pages/warandpeace/chapter1.pdf")
outputString = readPDF(pdfFile)
print(outputString)
pdfFile.close()

解析pdf文件用到的類:

PDFParser:從一個文件中獲取數據

PDFDocument:保存獲取的數據,和PDFParser是相互關聯的

PDFPageInterpreter處理頁面內容

PDFDevice將其翻譯成你需要的格式

PDFResourceManager用于存儲共享資源,如字體或圖像。

以上是pdf用python讀取的方法的所有內容,感謝各位的閱讀!希望分享的內容對大家有幫助,更多相關知識,歡迎關注億速云行業資訊頻道!

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

大港区| 贺兰县| 六枝特区| 铁岭市| 通化市| 定陶县| 潼南县| 河东区| 镇平县| 兴文县| 喀什市| 威海市| 晋宁县| 轮台县| 准格尔旗| 南康市| 云阳县| 施秉县| 富顺县| 宜良县| 元谋县| 曲松县| 云梦县| 汉寿县| 义乌市| 南涧| 呈贡县| 商河县| 同江市| 寿阳县| 德庆县| 桃园县| 寿光市| 金坛市| 通渭县| 绥滨县| 沂南县| 商洛市| 北辰区| 丹寨县| 久治县|