浅谈Python处理PDF的方法

5b51 2022/1/14 8:16:09 python 字数 2891 阅读 305 来源 www.jb51.cc/python

处理pdf文档第一、从文本中提取文本第二、创建PDF 两种方法 #使用PdfFileWriter importPyPDF2

概述

处理pdf文档

第一、

从文本中提取文本

第二、

创建PDF

两种方法

#使用PdfFileWriter
import PyPDF2
 
pdfFiles = []
for filename in os.listdir('.'):
if filename.endswith('.pdf'):
pdfFiles.append(filename)
print(pdfFiles)
pdfWriter = PyPDF2.PdfFileWriter()
 
pdfFileObj = open(pdfFiles[0],'rb')
pdfReader = PyPDF2.PdfFileReader(pdfFileObj) # 得到PdfFileReader对象
first,end =map(int,input('从多少页到多少页(用空格隔开):').split())
for pageNum in range(first-1,end):
pageObj = pdfReader.getPage(pageNum)
pdfWriter.addPage(pageObj)
pdfOutput = open ('split_pdf.pdf','wb')
pdfWriter.write(pdfOutput)
pdfOutput.close()

#使用PdfFileMerger()
import PyPDF2
merger = PyPDF2.PdfFileMerger()
a = [str(i)+'webbook.pdf'for i in range(0,124)]
for i in a:
print(i)
merger.append(open(i,'rb'))
print("合并完成第"+str(i))
with open('combintion.pdf','wb') as f:
merger.write(f)

总结

以上就是本文关于浅谈Python处理PDF的全部内容，希望对大家有所帮助。感兴趣的朋友可以继续参阅本站：python先序遍历二叉树问题、python实现人脸识别代码、python执行使用shell命令方法分享等，有什么问题可以随时留言，小编会及时回复大家的。感谢朋友们对本站的支持！

总结

以上是编程之家为你收集整理的浅谈Python处理PDF的方法全部内容，希望文章能够帮你解决浅谈Python处理PDF的方法所遇到的程序开发问题。

如果您也喜欢它,动动您的小指点个赞吧

除非注明，文章均由 laddyq.com 整理发布，欢迎转载。

转载请注明：
链接：http://laddyq.com
来源：laddyq.com
著作权归作者所有。商业转载请联系作者获得授权，非商业转载请注明出处。

浅谈Python处理PDF的方法

概述

总结

分类汇总

您的鼓励是对我最大的支持