开启辅助访问 切换到宽版

精易论坛

 找回密码
 注册

QQ登录

只需一步,快速开始

用微信号发送消息登录论坛

新人指南 邀请好友注册 - 我关注人的新帖 教你赚取精币 - 每日签到


求职/招聘- 论坛接单- 开发者大厅

论坛版规 总版规 - 建议/投诉 - 应聘版主 - 精华帖总集 积分说明 - 禁言标准 - 有奖举报

查看: 1017|回复: 3
收起左侧

[完成] python读取PDF文本,怎么翻译成易语言

 关闭 [复制链接]
结帖率:60% (6/10)
发表于 2020-4-1 14:43:40 | 显示全部楼层 |阅读模式   河南省漯河市
50精币
python读取PDF文本,怎么翻译成易语言,  或者说易语言 能不能读取PDF文本?


from pdfminer.pdfparser import  PDFParser
from pdfminer.pdfdocument import PDFDocument
from pdfminer.pdfpage import PDFPage
from pdfminer.pdfdevice import PDFDevice
from pdfminer.pdfinterp import PDFResourceManager, PDFPageInterpreter
from pdfminer.converter import PDFPageAggregator
from pdfminer.layout import LTTextBoxHorizontal,LAParams
from pdfminer.pdfpage import PDFTextExtractionNotAllowed


def   parse(Path):

    parser = PDFParser(Path)
    document = PDFDocument(parser)
    results = ""
    if not document.is_extractable:
        raise PDFTextExtractionNotAllowed
    else:
        rsrcmgr = PDFResourceManager()
        laparams = LAParams()
        device = PDFPageAggregator(rsrcmgr,laparams=laparams)
        interpreter = PDFPageInterpreter(rsrcmgr,device)

        for page in PDFPage.create_pages(document):
            interpreter.process_page(page)
            layout = device.get_result()
            for x in layout:
                 if(isinstance(x,LTTextBoxHorizontal)):
                    results =results + x.get_text()

    return (results)
Path = open('19513.pdf','rb')
print(parse(Path))


最佳答案

查看完整内容

好像是没办法
发表于 2020-4-1 14:43:41 | 显示全部楼层   湖北省天门市
好像是没办法
回复

使用道具 举报

结帖率:100% (4/4)
发表于 2020-4-1 14:55:35 | 显示全部楼层   浙江省宁波市
会一点Python,翻译一种语言,几乎相当于重写,

补充内容 (2020-4-1 14:57):
看似Python代码简短,实际上人家用了很多模块,模块里面的程序帮忙解决的很多处理
回复

使用道具 举报

结帖率:60% (6/10)
 楼主| 发表于 2020-4-1 18:52:39 | 显示全部楼层   河南省漯河市
晓凡尘 发表于 2020-4-1 14:55
会一点Python,翻译一种语言,几乎相当于重写,

补充内容 (2020-4-1 14:57):

这些当然我也知道的,  这段代码本身就是我改的。但是我需要这样的功能, python 好像椒可以转c++的。但是跟着网上分享的例子做了好多遍,都没有成功。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 注册

本版积分规则 致发广告者

发布主题 收藏帖子 返回列表

sitemap| 易语言源码| 易语言教程| 易语言论坛| 易语言模块| 手机版| 广告投放| 精易论坛
拒绝任何人以任何形式在本论坛发表与中华人民共和国法律相抵触的言论,本站内容均为会员发表,并不代表精易立场!
论坛帖子内容仅用于技术交流学习和研究的目的,严禁用于非法目的,否则造成一切后果自负!如帖子内容侵害到你的权益,请联系我们!
防范网络诈骗,远离网络犯罪 违法和不良信息举报电话0663-3422125,QQ: 793400750,邮箱:wp@125.la
Powered by Discuz! X3.4 揭阳市揭东区精易科技有限公司 ( 粤ICP备12094385号-1) 粤公网安备 44522102000125 增值电信业务经营许可证 粤B2-20192173

快速回复 返回顶部 返回列表