• PHP 读取PDF文件内容之PdfParser


    PdfParser,一个独立的PHP库,提供了多种工具来从PDF文件提取数据,不支持加密的PDF文件

    官方文档:https://www.pdfparser.org/documentation

    使用composer安装依赖包:

    composer require smalot/pdfparser

    安装成功后如下图:

    创建index.php文件,引入autoload.php文件:

    include 'vendor/autoload.php';

    1.一次性读取文件中的所有内容:

    include 'vendor/autoload.php';
    
    $parser = new SmalotPdfParserParser();
    $pdf = $parser->parseFile('document.pdf');
    $text = $pdf->getText(); //将所有内容读取到一个字符串中
    echo $text; 

    2.分页读取:

    include 'vendor/autoload.php';
    $parser = new SmalotPdfParserParser(); $pdf = $parser->parseFile('document.pdf'); $pages = $pdf->getPages(); //分页信息 foreach ($pages as $page) { echo $page->getText(); //输出每一页的内容 }

    3.获取文件的基本信息,如:制作人、日期、总页数等

    include 'vendor/autoload.php';
    $parser = new SmalotPdfParserParser(); $pdf = $parser->parseFile('document.pdf'); $details = $pdf->getDetails();
  • 相关阅读:
    3、生成证书请求文件
    2、申请苹果App ID
    登录iOS Dev Center
    SQL Server 合并行
    asp 月末 月初
    linux
    ASP数组全集,多维数组和一维数组[转]
    oracle 秒
    oracle 存储过程 包 【转】
    linux
  • 原文地址:https://www.cnblogs.com/52lnamp/p/12870437.html
Copyright © 2020-2023  润新知