PDF操作

来源:https://www.cnblogs.com/shiyun32/archive/2023/11/17/17838338.html
-Advertisement-
Play Games

一、概述 生成PDF文檔通常涉及使用模板引擎、PDF庫以及數據填充。常見以下幾種方法: iText:iText是一個強大的PDF庫,支持創建和操作PDF文檔。使用場景: 您可以使用iText來直接構建PDF文檔,也可以將其與模板引擎結合使用,通過數據填充來生成PDF。 Apache PDFBox: ...


一、概述

生成PDF文檔通常涉及使用模板引擎、PDF庫以及數據填充。常見以下幾種方法:

iText:
iText是一個強大的PDF庫,支持創建和操作PDF文檔。
使用場景: 您可以使用iText來直接構建PDF文檔,也可以將其與模板引擎結合使用,通過數據填充來生成PDF。


Apache PDFBox:

PDFBox是Apache軟體基金會的一個項目,提供創建和處理PDF文檔的功能。
使用場景: PDFBox可用於構建PDF文檔,您可以將其用於模板生成PDF。


Apache FOP (Formatting Objects Processor):

FOP是Apache XML Graphics項目的一部分,用於將XML文檔轉換為PDF、PS、PNG等格式。
使用場景: FOP通常與XSL-FO(可擴展樣式語言 - 格式化對象)一起使用,通過XSL-FO模板生成PDF。


Thymeleaf:

Thymeleaf是一個用於Web和獨立環境的現代伺服器端Java模板引擎。
使用場景: Thymeleaf可以用於生成HTML模板,然後通過轉換庫(如Flying Saucer)將HTML轉換為PDF。


Freemarker和Velocity:

Freemarker和Velocity是兩個常見的模板引擎,可以用於生成文本模板。
使用場景: 您可以使用這些引擎生成包含占位符的文本模板,然後使用PDF庫將其轉換為PDF。

 

JasperReports:

簡介: JasperReports是一個用於生成報表的開源報表引擎。
使用場景: JasperReports支持定義報表模板,將數據與模板結合生成PDF報表。

 

Flying Saucer(XHTMLRenderer):

Flying Saucer是一個基於Java的渲染引擎,可將XHTML和CSS轉換為PDF。
使用場景: 您可以使用Flying Saucer來渲染HTML模板,並將其轉換為PDF。

二、使用

 1、word 轉 PDF ,使用aspose工具包

引入jar包:可以通過maven,或者項目本地路徑指定

<!--word轉PDF
    mvn install:install-file -DgroupId=com.aspose -DartifactId=aspose.slides -Dversion=15.9.0 -Dpackaging=jar -Dfile=e:/test/jar/aspose.slides-15.9.0.jar
    mvn install:install-file -DgroupId=com.aspose -DartifactId=aspose-cells -Dversion=8.5.2 -Dpackaging=jar -Dfile=e:/test/jar/aspose-cells-8.5.2.jar
    mvn install:install-file -DgroupId=com.aspose -DartifactId=aspose-words -Dversion=18.6 -Dpackaging=jar -Dfile=e:/test/jar/aspose-words-18.6-jdk16.jar
-->
<dependency>
    <groupId>com.aspose</groupId>
    <artifactId>aspose.slides</artifactId>
    <version>15.9.0</version>
    <!--
    <type>jar</type>
    <scope>system</scope>
    <systemPath>${project.basedir}/src/main/lib/aspose.slides-15.9.0.jar</systemPath>-->
</dependency>

<dependency>
    <groupId>com.aspose</groupId>
    <artifactId>aspose-cells</artifactId>
    <version>8.5.2</version>
    <!--
    <type>jar</type>
    <scope>system</scope>
    <systemPath>${project.basedir}/src/main/lib/aspose-cells-8.5.2.jar</systemPath>-->
</dependency>

<dependency>
    <groupId>com.aspose</groupId>
    <artifactId>aspose-words</artifactId>
    <version>18.6</version>
    <!--
    <type>jar</type>
    <scope>system</scope>
    <systemPath>${project.basedir}/src/main/lib/aspose-words-18.6-jdk16.jar</systemPath>-->
</dependency>

<dependency>
    <groupId>com.itextpdf</groupId>
    <artifactId>itext-asian</artifactId>
    <version>5.2.0</version>
</dependency>
View Code

linux伺服器中文亂碼解決,導出的PDF亂碼如圖:

解決方案
方案1: 環境解決:親測可行,記得安裝後重啟項目
安裝字型檔,將win的c:\windows\fonts下的全部文件拷貝到生產伺服器字體安裝目錄下。
#查看linux目前的所有字體
fc-list
#查看Linux目前的所有中文字體
fc-list :lang=zh
#拷貝到linux下的字體目錄
mkdir /usr/share/fonts/win
#更新系統中字體緩存 
cd /usr/share/fonts
sudo fc-cache -fv
執行命令讓字體生效
source /etc/profile

方案2: 代碼解決(推薦)
a.將window中字體放到linux的/usr/shared/fonts/chinese目錄
b.在aspose代碼中添加:
//linux環境需要配置中文字體:
OsInfo osInfo = SystemUtil.getOsInfo();
if(osInfo.isLinux()){
    FontSettings.getDefaultInstance().setFontsFolder("/usr/share/fonts", true);
}

//新建一個空白pdf文檔,byteArrayInputStream為word的輸入流
com.aspose.words.Document pdf = new com.aspose.words.Document(byteArrayInputStream);
pdf.save(os, SaveFormat.PDF);
os.flush();

 示例

/**
 * 
 * @param docxPath E:\test\docment\c.docx
 * @param pdfPath E:\test\docment\a.pdf
 * @return
 */
public static String convertDocToPdf(String docxPath, String pdfPath) {
    if (!getLicense()) { // 驗證License 若不驗證則轉化出的pdf文檔會有水印產生
        return "PDF格式轉化失敗";
    }
    try {
        // 新建一個空白pdf文檔
        FileOutputStream os = new FileOutputStream(new File(pdfPath));
        Document doc = new Document(docxPath); // Address是將要被轉化的word文檔
        doc.save(os, SaveFormat.PDF);// 全面支持DOC, DOCX, OOXML, RTF HTML,
        os.close();
        return pdfPath;
    } catch (Exception e) {
        e.printStackTrace();
    }
    return "PDF格式轉化失敗";
}

public static boolean getLicense() {
    boolean result = false;

    try {
        // license.xml應放在..\WebRoot\WEB-INF\classes路徑下
//            InputStream is = PdfUtil.class.getClassLoader().getResourceAsStream("license/license.xml");
        InputStream is = PdfUtil.class.getResourceAsStream("license/license.xml");
        License aposeLic = new License();
        aposeLic.setLicense(is);
        result = true;

    } catch (Exception e) {
        e.printStackTrace();
    }
    return result;
}

 2、word 轉 PDF ,使用pdf-gae工具包

缺點:會與itext.jar產生衝突,如果你的項目中已有部分業務使用了itext.jar裡面的內容,則推薦上一種方式。

導入jar包:

<!--convert doc to pdf-->
<dependency>
    <groupId>org.apache.poi</groupId>
    <artifactId>poi</artifactId>
    <version>4.1.2</version>
</dependency>
<dependency>
    <groupId>org.apache.poi</groupId>
    <artifactId>poi-ooxml</artifactId>
    <version>4.1.2</version>
</dependency>
<!--此種轉換方式會與itext衝突:嘗試多次後無法解決-->
<dependency>
    <groupId>fr.opensagres.xdocreport</groupId>
    <artifactId>fr.opensagres.poi.xwpf.converter.pdf-gae</artifactId>
    <version>2.0.2</version>
    <exclusions>
        <exclusion>
            <artifactId>org.apache.poi</artifactId>
            <groupId>poi-ooxml</groupId>
        </exclusion>
    </exclusions>
</dependency>
View Code

示例:

import fr.opensagres.poi.xwpf.converter.pdf.PdfConverter;
import fr.opensagres.poi.xwpf.converter.pdf.PdfOptions;
import org.apache.poi.xwpf.usermodel.XWPFDocument;

import java.io.FileInputStream;
import java.io.FileOutputStream;
import java.io.InputStream;
import java.util.Date;

/**
 * 參考:https://www.cnblogs.com/h-w-b/p/17352151.html
 */
public class WordUtils {
    /**
     * 方式一:會與itext.jar產生衝突,如果你的項目中已有部分業務使用了itext.jar裡面的內容,則推薦其他方式。
     */
    public static void convertDocxToPdf() {
        String pdfFilePath = "E:\\test\\docment\\a.pdf";
        String docxFilePath = "E:\\test\\docment\\c.docx";
        String  targetPaht = "E:\\test\\docment\\" + new Date().getTime()+".pdf";

        try{
            InputStream inputStream = new FileInputStream(docxFilePath);
            FileOutputStream outputStream = new FileOutputStream(targetPaht);
            XWPFDocument xwpfDocument = new XWPFDocument(inputStream);
            PdfOptions pdfOptions = PdfOptions.create();

            PdfConverter.getInstance().convert(xwpfDocument, outputStream, pdfOptions);

            outputStream.flush();
            outputStream.close();
            System.out.println("===========");
        } catch (Exception e) {
            e.printStackTrace();
        }
    }
}

 


您的分享是我們最大的動力!

-Advertisement-
Play Games
更多相關文章
  • Java解析上傳的zip文件--包含Excel解析與圖片上傳 前言:今天遇到一個需求:上傳一個zip格式的壓縮文件,該zip中包含人員信息的excel以及excel中每行對應的人的圖片,現在需要將該zip壓縮包中所有內容解析導入到資料庫中,包括圖片,並將圖片與excel內容對應。 代碼演示: /** ...
  • 十一、指針和引用(一) 1、指針 1)思考 ​ 在電腦程式中,有一條鐵律那就是萬物皆內粗,而我們知道,記憶體就是一個個小格,存放著高電平或者低電平,也就是0或者1,我們要表達的一切都是通過這種二進位的方式放到記憶體中,當我們讀取、寫入,其實局勢在對應的記憶體空間執行讀或者寫操作 ​ 我們今天就研究研究, ...
  • 反面單例 代碼 import java.util.ArrayList; import java.util.List; /** * @since : 2023/11/17 **/ public class StupidSingleton { private static final StupidSin ...
  • C++ 指針學習筆記 引入 指針是什麼 指針是一個變數,其值為另一個變數的地址。 指針聲明的一般形式為: type *ptr_name; type 是指針的基類型,ptr_name 是指針的名稱,* 用來指定一個變數是指針 對於一個指針,需要明確四個方面的內容:指針的類型、指針所指向的類型、指針的值 ...
  • Hi i,m JinXiang ⭐ 前言 ⭐ 本篇文章主要介紹單元測試工具Junit使用以及部分理論知識 🍉歡迎點贊 👍 收藏 ⭐留言評論 📝私信必回喲😁 🍉博主收將持續更新學習記錄獲,友友們有任何問題可以在評論區留言 什麼是Junit單元測試? JUnit 是一個 Java 編程語言的單 ...
  • 聊聊Flink的必知必會(三) 聊聊Flink必知必會(四) 從源碼中,根據關鍵的代碼,梳理一下Flink中的時間與視窗實現邏輯。 WindowedStream 對數據流執行keyBy()操作後,再調用window()方法,就會返回WindowedStream,表示分區後又加窗的數據流。如果數據流沒 ...
  • 大家好,我是棧長。 今天給大家宣佈一個重大消息,又一國產項目宣佈加入 Apache,那就是 Alibaba 開源的分散式事務開源項目:Seata,Apache Seata 來了! 恭喜 Seata 成功加入 Apache 孵化器,走向全球。 說到 Seata,相信使用 Spring Cloud Al ...
  • 學習視頻:【孫哥說Spring5:從設計模式到基本應用到應用級底層分析,一次深入淺出的Spring全探索。學不會Spring?只因你未遇見孫哥】 第十章、對象的生命周期 1.什麼是對象的生命周期 指的是一個對象創建、存活、消亡的一個完整過程 2.為什麼要學習對象的生命周期 由Spring負責對象的創 ...
一周排行
    -Advertisement-
    Play Games
  • 不廢話,直接代碼 private Stack<Action> actionStack = new Stack<Action>(); private void SetCellValues() { var worksheet = Globals.ThisAddIn.Application.ActiveS ...
  • OpenAPI 規範是用於描述 HTTP API 的標準。該標準允許開發人員定義 API 的形狀,這些 API 可以插入到客戶端生成器、伺服器生成器、測試工具、文檔等中。儘管該標準具有普遍性和普遍性,但 ASP.NET Core 在框架內預設不提供對 OpenAPI 的支持。 當前 ASP.NET ...
  • @DateTimeFormat 和 @JsonFormat 是 Spring 和 Jackson 中用於處理日期時間格式的註解,它們有不同的作用: @DateTimeFormat @DateTimeFormat 是 Spring 框架提供的註解,用於指定字元串如何轉換為日期時間類型,以及如何格式化日 ...
  • 一、背景說明 1.1 效果演示 用python開發的爬蟲採集軟體,可自動抓取抖音評論數據,並且含二級評論! 為什麼有了源碼還開發界面軟體呢?方便不懂編程代碼的小白用戶使用,無需安裝python、無需懂代碼,雙擊打開即用! 軟體界面截圖: 爬取結果截圖: 以上。 1.2 演示視頻 軟體運行演示視頻:見 ...
  • SpringBoot筆記 SpringBoot文檔 官網: https://spring.io/projects/spring-boot 學習文檔: https://docs.spring.io/spring-boot/docs/current/reference/html/ 線上API: http ...
  • 作為後端工程師,多數情況都是給別人提供介面,寫的好不好使你得重視起來。 最近我手頭一些活,需要和外部公司對接,我們需要提供一個介面文檔,這樣可以節省雙方時間、也可以防止後續扯皮。這是就要考驗我的介面是否規範化。 1. 介面名稱清晰、明確 顧名思義,介面是做什麼的,是否準確、清晰?讓使用這一眼就能知道 ...
  • 本文介紹基於Python語言,遍歷文件夾並從中找到文件名稱符合我們需求的多個.txt格式文本文件,並從上述每一個文本文件中,找到我們需要的指定數據,最後得到所有文本文件中我們需要的數據的合集的方法~ ...
  • Java JUC&多線程 基礎完整版 目錄Java JUC&多線程 基礎完整版1、 多線程的第一種啟動方式之繼承Thread類2、多線程的第二種啟動方式之實現Runnable介面3、多線程的第三種實現方式之實現Callable介面4、多線的常用成員方法5、線程的優先順序6、守護線程7、線程的讓出8、線 ...
  • 實時識別關鍵詞是一種能夠將搜索結果提升至新的高度的API介面。它可以幫助我們更有效地分析文本,並提取出關鍵詞,以便進行進一步的處理和分析。 該介面是挖數據平臺提供的,有三種模式:精確模式、全模式和搜索引擎模式。不同的模式在分詞的方式上有所不同,適用於不同的場景。 首先是精確模式。這種模式會儘量將句子 ...
  • 1 為啥要折騰搭建一個專屬圖床? 技術大佬寫博客都用 md 格式,要在多平臺發佈,圖片就得有外鏈 後續如博客遷移,國內博客網站如掘金,簡書,語雀等都做了防盜鏈,圖片無法遷移 2 為啥選擇CloudFlare R2 跳轉:https://dash.cloudflare.com/ 有白嫖額度 免費 CD ...