PDF操作

来源:https://www.cnblogs.com/shiyun32/archive/2023/11/17/17838338.html
-Advertisement-
Play Games

一、概述 生成PDF文檔通常涉及使用模板引擎、PDF庫以及數據填充。常見以下幾種方法: iText:iText是一個強大的PDF庫,支持創建和操作PDF文檔。使用場景: 您可以使用iText來直接構建PDF文檔,也可以將其與模板引擎結合使用,通過數據填充來生成PDF。 Apache PDFBox: ...


一、概述

生成PDF文檔通常涉及使用模板引擎、PDF庫以及數據填充。常見以下幾種方法:

iText:
iText是一個強大的PDF庫,支持創建和操作PDF文檔。
使用場景: 您可以使用iText來直接構建PDF文檔,也可以將其與模板引擎結合使用,通過數據填充來生成PDF。


Apache PDFBox:

PDFBox是Apache軟體基金會的一個項目,提供創建和處理PDF文檔的功能。
使用場景: PDFBox可用於構建PDF文檔,您可以將其用於模板生成PDF。


Apache FOP (Formatting Objects Processor):

FOP是Apache XML Graphics項目的一部分,用於將XML文檔轉換為PDF、PS、PNG等格式。
使用場景: FOP通常與XSL-FO(可擴展樣式語言 - 格式化對象)一起使用,通過XSL-FO模板生成PDF。


Thymeleaf:

Thymeleaf是一個用於Web和獨立環境的現代伺服器端Java模板引擎。
使用場景: Thymeleaf可以用於生成HTML模板,然後通過轉換庫(如Flying Saucer)將HTML轉換為PDF。


Freemarker和Velocity:

Freemarker和Velocity是兩個常見的模板引擎,可以用於生成文本模板。
使用場景: 您可以使用這些引擎生成包含占位符的文本模板,然後使用PDF庫將其轉換為PDF。

 

JasperReports:

簡介: JasperReports是一個用於生成報表的開源報表引擎。
使用場景: JasperReports支持定義報表模板,將數據與模板結合生成PDF報表。

 

Flying Saucer(XHTMLRenderer):

Flying Saucer是一個基於Java的渲染引擎,可將XHTML和CSS轉換為PDF。
使用場景: 您可以使用Flying Saucer來渲染HTML模板,並將其轉換為PDF。

二、使用

 1、word 轉 PDF ,使用aspose工具包

引入jar包:可以通過maven,或者項目本地路徑指定

<!--word轉PDF
    mvn install:install-file -DgroupId=com.aspose -DartifactId=aspose.slides -Dversion=15.9.0 -Dpackaging=jar -Dfile=e:/test/jar/aspose.slides-15.9.0.jar
    mvn install:install-file -DgroupId=com.aspose -DartifactId=aspose-cells -Dversion=8.5.2 -Dpackaging=jar -Dfile=e:/test/jar/aspose-cells-8.5.2.jar
    mvn install:install-file -DgroupId=com.aspose -DartifactId=aspose-words -Dversion=18.6 -Dpackaging=jar -Dfile=e:/test/jar/aspose-words-18.6-jdk16.jar
-->
<dependency>
    <groupId>com.aspose</groupId>
    <artifactId>aspose.slides</artifactId>
    <version>15.9.0</version>
    <!--
    <type>jar</type>
    <scope>system</scope>
    <systemPath>${project.basedir}/src/main/lib/aspose.slides-15.9.0.jar</systemPath>-->
</dependency>

<dependency>
    <groupId>com.aspose</groupId>
    <artifactId>aspose-cells</artifactId>
    <version>8.5.2</version>
    <!--
    <type>jar</type>
    <scope>system</scope>
    <systemPath>${project.basedir}/src/main/lib/aspose-cells-8.5.2.jar</systemPath>-->
</dependency>

<dependency>
    <groupId>com.aspose</groupId>
    <artifactId>aspose-words</artifactId>
    <version>18.6</version>
    <!--
    <type>jar</type>
    <scope>system</scope>
    <systemPath>${project.basedir}/src/main/lib/aspose-words-18.6-jdk16.jar</systemPath>-->
</dependency>

<dependency>
    <groupId>com.itextpdf</groupId>
    <artifactId>itext-asian</artifactId>
    <version>5.2.0</version>
</dependency>
View Code

linux伺服器中文亂碼解決,導出的PDF亂碼如圖:

解決方案
方案1: 環境解決:親測可行,記得安裝後重啟項目
安裝字型檔,將win的c:\windows\fonts下的全部文件拷貝到生產伺服器字體安裝目錄下。
#查看linux目前的所有字體
fc-list
#查看Linux目前的所有中文字體
fc-list :lang=zh
#拷貝到linux下的字體目錄
mkdir /usr/share/fonts/win
#更新系統中字體緩存 
cd /usr/share/fonts
sudo fc-cache -fv
執行命令讓字體生效
source /etc/profile

方案2: 代碼解決(推薦)
a.將window中字體放到linux的/usr/shared/fonts/chinese目錄
b.在aspose代碼中添加:
//linux環境需要配置中文字體:
OsInfo osInfo = SystemUtil.getOsInfo();
if(osInfo.isLinux()){
    FontSettings.getDefaultInstance().setFontsFolder("/usr/share/fonts", true);
}

//新建一個空白pdf文檔,byteArrayInputStream為word的輸入流
com.aspose.words.Document pdf = new com.aspose.words.Document(byteArrayInputStream);
pdf.save(os, SaveFormat.PDF);
os.flush();

 示例

/**
 * 
 * @param docxPath E:\test\docment\c.docx
 * @param pdfPath E:\test\docment\a.pdf
 * @return
 */
public static String convertDocToPdf(String docxPath, String pdfPath) {
    if (!getLicense()) { // 驗證License 若不驗證則轉化出的pdf文檔會有水印產生
        return "PDF格式轉化失敗";
    }
    try {
        // 新建一個空白pdf文檔
        FileOutputStream os = new FileOutputStream(new File(pdfPath));
        Document doc = new Document(docxPath); // Address是將要被轉化的word文檔
        doc.save(os, SaveFormat.PDF);// 全面支持DOC, DOCX, OOXML, RTF HTML,
        os.close();
        return pdfPath;
    } catch (Exception e) {
        e.printStackTrace();
    }
    return "PDF格式轉化失敗";
}

public static boolean getLicense() {
    boolean result = false;

    try {
        // license.xml應放在..\WebRoot\WEB-INF\classes路徑下
//            InputStream is = PdfUtil.class.getClassLoader().getResourceAsStream("license/license.xml");
        InputStream is = PdfUtil.class.getResourceAsStream("license/license.xml");
        License aposeLic = new License();
        aposeLic.setLicense(is);
        result = true;

    } catch (Exception e) {
        e.printStackTrace();
    }
    return result;
}

 2、word 轉 PDF ,使用pdf-gae工具包

缺點:會與itext.jar產生衝突,如果你的項目中已有部分業務使用了itext.jar裡面的內容,則推薦上一種方式。

導入jar包:

<!--convert doc to pdf-->
<dependency>
    <groupId>org.apache.poi</groupId>
    <artifactId>poi</artifactId>
    <version>4.1.2</version>
</dependency>
<dependency>
    <groupId>org.apache.poi</groupId>
    <artifactId>poi-ooxml</artifactId>
    <version>4.1.2</version>
</dependency>
<!--此種轉換方式會與itext衝突:嘗試多次後無法解決-->
<dependency>
    <groupId>fr.opensagres.xdocreport</groupId>
    <artifactId>fr.opensagres.poi.xwpf.converter.pdf-gae</artifactId>
    <version>2.0.2</version>
    <exclusions>
        <exclusion>
            <artifactId>org.apache.poi</artifactId>
            <groupId>poi-ooxml</groupId>
        </exclusion>
    </exclusions>
</dependency>
View Code

示例:

import fr.opensagres.poi.xwpf.converter.pdf.PdfConverter;
import fr.opensagres.poi.xwpf.converter.pdf.PdfOptions;
import org.apache.poi.xwpf.usermodel.XWPFDocument;

import java.io.FileInputStream;
import java.io.FileOutputStream;
import java.io.InputStream;
import java.util.Date;

/**
 * 參考:https://www.cnblogs.com/h-w-b/p/17352151.html
 */
public class WordUtils {
    /**
     * 方式一:會與itext.jar產生衝突,如果你的項目中已有部分業務使用了itext.jar裡面的內容,則推薦其他方式。
     */
    public static void convertDocxToPdf() {
        String pdfFilePath = "E:\\test\\docment\\a.pdf";
        String docxFilePath = "E:\\test\\docment\\c.docx";
        String  targetPaht = "E:\\test\\docment\\" + new Date().getTime()+".pdf";

        try{
            InputStream inputStream = new FileInputStream(docxFilePath);
            FileOutputStream outputStream = new FileOutputStream(targetPaht);
            XWPFDocument xwpfDocument = new XWPFDocument(inputStream);
            PdfOptions pdfOptions = PdfOptions.create();

            PdfConverter.getInstance().convert(xwpfDocument, outputStream, pdfOptions);

            outputStream.flush();
            outputStream.close();
            System.out.println("===========");
        } catch (Exception e) {
            e.printStackTrace();
        }
    }
}

 


您的分享是我們最大的動力!

-Advertisement-
Play Games
更多相關文章
  • Java解析上傳的zip文件--包含Excel解析與圖片上傳 前言:今天遇到一個需求:上傳一個zip格式的壓縮文件,該zip中包含人員信息的excel以及excel中每行對應的人的圖片,現在需要將該zip壓縮包中所有內容解析導入到資料庫中,包括圖片,並將圖片與excel內容對應。 代碼演示: /** ...
  • 十一、指針和引用(一) 1、指針 1)思考 ​ 在電腦程式中,有一條鐵律那就是萬物皆內粗,而我們知道,記憶體就是一個個小格,存放著高電平或者低電平,也就是0或者1,我們要表達的一切都是通過這種二進位的方式放到記憶體中,當我們讀取、寫入,其實局勢在對應的記憶體空間執行讀或者寫操作 ​ 我們今天就研究研究, ...
  • 反面單例 代碼 import java.util.ArrayList; import java.util.List; /** * @since : 2023/11/17 **/ public class StupidSingleton { private static final StupidSin ...
  • C++ 指針學習筆記 引入 指針是什麼 指針是一個變數,其值為另一個變數的地址。 指針聲明的一般形式為: type *ptr_name; type 是指針的基類型,ptr_name 是指針的名稱,* 用來指定一個變數是指針 對於一個指針,需要明確四個方面的內容:指針的類型、指針所指向的類型、指針的值 ...
  • Hi i,m JinXiang ⭐ 前言 ⭐ 本篇文章主要介紹單元測試工具Junit使用以及部分理論知識 🍉歡迎點贊 👍 收藏 ⭐留言評論 📝私信必回喲😁 🍉博主收將持續更新學習記錄獲,友友們有任何問題可以在評論區留言 什麼是Junit單元測試? JUnit 是一個 Java 編程語言的單 ...
  • 聊聊Flink的必知必會(三) 聊聊Flink必知必會(四) 從源碼中,根據關鍵的代碼,梳理一下Flink中的時間與視窗實現邏輯。 WindowedStream 對數據流執行keyBy()操作後,再調用window()方法,就會返回WindowedStream,表示分區後又加窗的數據流。如果數據流沒 ...
  • 大家好,我是棧長。 今天給大家宣佈一個重大消息,又一國產項目宣佈加入 Apache,那就是 Alibaba 開源的分散式事務開源項目:Seata,Apache Seata 來了! 恭喜 Seata 成功加入 Apache 孵化器,走向全球。 說到 Seata,相信使用 Spring Cloud Al ...
  • 學習視頻:【孫哥說Spring5:從設計模式到基本應用到應用級底層分析,一次深入淺出的Spring全探索。學不會Spring?只因你未遇見孫哥】 第十章、對象的生命周期 1.什麼是對象的生命周期 指的是一個對象創建、存活、消亡的一個完整過程 2.為什麼要學習對象的生命周期 由Spring負責對象的創 ...
一周排行
    -Advertisement-
    Play Games
  • 1、預覽地址:http://139.155.137.144:9012 2、qq群:801913255 一、前言 隨著網路的發展,企業對於信息系統數據的保密工作愈發重視,不同身份、角色對於數據的訪問許可權都應該大相徑庭。 列如 1、不同登錄人員對一個數據列表的可見度是不一樣的,如數據列、數據行、數據按鈕 ...
  • 前言 上一篇文章寫瞭如何使用RabbitMQ做個簡單的發送郵件項目,然後評論也是比較多,也是準備去學習一下如何確保RabbitMQ的消息可靠性,但是由於時間原因,先來說說設計模式中的簡單工廠模式吧! 在瞭解簡單工廠模式之前,我們要知道C#是一款面向對象的高級程式語言。它有3大特性,封裝、繼承、多態。 ...
  • Nodify學習 一:介紹與使用 - 可樂_加冰 - 博客園 (cnblogs.com) Nodify學習 二:添加節點 - 可樂_加冰 - 博客園 (cnblogs.com) 介紹 Nodify是一個WPF基於節點的編輯器控制項,其中包含一系列節點、連接和連接器組件,旨在簡化構建基於節點的工具的過程 ...
  • 創建一個webapi項目做測試使用。 創建新控制器,搭建一個基礎框架,包括獲取當天日期、wiki的請求地址等 創建一個Http請求幫助類以及方法,用於獲取指定URL的信息 使用http請求訪問指定url,先運行一下,看看返回的內容。內容如圖右邊所示,實際上是一個Json數據。我們主要解析 大事記 部 ...
  • 最近在不少自媒體上看到有關.NET與C#的資訊與評價,感覺大家對.NET與C#還是不太瞭解,尤其是對2016年6月發佈的跨平臺.NET Core 1.0,更是知之甚少。在考慮一番之後,還是決定寫點東西總結一下,也回顧一下.NET的發展歷史。 首先,你沒看錯,.NET是跨平臺的,可以在Windows、 ...
  • Nodify學習 一:介紹與使用 - 可樂_加冰 - 博客園 (cnblogs.com) Nodify學習 二:添加節點 - 可樂_加冰 - 博客園 (cnblogs.com) 添加節點(nodes) 通過上一篇我們已經創建好了編輯器實例現在我們為編輯器添加一個節點 添加model和viewmode ...
  • 前言 資料庫併發,數據審計和軟刪除一直是數據持久化方面的經典問題。早些時候,這些工作需要手寫複雜的SQL或者通過存儲過程和觸發器實現。手寫複雜SQL對軟體可維護性構成了相當大的挑戰,隨著SQL字數的變多,用到的嵌套和複雜語法增加,可讀性和可維護性的難度是幾何級暴漲。因此如何在實現功能的同時控制這些S ...
  • 類型檢查和轉換:當你需要檢查對象是否為特定類型,並且希望在同一時間內將其轉換為那個類型時,模式匹配提供了一種更簡潔的方式來完成這一任務,避免了使用傳統的as和is操作符後還需要進行額外的null檢查。 複雜條件邏輯:在處理複雜的條件邏輯時,特別是涉及到多個條件和類型的情況下,使用模式匹配可以使代碼更 ...
  • 在日常開發中,我們經常需要和文件打交道,特別是桌面開發,有時候就會需要載入大批量的文件,而且可能還會存在部分文件缺失的情況,那麼如何才能快速的判斷文件是否存在呢?如果處理不當的,且文件數量比較多的時候,可能會造成卡頓等情況,進而影響程式的使用體驗。今天就以一個簡單的小例子,簡述兩種不同的判斷文件是否... ...
  • 前言 資料庫併發,數據審計和軟刪除一直是數據持久化方面的經典問題。早些時候,這些工作需要手寫複雜的SQL或者通過存儲過程和觸發器實現。手寫複雜SQL對軟體可維護性構成了相當大的挑戰,隨著SQL字數的變多,用到的嵌套和複雜語法增加,可讀性和可維護性的難度是幾何級暴漲。因此如何在實現功能的同時控制這些S ...