java将doc文件转pdf

将doc文件转为pdf

itextpdf+poi 方案,针对doc文件,非docx

缺点,不支持负责的格式,不支持图标,图片等。

需要的依赖

xml 复制代码
  <!-- https://mvnrepository.com/artifact/com.itextpdf/itextpdf -->
        <dependency>
            <groupId>com.itextpdf</groupId>
            <artifactId>itextpdf</artifactId>
            <version>5.5.13.3</version>
        </dependency>
       <!-- https://mvnrepository.com/artifact/org.apache.poi/poi-ooxml -->
        <dependency>
            <groupId>org.apache.poi</groupId>
            <artifactId>poi-ooxml</artifactId>
            <version>4.1.2</version>
        </dependency>
        <!-- https://mvnrepository.com/artifact/org.apache.poi/poi-ooxml-schemas -->
        <dependency>
            <groupId>org.apache.poi</groupId>
            <artifactId>poi-ooxml-schemas</artifactId>
            <version>4.1.2</version>
        </dependency>
        <dependency>
            <groupId>org.apache.poi</groupId>
            <artifactId>ooxml-schemas</artifactId>
            <version>1.1</version>
        </dependency>
        <!-- https://mvnrepository.com/artifact/org.apache.poi/poi-scratchpad -->
        <dependency>
            <groupId>org.apache.poi</groupId>
            <artifactId>poi-scratchpad</artifactId>
            <version>4.1.2</version>
        </dependency>

java代码

java 复制代码
import com.google.common.io.Files;
import com.itextpdf.text.Document;
import com.itextpdf.text.DocumentException;
import com.itextpdf.text.Font;
import com.itextpdf.text.Paragraph;
import com.itextpdf.text.pdf.BaseFont;
import com.itextpdf.text.pdf.PdfWriter;
import lombok.extern.slf4j.Slf4j;
import org.apache.poi.hwpf.HWPFDocument;
import org.apache.poi.hwpf.extractor.WordExtractor;

import java.io.*;

/**
 * @Description 将doc文件转换为pdf
 */
@Slf4j
public class DocToPdfUtil {

    public static void toPdf(File orgFile, String outputFile) throws IOException {
        File file = new File(outputFile);
        try {
            ByteArrayOutputStream outputStream = toPdf(orgFile);
            Files.write(outputStream.toByteArray(), new File(outputFile));
        } catch (Exception e) {
            e.printStackTrace();
        }
    }

    public static ByteArrayOutputStream toPdf(File file) throws IOException, DocumentException {
        Document pdfDoc = null;
        WordExtractor extractor = null;
        try {
            // 读取DOC文件
            HWPFDocument doc = new HWPFDocument(new FileInputStream(file));
            extractor = new WordExtractor(doc);

            ByteArrayOutputStream outputStream = new ByteArrayOutputStream();
            // 创建PDF文档
            pdfDoc = new Document();
            PdfWriter.getInstance(pdfDoc, outputStream);
            pdfDoc.open();

            // 写入内容
            String[] paragraphs = extractor.getParagraphText();
            // 加载中文字体
            BaseFont baseFont = BaseFont.createFont("STSong-Light", "UniGB-UCS2-H", BaseFont.EMBEDDED);
            Font font = new Font(baseFont, 12);

            for (String text : paragraphs) {
                Paragraph p = new Paragraph(text, font);
                pdfDoc.add(p);
            }
            log.info("==========doc转换pdf成功===============" + file.getAbsolutePath());
            return outputStream;
        } catch (Exception e) {
            log.info("==========doc转换pdf失败===============" + file.getAbsolutePath());
            e.printStackTrace();
            throw e;
        } finally {
            // 关闭资源
            if (null != pdfDoc) {
                pdfDoc.close();
            }
            if (null != extractor) {
                extractor.close();
            }
        }
    }
}

测试用例

java 复制代码
 DocToPdfUtil.toPdf(new File("C:\\mydoc\\明朝那点事.doc"), "C:\\mydoc\\明朝那点事" + System.currentTimeMillis() + ".pdf");

遇到的问题

转换的文件不显示中文

原因:字体问题,请设置字体。

java 复制代码
// 加载中文字体
            BaseFont baseFont = BaseFont.createFont("STSong-Light", "UniGB-UCS2-H", BaseFont.EMBEDDED);
            Font font = new Font(baseFont, 12);
相关推荐
前端赵哈哈9 分钟前
初学者入门:Android 实现 Tab 点击切换(TabLayout + ViewPager2)
android·java·android studio
jokr_10 分钟前
C++ 指针与引用面试深度解析
java·c++·面试
杨杨杨大侠11 分钟前
第6篇:链路追踪系统 - 分布式环境下的请求跟踪
java·后端·apache log4j
乘风归趣11 分钟前
spire.doc在word中生成公式
java·开发语言·word
kong@react18 分钟前
docker部署spring boot,安装jdk17、maven3.8.8详细步骤
java·spring boot·docker
莹莹啦19 分钟前
聊一聊Java线程池的核心参数
java·后端
猿java34 分钟前
Java String.replace()原理,你真的了解吗?
java·面试·架构
SimonKing43 分钟前
优雅地实现ChatGPT式的打字机效果:Spring流式响应
java·后端·程序员
long3161 小时前
状态设计模式
java·学习·程序人生·设计模式·状态模式·state-pattern
一根会骑马的Banana1 小时前
关于DTO、DO、BO、VO
java