Java操作Miscrosoft Office各类文件格式的开源免费工具库

Aspose.Words库
复制代码
是一个商业Java库,还封装了常用的word、pdf、防伪码、水印等诸多功能。

Apache 库需要注意的前置问题

复制代码
问题1:Word的两个格式doc和docx,POI并没有提供统一的处理类。分别用 HWPFDocument 处理doc文档,用 XWPFTemplate 处理docx文档。
HWPFDocument 处理doc文档
XWPFTemplate 处理docx文档
解决方法1:将.doc文件转成.docx格式,处理完后再转回来。
解决方法2:(待验证)可以前置统一将.doc名字重命名成.docx,如果严格要求格式,处理完后再把名字改回去。
Excel(xls和xlsx)同理。
Miscrosoft Office各类文件格式的读写:
复制代码
Apache POI库
Apache POI是一个开源的Java库,用于操作Microsoft Office格式的文件。
它支持各种Office文档的读写功能,包括Word文档、Excel电子表格、PowerPoint演示文稿、Outlook电子邮件等。
Apache POI提供了一组API,使得Java开发者能够轻松地在Java应用程序中处理Office文件。
Java 将 Word 文档转换为 PDF
复制代码
使用PdfConverter工具类,如下:
import org.apache.poi.xwpf.usermodel.XWPFDocument;
import org.apache.poi.xwpf.converter.pdf.PdfConverter;
import org.apache.poi.xwpf.converter.pdf.PdfOptions;
public class Word2PdfByApachePOI {
	public start void main(String[] args) throws Exception {
		// 读取word目标文件
		XWPFDocument docx = new XWPFDocument(new FileInputStream("xxxx/input.docx"));
	
		//创建pdf选项
		PdfOptions options = PdfOptions.create();
		
		// word转为pdf
		PdfConverter.getInstance().convert(docx, new FileOutputStream("output.pdf"),options);
	}
}
PDF操作
复制代码
Apache PDFBox库是一个开源的Java工具,专门用于处理PDF文档。
它允许用户创建全新的PDF文件,编辑现有的PDF文档,以及从PDF文件中提取内容。

功能:创建、渲染、打印、合并、拆分、加密、解密、签名等多种操作PDF文件的功能,包括一个命令行工具,可以用于执行各种PDF处理任务。
支持文本提取和搜索,以及将PDF转换为其他格式,如图片和文本。

Apache PDFBox具备以下主要功能:
	从PDF文件中提取Unicode文本。
	将单个PDF文件拆分成多个文件,或将多个PDF文件合并成一个。
	从PDF表单中提取数据,或填写PDF表单。
	验证PDF文件是否符合PDF/A-1b标准。
	使用标准的Java打印API打印PDF文件。
	将PDF文件另存为图像格式,如PNG或JPEG。
	从零开始创建PDF文件,包括嵌入字体和图像。
	对PDF文件进行数字签名。
相关推荐
码语智行3 小时前
导入模板下载
java
RuoyiOffice3 小时前
2026 企业定制开发选型:从零开发、低代码、SaaS 与 RuoYi Office 怎么选?
spring boot·uni-app·开源·saas·oa·定制化·ruoyioffice
闪电悠米3 小时前
黑马点评-秒杀优化-04_lua_and_db_fallback
服务器·开发语言·网络·数据库·缓存·junit·lua
Shadow(⊙o⊙)3 小时前
进程间通信0.0-pipe()匿名管道,详细分析进程池调度队列执行逻辑,进程池模拟实现。
linux·运维·服务器·开发语言·c++
狗凯之家源码网3 小时前
电商代付系统从零搭建与实战指南
前端·后端·开源
摇滚侠3 小时前
IDEA 创建 Java 项目 推送到远程 Git 仓库
java·git·intellij-idea
指尖的爷3 小时前
C++头文件的作用
开发语言·c++
keykey6.3 小时前
反向传播与梯度下降:神经网络如何学习
开发语言·人工智能·深度学习·机器学习
可乐ea3 小时前
【知识获取与分享社区项目 | 项目日记第 24 天】终章总结:从认证、发布、计数、Feed、搜索到 RAG:完整复盘一个知识社区后端系统
java·spring boot·redis·mysql·elasticsearch·ai·kafka
Jun6263 小时前
QT(5)-第三方日志系统
开发语言·数据库·qt