java 富文本(含图片)导出为docx文件,以及docx文件的合并

2024-06-18 06:28

本文主要是介绍java 富文本(含图片)导出为docx文件,以及docx文件的合并,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

应用场景:

本身是用easypoi来进行导出docx文件的,但是发现easypoi 不支持导出富文本格式。于是有了此场景。

解决思路:

  1. 先把富文本(含图片)内容转为docx文件。
  2. 将easypoi导出的文件 与 富文本转出的docx文件 合并。
  3. 获取到最终文件
  4. 注释清楚的一批,又不会的直接留言。不经常看,回复的可能不及时

使用工具:
使用了e-iceblue依赖,来进行对docx文档的操作(富文本转docx,合并文档)。(缺点就是有水印,需要去除文档中的水印)

用到的依赖(应该有多余的):

 <dependency><groupId>cn.afterturn</groupId><artifactId>easypoi-base</artifactId><version>4.1.0</version></dependency><dependency><groupId>cn.afterturn</groupId><artifactId>easypoi-web</artifactId><version>4.1.0</version></dependency><dependency><groupId>cn.afterturn</groupId><artifactId>easypoi-annotation</artifactId><version>4.1.0</version></dependency><dependency><groupId>org.jsoup</groupId><artifactId>jsoup</artifactId><version>1.13.1</version></dependency><dependency><groupId>org.freemarker</groupId><artifactId>freemarker</artifactId><version>2.3.31</version></dependency><dependency><groupId>e-iceblue</groupId><artifactId>spire.doc</artifactId><version>12.4.1</version></dependency>
<!--poi--><dependency><groupId>org.apache.poi</groupId><artifactId>poi-examples</artifactId><version>3.14</version></dependency></dependencies><repositories><repository><id>com.e-iceblue</id><name>e-iceblue</name><url>http://repo.e-iceblue.cn/repository/maven-public/</url></repository></repositories>

富文本转为docx文档

 /*** 富文本导出为docx文档* @param htmlContext 富文本内容* @param temporaryFileName  导出的临时文件名称* @param titleName  这一块富文本内容的标题,看自己需求* @return* @throws IOException*/private String htmlStringToWord(String htmlContext, String temporaryFileName, String titleName) throws IOException {
//        替换img 标签中  src的代理路径,换成自己的 profile为我图片的保存路径,自己替换htmlContext = htmlContext.replace("/dev-api/profile", profile).replace("/prod-api/profile", profile).replace("http://localhost", "");//临时保存文件路径String filePath = profile + temporaryFilePath + temporaryFileName + ".docx";//新建Document对象com.spire.doc.Document document = new com.spire.doc.Document();
//         在此docx文件中 创一个标题样式-可以不要ParagraphStyle style1 = new ParagraphStyle(document);style1.setName("titleStyle");style1.getCharacterFormat().setBold(true);style1.getCharacterFormat().setFontSize(16f);style1.getCharacterFormat().setFontName("Times New Roman");document.getStyles().add(style1);//添加sectionSection sec = document.addSection();//        先新增一个标题 可以不要Paragraph para1 = sec.addParagraph();
//        titleName 为 方法传入 可以不要para1.appendText(titleName);para1.applyStyle("titleStyle");//        img标签的 正则表达式String imgPattern = "<img\\s+[^>]*src=\"([^\"]*)\"[^>]*>";Pattern pattern = Pattern.compile(imgPattern);Matcher matcher = pattern.matcher(htmlContext);//        创建表格Table table = sec.addTable(true);
//        只有一个单元格table.resetCells(1,1);// 获取左页边距float leftMargin = sec.getPageSetup().getMargins().getLeft();// 获取右页边距float rightMargin = sec.getPageSetup().getMargins().getRight();double pageWidth = sec.getPageSetup().getPageSize().getWidth() - leftMargin - rightMargin;//        获取第(1,1)单元格TableCell cell = table.getRows().get(0).getCells().get(0);int lastIndex = 0;while (matcher.find()) {// 获取 img 标签之前的 HTML 片段String textBeforeImg = htmlContext.substring(lastIndex, matcher.start());// 添加 HTML 片段到段落Paragraph textParagraph = cell.addParagraph();textParagraph.appendHTML(textBeforeImg);// 获取 src 属性的值String imgSrc = matcher.group(1);// 添加图片到新段落Paragraph imgParagraph = cell.addParagraph();DocPicture picture = new DocPicture(document);picture.loadImage(imgSrc);imgParagraph.getChildObjects().insert(0, picture);// 更新 lastIndexlastIndex = matcher.end();}
//        新增表格的段落Paragraph remainingTextParagraph = cell.addParagraph();remainingTextParagraph.appendHTML(htmlContext.substring(lastIndex));
//        表格宽度table.getRows().get(0).getCells().get(0).setCellWidth((float)(pageWidth * 1.3), CellWidthType.Point);//文档另存为docxdocument.saveToFile(filePath, FileFormat.Docx);return filePath;}

合并文档

/*** 合并文档  另起一页合并* @param filePath1  最终留存文件路径* @param filePath2 被合并文档路径* @return*/private String mergeDocx(String filePath1, String filePath2, String finalFilePath){//创建 Document 类的对象并从磁盘加载 Word 文档com.spire.doc.Document document = new com.spire.doc.Document(filePath1);//将另一个文档插入当前文档document.insertTextFromFile(filePath2, FileFormat.Docx);//保存结果文档document.saveToFile(finalFilePath, FileFormat.Docx);return finalFilePath;}/*** 合并文档  内容合并  不另起一页* @param filePath1  最终留存文件路径* @param filePath2 被合并文档路径* @return*/private String mergeDocxFile(String filePath1, String filePath2, String finalFilePath){com.spire.doc.Document document1  = new com.spire.doc.Document(filePath1);com.spire.doc.Document document2  = new com.spire.doc.Document(filePath2);//在第二个文档中循环获取所有节for (Object sectionObj : (Iterable) document2.getSections()) {Section sec=(Section)sectionObj;//在所有节中循环获取所有子对象for (Object docObj :(Iterable ) sec.getBody().getChildObjects()) {DocumentObject obj=(DocumentObject)docObj;//获取第一个文档的最后一节Section lastSection = document1.getLastSection();//将所有子对象添加到第一个文档的最后一节中Body body = lastSection.getBody();body.getChildObjects().add(obj.deepClone());}}//保存结果文档document1.saveToFile(finalFilePath, FileFormat.Docx);return finalFilePath;}

这篇关于java 富文本(含图片)导出为docx文件,以及docx文件的合并的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1071543

相关文章

java如何解压zip压缩包

《java如何解压zip压缩包》:本文主要介绍java如何解压zip压缩包问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录Java解压zip压缩包实例代码结果如下总结java解压zip压缩包坐在旁边的小伙伴问我怎么用 java 将服务器上的压缩文件解压出来,

SpringBoot中SM2公钥加密、私钥解密的实现示例详解

《SpringBoot中SM2公钥加密、私钥解密的实现示例详解》本文介绍了如何在SpringBoot项目中实现SM2公钥加密和私钥解密的功能,通过使用Hutool库和BouncyCastle依赖,简化... 目录一、前言1、加密信息(示例)2、加密结果(示例)二、实现代码1、yml文件配置2、创建SM2工具

Spring WebFlux 与 WebClient 使用指南及最佳实践

《SpringWebFlux与WebClient使用指南及最佳实践》WebClient是SpringWebFlux模块提供的非阻塞、响应式HTTP客户端,基于ProjectReactor实现,... 目录Spring WebFlux 与 WebClient 使用指南1. WebClient 概述2. 核心依

Spring Boot @RestControllerAdvice全局异常处理最佳实践

《SpringBoot@RestControllerAdvice全局异常处理最佳实践》本文详解SpringBoot中通过@RestControllerAdvice实现全局异常处理,强调代码复用、统... 目录前言一、为什么要使用全局异常处理?二、核心注解解析1. @RestControllerAdvice2

Spring IoC 容器的使用详解(最新整理)

《SpringIoC容器的使用详解(最新整理)》文章介绍了Spring框架中的应用分层思想与IoC容器原理,通过分层解耦业务逻辑、数据访问等模块,IoC容器利用@Component注解管理Bean... 目录1. 应用分层2. IoC 的介绍3. IoC 容器的使用3.1. bean 的存储3.2. 方法注

Spring事务传播机制最佳实践

《Spring事务传播机制最佳实践》Spring的事务传播机制为我们提供了优雅的解决方案,本文将带您深入理解这一机制,掌握不同场景下的最佳实践,感兴趣的朋友一起看看吧... 目录1. 什么是事务传播行为2. Spring支持的七种事务传播行为2.1 REQUIRED(默认)2.2 SUPPORTS2

怎样通过分析GC日志来定位Java进程的内存问题

《怎样通过分析GC日志来定位Java进程的内存问题》:本文主要介绍怎样通过分析GC日志来定位Java进程的内存问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、GC 日志基础配置1. 启用详细 GC 日志2. 不同收集器的日志格式二、关键指标与分析维度1.

Java进程异常故障定位及排查过程

《Java进程异常故障定位及排查过程》:本文主要介绍Java进程异常故障定位及排查过程,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、故障发现与初步判断1. 监控系统告警2. 日志初步分析二、核心排查工具与步骤1. 进程状态检查2. CPU 飙升问题3. 内存

java中新生代和老生代的关系说明

《java中新生代和老生代的关系说明》:本文主要介绍java中新生代和老生代的关系说明,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、内存区域划分新生代老年代二、对象生命周期与晋升流程三、新生代与老年代的协作机制1. 跨代引用处理2. 动态年龄判定3. 空间分

Java设计模式---迭代器模式(Iterator)解读

《Java设计模式---迭代器模式(Iterator)解读》:本文主要介绍Java设计模式---迭代器模式(Iterator),具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,... 目录1、迭代器(Iterator)1.1、结构1.2、常用方法1.3、本质1、解耦集合与遍历逻辑2、统一