java 富文本(含图片)导出为docx文件,以及docx文件的合并

2024-06-18 06:28

本文主要是介绍java 富文本(含图片)导出为docx文件,以及docx文件的合并,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

应用场景:

本身是用easypoi来进行导出docx文件的,但是发现easypoi 不支持导出富文本格式。于是有了此场景。

解决思路:

  1. 先把富文本(含图片)内容转为docx文件。
  2. 将easypoi导出的文件 与 富文本转出的docx文件 合并。
  3. 获取到最终文件
  4. 注释清楚的一批,又不会的直接留言。不经常看,回复的可能不及时

使用工具:
使用了e-iceblue依赖,来进行对docx文档的操作(富文本转docx,合并文档)。(缺点就是有水印,需要去除文档中的水印)

用到的依赖(应该有多余的):

 <dependency><groupId>cn.afterturn</groupId><artifactId>easypoi-base</artifactId><version>4.1.0</version></dependency><dependency><groupId>cn.afterturn</groupId><artifactId>easypoi-web</artifactId><version>4.1.0</version></dependency><dependency><groupId>cn.afterturn</groupId><artifactId>easypoi-annotation</artifactId><version>4.1.0</version></dependency><dependency><groupId>org.jsoup</groupId><artifactId>jsoup</artifactId><version>1.13.1</version></dependency><dependency><groupId>org.freemarker</groupId><artifactId>freemarker</artifactId><version>2.3.31</version></dependency><dependency><groupId>e-iceblue</groupId><artifactId>spire.doc</artifactId><version>12.4.1</version></dependency>
<!--poi--><dependency><groupId>org.apache.poi</groupId><artifactId>poi-examples</artifactId><version>3.14</version></dependency></dependencies><repositories><repository><id>com.e-iceblue</id><name>e-iceblue</name><url>http://repo.e-iceblue.cn/repository/maven-public/</url></repository></repositories>

富文本转为docx文档

 /*** 富文本导出为docx文档* @param htmlContext 富文本内容* @param temporaryFileName  导出的临时文件名称* @param titleName  这一块富文本内容的标题,看自己需求* @return* @throws IOException*/private String htmlStringToWord(String htmlContext, String temporaryFileName, String titleName) throws IOException {
//        替换img 标签中  src的代理路径,换成自己的 profile为我图片的保存路径,自己替换htmlContext = htmlContext.replace("/dev-api/profile", profile).replace("/prod-api/profile", profile).replace("http://localhost", "");//临时保存文件路径String filePath = profile + temporaryFilePath + temporaryFileName + ".docx";//新建Document对象com.spire.doc.Document document = new com.spire.doc.Document();
//         在此docx文件中 创一个标题样式-可以不要ParagraphStyle style1 = new ParagraphStyle(document);style1.setName("titleStyle");style1.getCharacterFormat().setBold(true);style1.getCharacterFormat().setFontSize(16f);style1.getCharacterFormat().setFontName("Times New Roman");document.getStyles().add(style1);//添加sectionSection sec = document.addSection();//        先新增一个标题 可以不要Paragraph para1 = sec.addParagraph();
//        titleName 为 方法传入 可以不要para1.appendText(titleName);para1.applyStyle("titleStyle");//        img标签的 正则表达式String imgPattern = "<img\\s+[^>]*src=\"([^\"]*)\"[^>]*>";Pattern pattern = Pattern.compile(imgPattern);Matcher matcher = pattern.matcher(htmlContext);//        创建表格Table table = sec.addTable(true);
//        只有一个单元格table.resetCells(1,1);// 获取左页边距float leftMargin = sec.getPageSetup().getMargins().getLeft();// 获取右页边距float rightMargin = sec.getPageSetup().getMargins().getRight();double pageWidth = sec.getPageSetup().getPageSize().getWidth() - leftMargin - rightMargin;//        获取第(1,1)单元格TableCell cell = table.getRows().get(0).getCells().get(0);int lastIndex = 0;while (matcher.find()) {// 获取 img 标签之前的 HTML 片段String textBeforeImg = htmlContext.substring(lastIndex, matcher.start());// 添加 HTML 片段到段落Paragraph textParagraph = cell.addParagraph();textParagraph.appendHTML(textBeforeImg);// 获取 src 属性的值String imgSrc = matcher.group(1);// 添加图片到新段落Paragraph imgParagraph = cell.addParagraph();DocPicture picture = new DocPicture(document);picture.loadImage(imgSrc);imgParagraph.getChildObjects().insert(0, picture);// 更新 lastIndexlastIndex = matcher.end();}
//        新增表格的段落Paragraph remainingTextParagraph = cell.addParagraph();remainingTextParagraph.appendHTML(htmlContext.substring(lastIndex));
//        表格宽度table.getRows().get(0).getCells().get(0).setCellWidth((float)(pageWidth * 1.3), CellWidthType.Point);//文档另存为docxdocument.saveToFile(filePath, FileFormat.Docx);return filePath;}

合并文档

/*** 合并文档  另起一页合并* @param filePath1  最终留存文件路径* @param filePath2 被合并文档路径* @return*/private String mergeDocx(String filePath1, String filePath2, String finalFilePath){//创建 Document 类的对象并从磁盘加载 Word 文档com.spire.doc.Document document = new com.spire.doc.Document(filePath1);//将另一个文档插入当前文档document.insertTextFromFile(filePath2, FileFormat.Docx);//保存结果文档document.saveToFile(finalFilePath, FileFormat.Docx);return finalFilePath;}/*** 合并文档  内容合并  不另起一页* @param filePath1  最终留存文件路径* @param filePath2 被合并文档路径* @return*/private String mergeDocxFile(String filePath1, String filePath2, String finalFilePath){com.spire.doc.Document document1  = new com.spire.doc.Document(filePath1);com.spire.doc.Document document2  = new com.spire.doc.Document(filePath2);//在第二个文档中循环获取所有节for (Object sectionObj : (Iterable) document2.getSections()) {Section sec=(Section)sectionObj;//在所有节中循环获取所有子对象for (Object docObj :(Iterable ) sec.getBody().getChildObjects()) {DocumentObject obj=(DocumentObject)docObj;//获取第一个文档的最后一节Section lastSection = document1.getLastSection();//将所有子对象添加到第一个文档的最后一节中Body body = lastSection.getBody();body.getChildObjects().add(obj.deepClone());}}//保存结果文档document1.saveToFile(finalFilePath, FileFormat.Docx);return finalFilePath;}

这篇关于java 富文本(含图片)导出为docx文件,以及docx文件的合并的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1071543

相关文章

Java StringBuilder 实现原理全攻略

《JavaStringBuilder实现原理全攻略》StringBuilder是Java提供的可变字符序列类,位于java.lang包中,专门用于高效处理字符串的拼接和修改操作,本文给大家介绍Ja... 目录一、StringBuilder 基本概述核心特性二、StringBuilder 核心实现2.1 内部

Android实现图片浏览功能的示例详解(附带源码)

《Android实现图片浏览功能的示例详解(附带源码)》在许多应用中,都需要展示图片并支持用户进行浏览,本文主要为大家介绍了如何通过Android实现图片浏览功能,感兴趣的小伙伴可以跟随小编一起学习一... 目录一、项目背景详细介绍二、项目需求详细介绍三、相关技术详细介绍四、实现思路详细介绍五、完整实现代码

SpringBoot AspectJ切面配合自定义注解实现权限校验的示例详解

《SpringBootAspectJ切面配合自定义注解实现权限校验的示例详解》本文章介绍了如何通过创建自定义的权限校验注解,配合AspectJ切面拦截注解实现权限校验,本文结合实例代码给大家介绍的非... 目录1. 创建权限校验注解2. 创建ASPectJ切面拦截注解校验权限3. 用法示例A. 参考文章本文

Java中字符编码问题的解决方法详解

《Java中字符编码问题的解决方法详解》在日常Java开发中,字符编码问题是一个非常常见却又特别容易踩坑的地方,这篇文章就带你一步一步看清楚字符编码的来龙去脉,并结合可运行的代码,看看如何在Java项... 目录前言背景:为什么会出现编码问题常见场景分析控制台输出乱码文件读写乱码数据库存取乱码解决方案统一使

Java Stream流与使用操作指南

《JavaStream流与使用操作指南》Stream不是数据结构,而是一种高级的数据处理工具,允许你以声明式的方式处理数据集合,类似于SQL语句操作数据库,本文给大家介绍JavaStream流与使用... 目录一、什么是stream流二、创建stream流1.单列集合创建stream流2.双列集合创建str

springboot集成easypoi导出word换行处理过程

《springboot集成easypoi导出word换行处理过程》SpringBoot集成Easypoi导出Word时,换行符n失效显示为空格,解决方法包括生成段落或替换模板中n为回车,同时需确... 目录项目场景问题描述解决方案第一种:生成段落的方式第二种:替换模板的情况,换行符替换成回车总结项目场景s

SpringBoot集成redisson实现延时队列教程

《SpringBoot集成redisson实现延时队列教程》文章介绍了使用Redisson实现延迟队列的完整步骤,包括依赖导入、Redis配置、工具类封装、业务枚举定义、执行器实现、Bean创建、消费... 目录1、先给项目导入Redisson依赖2、配置redis3、创建 RedissonConfig 配

SpringBoot中@Value注入静态变量方式

《SpringBoot中@Value注入静态变量方式》SpringBoot中静态变量无法直接用@Value注入,需通过setter方法,@Value(${})从属性文件获取值,@Value(#{})用... 目录项目场景解决方案注解说明1、@Value("${}")使用示例2、@Value("#{}"php

SpringBoot分段处理List集合多线程批量插入数据方式

《SpringBoot分段处理List集合多线程批量插入数据方式》文章介绍如何处理大数据量List批量插入数据库的优化方案:通过拆分List并分配独立线程处理,结合Spring线程池与异步方法提升效率... 目录项目场景解决方案1.实体类2.Mapper3.spring容器注入线程池bejsan对象4.创建

线上Java OOM问题定位与解决方案超详细解析

《线上JavaOOM问题定位与解决方案超详细解析》OOM是JVM抛出的错误,表示内存分配失败,:本文主要介绍线上JavaOOM问题定位与解决方案的相关资料,文中通过代码介绍的非常详细,需要的朋... 目录一、OOM问题核心认知1.1 OOM定义与技术定位1.2 OOM常见类型及技术特征二、OOM问题定位工具