java - Docx4J 表字体类型被忽略-6ren

java - Docx4J 表字体类型被忽略

转载作者：行者123 更新时间：2023-12-01 22:37:45

27

4

我正在尝试使用 DOCX4J 将 HTML 转换为 Docx。我们正在使用以下代码。除了最终 Docx 文件中的表格文本始终为 Calibiri 之外，所有转换均有效。我们尝试在代码、CSS 和 Docx4J 中处理这个问题，但在过去几天没有取得任何成功。如果您能提供帮助，那就太好了。

public String xhtmlToDocx(List<String> fileData, File destinationFile) {

    try {
        InputStream in;
        in = new FileInputStream(new File(TCellUtil.TCELL_DATA_LOG_FOLDER_PATH + File.separator + "Header_Temp.docx"));
        WordprocessingMLPackage wordMLPackage = WordprocessingMLPackage.load(in);
        System.out.println("before");
        for (String s : wordMLPackage.getMainDocumentPart().fontsInUse())
            System.out.println(s);
        System.out.println("aFTER ");
        VariablePrepare.prepare(wordMLPackage);

        RFonts rfonts = Context.getWmlObjectFactory().createRFonts();
        rfonts.setAscii("Times New Roman");
        rfonts.setHAnsi("Times New Roman");
        rfonts.setEastAsia("Times New Roman");
        XHTMLImporterImpl.addFontMapping("Times New Roman", rfonts);
        wordMLPackage.getMainDocumentPart().getPropertyResolver().getDocumentDefaultRPr().setRFonts(rfonts);

        int c = 1;
        for (String xhtml : fileData) {
            String file_data = "<html>" + xhtml + "</html>";
            AlternativeFormatInputPart afiPart = new AlternativeFormatInputPart(new PartName("/hw" + c + ".html"));
            afiPart.setContentType(new ContentType("text/html"));
            afiPart.setBinaryData(file_data.getBytes());

            Relationship altChunkRel = wordMLPackage.getMainDocumentPart().addTargetPart(afiPart, AddPartBehaviour.REUSE_EXISTING);
            CTAltChunk ac = Context.getWmlObjectFactory().createCTAltChunk();
            ac.setId(altChunkRel.getId());
            wordMLPackage.getMainDocumentPart().addObject(ac);
            wordMLPackage.getMainDocumentPart().addObject(createPageBreak());
            ((CTSettings) wordMLPackage.getMainDocumentPart().getDocumentSettingsPart().getJaxbElement()).setUpdateFields(new BooleanDefaultTrue());
            wordMLPackage.getMainDocumentPart().convertAltChunks();

            for (String s : wordMLPackage.getMainDocumentPart().fontsInUse())
                System.out.println(s);
            wordMLPackage.getContentTypeManager().addDefaultContentType("docx", "text/html");
            c++;
        }
        XmlUtils.marshaltoString(wordMLPackage.getMainDocumentPart().getJaxbElement(), true, true);
        wordMLPackage.save(destinationFile);
        this.dest_filePath = destinationFile.getAbsolutePath();

        return this.dest_filePath;
    } catch (Docx4JException var12) {
        var12.printStackTrace();
    } catch (Exception var13) {
        var13.printStackTrace();
    }
    return null;
}

最佳答案

首先要了解是 docx4j 进行转换，还是 Word 进行转换。

如果您专门调用 docx4j-ImportXHTML，或者使用了convertAltChunks()，docx4j 会尝试执行此操作。请注意，docx4j 仅转换 XHTML 类型(即不是 HTML)的 altChunk。因此，如果它是 HTML altChunk，Word 就会进行转换。

在您发布的代码中:

           AlternativeFormatInputPart afiPart = new AlternativeFormatInputPart(new PartName("/hw"+c+".html"));

                   afiPart.setContentType(new ContentType("text/html"));

            afiPart.setBinaryData(file_data.getBytes());

所以是 Word 进行转换(并在表格中使用 Calibri)。

此外，请务必检查您的 (X)HTML 是否是格式良好的 XML。如果不是，您需要更正您的输入，无论是在发出它的系统中，还是使用一些“整洁”的代码。

第一步，确保 https://github.com/plutext/docx4j-ImportXHTML/blob/master/src/samples/java/org/docx4j/samples/ConvertInXHTMLFile.java可以处理。

关于java - Docx4J 表字体类型被忽略，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/58516986/

27

4

0

文章推荐： legend - Grafana:自定义图例值？

文章推荐：正则表达式:匹配除反向引用之外的所有内容

文章推荐： Delphi TList 复制到另一个 TList 中？

gitconfig 忽略 includeIf
我正在尝试设置我的 git 配置，以便我可以使用工作环境和个人环境。这是我的 ~.gitconfig 文件的内容(碰巧 work 和 private 在 github 上): [url "git@
excel - 当单元格包含特定文本时不要复制(忽略)
我有以下情况。我在 Sheet1 上有一个项目列表，我想将项目复制到 Sheet2 并排除特定项目。假设我在 Sheet1 上有以下项目列表: 我想将“梨”单元格留在 Sheet2 上。它应该完全
gcc 忽略 LC_ALL
我试图让 gcc 以不同的语言提供错误消息。但它仍然给我英文的错误信息。我的语言环境输出 varun@varun-desktop:$ 语言环境 LANG=en_IN LC_CTYPE="es_EC.
GCC 忽略 cdecl？
我在 Linux x86 上使用 gcc。我的程序将指向 C 函数的指针导出到 LLVM JIT 函数。调用约定是 cdecl。它在 Windows 上的 MingW 上运行良好。但是奇怪的事情发生
php - require_once 忽略
windows 上 php 的奇怪问题...我的应用程序加载了一个“核心”文件，该文件加载了一个设置文件、注册自动加载、进行初始化等。在核心文件的顶部我有 include_once("config.p
delphi - 在构建配置中设置调试器语言异常(忽略)
在工具|选项|调试器选项 |语言异常可以忽略特定的异常类型。是否可以为每个项目定义这个？例如在调试构建配置中(Delphi 2009 和/或 2010)？ /编辑:Reported in QC 最佳答
Safari 忽略 tabindex
我在一个文本框旁边有 2 个按钮，在这 2 个按钮后面还有另一个文本框。第一个文本框的 tabindex 为 1000，第一个按钮为 1001，第二个按钮为 1002。第二个文本框的 tabindex
忽略 Python 类型提示
我是 python 新手，正在尝试类型提示，但它们似乎只在某些情况下起作用。它们似乎在属性返回类型上按预期工作，但是当我尝试将整数分配给字符串值(即 self._my_string = 4)时，我没有
VBA:忽略 For-Each 循环中的条件
问题陈述我有一些国家和这些国家的州的依赖组合框。我使用 VBA 在第一个组合框中填充唯一值，然后在第二个组合框中动态填充唯一值。该代码似乎忽略了初始传递中的条件。例如，该代码适用于第一个国家/地区
Javascript 忽略 if 语句
我对 Javascript 有点陌生。我试图做到这一点，以便单击一个页面上的图像会将您带到一个新页面，并在该新页面上显示特定的 div，因此我使用 sessionStorage 来记住并使用 bool
javascript - 忽略@RenderBody()
我不确定我是否正确地处理了这个问题。我有一个 ASP.NET MVC Web 应用程序。有 4 个主要“页面”通过单击菜单选项，可以选择一个页面，并将该页面选项存储在本地存储中。现在，如果我刷新页
javascript - 忽略/不转换时区？
我的页面工作正常，并按预期显示日期和时间，直到我不得不添加 new Date() 以避免 momentjs deprecation warning 。现在我的约会比应有的时间晚了 5 个小时。我该如
忽略 $Id 行的合并工具
我需要合并一个 fork 项目。不幸的是，CVS $Id 行不同，因此我尝试的合并工具报告所有文件都不同(其中 95% 只有这一行不同) 是否有一个合并工具可以配置为忽略基于模式的行比较结果？ [编辑
忽略 Python 类型提示
我是 python 新手，正在尝试类型提示，但它们似乎只在某些情况下起作用。它们似乎在属性返回类型上按预期工作，但是当我尝试将整数分配给字符串值(即 self._my_string = 4)时，我没有
HttpsURLConnection 忽略 setSSLSocketFactory
我正在尝试根据 How do a send an HTTPS request through a proxy in Java? 使用代理访问 https 网页但是我遇到了一个奇怪的问题:HttpsU
CMake 忽略 library_output_name
我有一个简单的 CMakeLists.txt 文件: cmake_minimum_required(VERSION 2.8.9) project (sample) add_library(Shared
忽略 Const 限定符
这个问题在这里已经有了答案: typedef pointer const weirdness (6 个答案) 关闭 8 年前。我有一个结构体 type_s。然后我将指向 struct type_s
CryptEncrypt 忽略 HASH？
我正在尝试制作一个使用 AES 256 加密的应用程序。不幸的是我无法让它工作。也许我没有完全理解密码逻辑。所以它正在工作，但据我了解，哈希包含密码。但如果我更改密码，输出是相同的。因此，Crypt
java - 提取引号之间的子字符串，忽略\"
我的文件包含一些行，例如 "This is a string." = "This is a string's content." " Another \" example \"" = " New ex
Mysql - 忽略 where 子句中的状态
我尝试使用此查询来获取所选健身房的所有用户。我的问题是查询忽略了这部分:ual.user_id = weekUsers.user_id 查询似乎获取了与我选择的日期匹配的所有用户 ID，而不检查该用

首页

博学

6Ren·AI

商城

java - Docx4J 表字体类型被忽略