在 Java 快速解析 PDF:文本、表格、图像与元数据
|
028-81705109
|
|
微信扫一扫
|

Spire.Cloud 纯前端文档控件

在 Java 快速解析 PDF:文本、表格、图像与元数据

Java 中解析 PDF 文档的完整指南:文本、表格、图像、元数据

在 Java 应用中,PDF 解析(PDF parsing in Java)通常用于从 PDF 文件中提取可用信息,而不仅仅是将其渲染出来进行展示。常见的应用场景包括文档索引、自动化报表处理、发票分析以及数据采集与导入流程等。

与 JSON、XML 等结构化数据格式不同,PDF 的设计目标是保证视觉呈现效果的一致性。文本、表格、图像等内容在 PDF 中并不是以逻辑结构存储的,而是以带有坐标信息的绘制指令形式存在。因此,在 Java 中进行 PDF 解析,核心在于理解 PDF 内部的内容表示方式,以及 Java PDF 库是如何通过 API 将这些内容暴露出来的。

本文将基于 Spire.PDF for Java,从实际开发角度出发,介绍在 Java 项目中常见的 PDF 解析操作。文章不会将 PDF 解析视为一个单一的线性流程,而是按功能划分,分别讲解文本、表格、图像和元数据的提取方式,便于在真实项目中按需组合使用。

目录

从实现角度理解 Java 中的 PDF 解析

从实践层面来看,Java 中的 PDF 解析并不是一个单一操作,而是一组针对同一 PDF 文档执行的不同数据提取任务,具体取决于应用需要获取哪类信息。

在实际系统中,PDF 解析通常用于获取以下内容:

  • 纯文本内容,用于搜索、索引或文本分析
  • 结构化数据(如表格),用于后续处理或存储
  • 嵌入资源(如图片),用于归档或下游处理
  • 文档元数据,用于分类、审计或版本管理

PDF 解析之所以复杂,根本原因在于 PDF 的内容存储方式。与结构化文档不同,PDF 并不会显式保存段落、行或表格等逻辑结构,而是主要由以下内容组成:

  • 页面级内容流
  • 通过坐标定位的文本片段
  • 用于构成视觉结构的图形元素(图片、线条、间距、边框等)

因此,Java 中的 PDF 解析本质上是基于页面布局信息还原内容语义的过程。这也是为什么在实际项目中,往往需要借助专业的 PDF 解析库:它既能暴露底层页面内容,又提供了文本提取、表格识别等高级功能,从而减少手写解析逻辑的复杂度。

Java 中实用的 PDF 解析思路

在生产环境中,PDF 解析更适合被设计为一组可独立调用的解析操作,而不是固定顺序的流水线。这种设计方式有助于隔离错误,也能让应用只执行真正需要的解析逻辑。

本文使用 Spire.PDF for Java 作为示例库。它提供了文本提取、表格解析、图像导出和元数据访问等 API,适用于后端服务、批量任务以及文档自动化系统。

安装 Spire.PDF for Java

你可以从 Spire.PDF for Java 下载页面 下载并手动引入依赖。如果项目使用 Maven,也可以通过以下配置进行安装:

<repositories>
    <repository>
        <id>com.e-iceblue</id>
        <name>e-iceblue</name>
        <url>https://repo.e-iceblue.cn/repository/maven-public/</url>
    </repository>
</repositories>
<dependencies>
    <dependency>
        <groupId>e-iceblue</groupId>
        <artifactId>spire.pdf</artifactId>
        <version>12.9.0</version>
    </dependency>
</dependencies>

完成安装后,即可直接使用 Java 代码加载和解析 PDF 文件,无需依赖外部工具。

在 Java 中加载并验证 PDF 文档

在执行任何解析操作之前,首先需要加载并验证 PDF 文档。建议将这一步作为独立操作,用于确认文档是否可以被后续解析逻辑安全处理。

import com.spire.pdf.PdfDocument;

public class loadPDF {
    public static void main(String[] args) {

        // 创建 PdfDocument 实例
        PdfDocument pdf = new PdfDocument();
        // 加载 PDF 文件
        pdf.loadFromFile("sample.pdf");

        // 获取页面总数
        int pageCount = pdf.getPages().getCount();
        System.out.println("总页数: " + pageCount);
    }
}

控制台输出示例

在 Java 中加载 PDF 并获取页数

从实现角度来看,只要能够成功加载文档并访问页面集合,就已经验证了多个关键条件:

  • 文件格式受支持
  • 文档结构可以正常解析
  • 页面树存在且可访问

在生产系统中,这一步通常作为入口校验使用,无法加载或页面结构异常的 PDF 可以直接被拦截,避免影响后续流程,有助于在批处理或自动化场景中避免错误级联。

实际开发中,PDF 也可能以字节数组或流的形式传入。关于这类场景,可参考 使用 Java 从字节数组加载 PDF 文档

使用 Java 解析 PDF 页面中的文本

文本解析是 Java 中最常见的 PDF 处理需求之一,其核心目标是从 PDF 页面中提取并重组可读文本内容。使用 Spire.PDF for Java 解析 PDF 文本时,文本解析不应简单理解为一次性 API 调用,而应通过 PdfTextExtractor 配合可配置的 PdfTextExtractOptions 来实现,以获得更稳定、可控的解析结果。

将文本解析设计为独立的处理步骤,可以在文档索引、内容分析、全文搜索或数据迁移等场景中灵活复用。

Java 中文本解析的实现流程

在典型的 Java 实现中,PDF 文本解析通常由以下几个清晰的步骤构成,每一步都能在代码中直接体现:

  1. 将 PDF 文件加载为 PdfDocument 实例
  2. 通过 PdfTextExtractOptions 配置文本解析行为
  3. 针对每一页创建对应的 PdfTextExtractor
  4. 按页面提取文本并汇总解析结果

这种基于页面的解析方式与 PDF 的底层结构高度一致,也为多页文档的处理提供了更好的控制能力。

示例:使用 Java 提取 PDF 页面中的文本

import com.spire.pdf.PdfDocument;
import com.spire.pdf.texts.PdfTextExtractOptions;
import com.spire.pdf.texts.PdfTextExtractor;

public class extractPdfText {
    public static void main(String[] args) {

        // 创建并加载 PDF 文档
        PdfDocument pdf = new PdfDocument();
        pdf.loadFromFile("sample1.pdf");

        // 使用 StringBuilder 高效累积解析结果
        StringBuilder extractedText = new StringBuilder();

        // 配置文本解析选项
        PdfTextExtractOptions options = new PdfTextExtractOptions();

        // 启用简化解析模式,提高文本可读性
        options.setSimpleExtraction(true);

        // 遍历 PDF 中的每一页
        for (int i = 0; i < pdf.getPages().getCount(); i++) {

            // 为当前页面创建文本解析器
            PdfTextExtractor extractor =
                    new PdfTextExtractor(pdf.getPages().get(i));

            // 按配置选项解析当前页面文本
            String pageText = extractor.extract(options);

            // 追加到结果缓冲区
            extractedText.append(pageText).append("\n");
        }

        // 此时 extractedText 已包含完整文本内容,
        // 可用于存储、索引或后续处理
        System.out.println(extractedText.toString());
    }
}

控制台输出示例

使用 Java 从 PDF 页面中提取文本

关键类与配置说明

  • PdfTextExtractor 以页面为解析单位,对文本内容进行提取和重组,提供比全局提取更精细的控制能力。

  • PdfTextExtractOptions 用于控制文本解析行为。启用 setSimpleExtraction(true) 可在多数场景下生成更干净、更易读的文本结果,减少因布局干扰导致的断行或错序问题。

  • 按页解析策略 将解析范围限定在单页,有助于处理大体量 PDF 文档,也更容易在出现异常时定位和隔离问题页面。

技术要点与实现注意事项

  • PDF 中的文本并不是以段落或行结构存储的,而是由带有位置信息的字符(glyph)组合而成,因此文本解析本质上是一个基于坐标的重组过程
  • 文本提取行为可以通过 PdfTextExtractOptions 进行调整,以在布局还原精度和文本可读性之间取得平衡
  • 采用页面级文本提取能够显著提升容错性和灵活性,尤其适合多页或结构不完全一致的 PDF 文件
  • 提取后的文本在进入搜索、分析或数据处理系统之前,通常仍需要进行额外的规范化处理,例如清理多余空白、合并断行、统一编码等

这种基于页面的文本解析方式非常适合布局相对稳定、以文字内容为主的文档,如报告、合同和说明文档;也是在 Java 中使用 Spire.PDF for Java 解析 PDF 页面文本的推荐实践。更多文本解析示例可参考:使用 Java 从 PDF 页面中提取文本

使用 Java 解析 PDF 页面中的表格

表格解析属于较为高级的 PDF 解析操作,其目标是在 PDF 页面中识别出表格结构,并将其还原为具有行和列关系的结构化数据。与纯文本解析相比,表格解析更强调单元格之间的语义关系,常用于发票、财务报表、业务统计报表等场景。

在 Java 中进行 PDF 解析时,表格解析可以将视觉上对齐的数据转换为程序可直接处理的结构化内容,便于存储、分析或导出。

Java 中表格解析的实现思路

表格解析的核心不再是简单的文本提取,而是基于页面布局和对齐关系进行结构推断:

  1. 将 PDF 文档加载为 PdfDocument
  2. 创建并绑定 PdfTableExtractor
  3. 从指定页面解析表格结构
  4. 根据解析结果还原行和列
  5. 对单元格数据进行校验和规范化

与文本解析不同,表格解析是通过元素的视觉对齐和布局一致性来推断结构的,从而实现对原本“散落在页面上的文本”的行列级访问。

示例:使用 Java 从 PDF 页面中解析表格

下面的示例展示了如何使用 PdfTableExtractor 从 PDF 页面中解析表格,并将其转换为按行列组织的数据结构,便于后续处理或导出。

import com.spire.pdf.PdfDocument;
import com.spire.pdf.utilities.PdfTable;
import com.spire.pdf.utilities.PdfTableExtractor;

public class extractPdfTable {
    public static void main(String[] args) {

        // 载入 PDF 文档
        PdfDocument pdf = new PdfDocument();
        pdf.loadFromFile("sample1.pdf");

        // 创建 PdfTableExtractor 对象
        PdfTableExtractor extractor = new PdfTableExtractor(pdf);

        // 从第一页解析表格(页索引从 0 开始)
        PdfTable[] tables = extractor.extractTable(0);

        // 遍历表格
        if (tables != null) {
            for (PdfTable table : tables) {

                // 获取表格的行数和列数
                int rowCount = table.getRowCount();
                int columnCount = table.getColumnCount();

                System.out.println("Rows: " + rowCount +
                        ", Columns: " + columnCount);

                StringBuilder tableData = new StringBuilder();
                for (int i = 0; i < rowCount; i++) {
                    for (int j = 0; j < columnCount; j++) {

                        // 获取单元格数据
                        tableData.append(table.getText(i, j));

                        if (j < columnCount - 1) {
                            tableData.append("\t");
                        }
                    }
                    if (i < rowCount - 1) {
                        tableData.append("\n");
                    }
                }

                System.out.println(tableData.toString());
            }
        }
    }
}

控制台输出示例

使用 Java 从 PDF 中解析表格

实现细节说明

  • PdfTableExtractor: 通过分析页面级内容,根据文本对齐和布局特征识别表格区域。

  • 结构还原: 行和列是通过文本元素的相对位置推断得出的,可通过行列索引访问单元格内容。

  • 按页解析: 每页单独解析,有助于应对不同页面布局不一致的问题。

表格解析的实际注意事项

  • 表格边界来源于视觉布局,而非显式定义
  • 表头行可能需要额外识别或处理逻辑
  • 单元格内容在存储或导出前通常需要规范化
  • 布局复杂或不规则的表格可能影响解析精度

尽管存在一定限制,表格解析依然是 Java PDF 解析中极具价值的能力之一,特别适合从结构化业务文档中自动提取数据。

在解析出表格数据后,常见的做法是将其导出为 CSV 等结构化格式,可参考:使用 Java 将 PDF 表格转换为 CSV

使用 Java 解析 PDF 页面中的图像

图像解析是一种专门用于提取 PDF 页面中嵌入图像资源的解析能力。与文本或表格解析不同,图像解析并不依赖内容流或布局推断,而是直接分析页面资源,识别其中的图像对象。

在 Java PDF 处理系统中,图像解析常用于视觉内容归档、文档组成审计,或将图像数据传递给下游处理流程。

Java 中图像解析的工作方式

从实现角度来看,图像解析主要基于页面级资源:

  1. 将 PDF 文档加载为 PdfDocument
  2. 初始化 PdfImageHelper 工具类
  3. 遍历页面并获取图像资源信息
  4. 提取并导出每个嵌入的图像对象

由于图像作为独立资源存储,这一解析过程不依赖文本顺序、布局重建或表格识别逻辑。

示例:使用 Java 从 PDF 页面中解析图像

import com.spire.pdf.PdfDocument;
import com.spire.pdf.utilities.PdfImageHelper;
import com.spire.pdf.utilities.PdfImageInfo;

import javax.imageio.ImageIO;
import java.awt.image.BufferedImage;
import java.io.File;
import java.io.IOException;

public class extractPdfImages {
    public static void main(String[] args) throws IOException {

        // 载入 PDF 文档
        PdfDocument pdf = new PdfDocument();
        pdf.loadFromFile("sample1.pdf");

        // 创建 PdfImageHelper 对象
        PdfImageHelper imageHelper = new PdfImageHelper();

        // 遍历每一页
        for (int i = 0; i < pdf.getPages().getCount(); i++) {

            // 获取当前页的图片信息
            PdfImageInfo[] imageInfos =
                    imageHelper.getImagesInfo(pdf.getPages().get(i));

            if (imageInfos != null) {
                for (int j = 0; j < imageInfos.length; j++) {

                    // 获取指定图片
                    BufferedImage image = imageInfos[j].getImage();

                    // 保存图片为 PNG 文件
                    File output = new File(
                            "output/images/page_" + i + "_image_" + j + ".png"
                    );
                    ImageIO.write(image, "PNG", output);
                }
            }
        }
    }
}

提取结果示例

使用 Java 从 PDF 页面中提取图像

图像解析的关键说明

  • PdfImageHelper / PdfImageInfo: 用于分析页面资源并以 BufferedImage 形式访问嵌入图像。

  • 按页处理: 即使多页文档中存在重复或复用图像,也能准确提取。

  • 与布局无关: 图像解析不依赖文本流或表格结构,适用于所有视觉资源。

图像解析的实际注意事项

  • 提取的图像可能包含装饰性或背景元素
  • 不同 PDF 的图像分辨率、色彩空间和格式可能不同
  • 大型 PDF 文档可能包含大量图像,需要合理管理内存和存储
  • 图像解析通常与文本、表格和元数据解析结合使用,共同构成完整的 PDF 解析流程

除逐个提取图像外,也可以将整个 PDF 页面直接转换为图片,详见:使用 Java 将 PDF 页面转换为图片

使用 Java 解析 PDF 元数据

元数据解析是 PDF 解析中的基础能力之一,主要用于读取独立于页面内容之外的文档级信息。与文本或表格解析不同,元数据解析不依赖页面布局,因此在绝大多数 PDF 文件中都具有较高的稳定性。

在 Java PDF 处理系统中,元数据通常作为前置分析步骤,用于文档分类、流程路由或索引决策。

Java 中元数据解析的实现方式

元数据解析是文档级操作,其实现步骤通常如下:

  1. 将 PDF 加载为 PdfDocument
  2. 访问文档信息字典
  3. 读取可用的元数据字段
  4. 将解析结果用于分类、路由或索引逻辑

由于元数据不依赖渲染内容,这一解析过程开销小、速度快,且结果较为一致。

示例:使用 Java 解析 PDF 文档元数据

import com.spire.pdf.PdfDocument;

public class parsePdfMetadata {
    public static void main(String[] args) {

        // 载入 PDF 文档
        PdfDocument pdf = new PdfDocument();
        pdf.loadFromFile("sample1.pdf");

        // 获取 PDF 文档元数据信息
        String title = pdf.getDocumentInformation().getTitle();
        String author = pdf.getDocumentInformation().getAuthor();
        String subject = pdf.getDocumentInformation().getSubject();
        String keywords = pdf.getDocumentInformation().getKeywords();
        String creator = pdf.getDocumentInformation().getCreator();
        String producer = pdf.getDocumentInformation().getProducer();

        String creationDate = pdf.getDocumentInformation()
                .getCreationDate().toString();
        String modificationDate = pdf.getDocumentInformation()
                .getModificationDate().toString();

        System.out.println(
                "Title: " + title +
                        "\nAuthor: " + author +
                        "\nSubject: " + subject +
                        "\nKeywords: " + keywords +
                        "\nCreator: " + creator +
                        "\nProducer: " + producer +
                        "\nCreation Date: " + creationDate +
                        "\nModification Date: " + modificationDate
        );
    }
}

控制台输出示例

使用 Java 解析 PDF 元数据

元数据解析的要点说明

  • 文档信息字典: 元数据存储在 PDF 的独立结构中,与页面渲染内容无关。

  • 字段完整性: 并非所有 PDF 都包含完整元数据,使用前应进行空值校验。

  • 解析成本低: 不需要遍历页面,适合作为初始解析步骤。

如需访问自定义 PDF 属性,可参考 PdfDocumentInformation API

元数据解析的常见用途

  • 文档分类与标签管理
  • 搜索索引与筛选
  • 工作流路由与权限控制
  • 版本管理与审计记录

由于不受布局和内容流影响,元数据解析在复杂 PDF 中通常比文本或表格解析更加稳定。

Java PDF 解析的实现注意事项

在实际项目中,往往需要在同一处理流程中组合多种 PDF 解析能力。

组合使用多种解析操作

常见的实现模式包括:

  • 提取文本用于索引,同时解析表格用于结构化存储
  • 利用元数据决定文档进入哪条处理流程
  • 在定时任务或批处理作业中异步执行解析操作

将文本、表格、图像和元数据解析视为相互独立但可组合的模块,有助于系统的扩展性、可测试性和长期维护。

实际限制与约束

即便使用成熟的 Java PDF 解析库,仍存在一些不可避免的限制:

  • 扫描版 PDF 在解析前,需要先进行 OCR 处理
  • 布局高度复杂或不一致的文档会降低解析精度
  • 自定义字体或编码方式可能影响文本还原效果

充分理解这些限制,有助于在生产环境中制定合理的解析策略,并降低异常处理复杂度。

总结

在 Java 中进行 PDF 解析时,将其视为一组目标明确、彼此独立的提取操作,往往比线性流程更高效、更可靠。通过分别处理文本、表格和元数据,Java 应用可以稳定地将 PDF 文档转换为可用数据。

借助 Spire.PDF for Java 这样的专业库,开发者可以构建可维护、可扩展,并能满足真实业务需求的 PDF 处理解决方案。

如需全面体验 Spire.PDF for Java 在 PDF 解析方面的能力,可 申请免费试用许可证

Java PDF 解析常见问题解答

Q1:如何在 Java 中解析 PDF 页面中的文本?

A:可以使用 Spire.PDF for Java 提供的 PdfTextExtractorPdfTextExtractOptions,按页面提取文本,适用于索引、分析或内容迁移场景。

Q2:如何在 Java 中提取 PDF 表格?

A:通过 PdfTableExtractor 识别表格区域并还原行列结构,解析结果可进一步处理或导出为结构化数据。

Q3:Java 可以解析 PDF 中的图片吗?

A:可以。使用 PdfImageHelperPdfImageInfo 可提取页面中的嵌入图像,也可将整页 PDF 转换为图片。

Q4:如何在 Java 中读取 PDF 元数据?

A:通过 PdfDocumentInformation 获取标题、作者、创建时间等字段,该操作速度快且不依赖页面内容。

Q5:Java PDF 解析是否存在限制?

A:复杂布局、扫描版 PDF 和自定义字体都会影响解析效果。扫描文档需要先进行 OCR 处理

Java
Spire.PDF for Java
文档操作
Java 设置 PDF 文档自定义属性
Java 复制 PDF 文档
Java 隐藏/显示 PDF 图层
Java 创建 PDF 文件包(Portfolio)
Java 如何提取 PDF 文件包(Portfolio)中的文件
Java 判断 PDF 文档是否为 PDF 文件包(Portfolio)
Java 更改 PDF 版本
Java 创建多栏 PDF
Java 获取或设置 PDF 文档的属性
Java 拆分 PDF 页面
Java 将 PDF 拆分为多个 PDF 文件
Java 合并 PDF 文件:完整合并、指定页面合并与流合并
Java 设置 PDF 浏览偏好
Java 在 PDF 文档中添加或删除页面
Java PDF 压缩教程:高效减小 PDF 文件大小
Java 创建带标签的 PDF 文档
通过 Java 生成 PDF 文件:从零创建、模板填充到 HTML 导出
Java 添加、隐藏或删除 PDF 图层
Java 比较 PDF 文档
Java 读取 PDF:提取文本、图片和表格
如何在 Java 中通过模板生成 PDF
在 Java 快速解析 PDF:文本、表格、图像与元数据
在 Java 中修改或编辑 PDF 文件:附实用代码示例
页面设置
Java 在 PDF 中添加有序和无序列表
Java 设置 PDF 的页边距,页面大小以及纸张方向
Java 添加编号列表和项目符号列表到 PDF
Java 添加页面跳转按钮到 PDF
Java 判断 PDF 页面方向
Java 合并 PDF 页面
Java 获取 PDF 页面大小
Java 设置 PDF 页面显示设置和缩放比例
Java 在 PDF 中创建多级列表
Java 重新排列 PDF 页面顺序
Java 调整现有 PDF 文档的边距
Java 更改 PDF 页面大小
Java 添加页码到 PDF 文档
Java 查找并删除 PDF 中的空白页面
Java 旋转 PDF 页面
Java 拆分 PDF 页面
Java 为 PDF 文档设置背景色或背景图片
Java 获取 PDF 文档页数
Java 裁剪 PDF 页面
Java 填充 PDF 表单域
Java 将 PDF 表单域设置为只读
Java 检测 PDF 文档中的必填域
Java 给 PDF 文档添加目录
Java 在 PDF 中添加工具提示
Java 在 PDF 文档中创建、填写或删除可填写表单域
Java 读取 PDF 表单域的值
Java 导入和导出 PDF 表单数据
文档转换
Java 将 PDF 转为 HTML 时保存到流
Java SVG 转 PDF,添加 SVG 图片到 PDF
Java 转换图片到 PDF
Linux 系统下使用 Java 和 Spire 组件转换文档时,结果文档乱码或字体缺失错误的处理方法
Java 将 PDF 转为 OFD
Java 将 PDF 转为 PDF/A
Java 将 PDF 转为 TIFF
Java 将 Tiff 转为 PDF
Java 将 HTML 转换为 PDF – URL、 HTML 字符串及文件
Java 将 PDF 转为灰度
Java 将 PDF 转换为图片(支持 PNG/JPEG/TIFF/SVG 等格式)
Java 将 PDF 转为 SVG
Java 将 OFD 转换为 PDF
Java 将文本文件 TXT 转换为 PDF
Java 将 PDF 转为线性 PDF
Java 将 PDF 转为 Excel
Java 将 PDF 转换为 PowerPoint 演示文稿
Java 将 PDF 转为 HTML
Java 将 PDF 转为 Word
Java 将 PDF 转换为 JPEG 或 PNG
如何在 Java 中将 PDF 转换为 CSV(轻松提取 PDF 表格)
Java 将 Byte 数组转换为 PDF(加载或生成)
文本
Java 设置 PDF 中文字对齐方式 【完整示例解析】
Java 设置 PDF 文本倾斜、旋转
Java 在 PDF 中绘制上标文本和下标文本
Java 设置 PDF 文档中文字的字体颜色
Java 在 PDF 中查找替换文本
Java 在 PDF 中查找并高亮文本
Java 提取 PDF 文本教程:支持文本型和扫描型 PDF(附完整代码)
图片和图形
Java 在 PDF 中添加形状
Java 删除 PDF 中的图片
Java 添加 PDF 专色文本和专色图形
Java 替换 PDF 文档中的图片
Java 添加虚线和实线到 PDF 文档
Java 设置 PDF 文档中的图片透明度
Java 获取 PDF 中图片的坐标信息
Java 在 PDF 中插入、替换或删除图像
Java 提取,压缩 PDF 文档中的图片
Java 提取 PDF 图片教程:高质量提取与图片过滤技巧
安全
Java 验证 PDF 数字签名的有效性
Java PDF 添加数字签名
Java 在 PDF 中添加骑缝章
Java 获取 PDF 中的数字签名信息
Java 删除 PDF 中的数字签名
Java 添加时间戳数字签名到 PDF
Java 验证 PDF 是否为加密文档
Java 加密或解密 PDF 文档
Java 验证或提取 PDF 中的数字签名
水印
Java 设置 PDF 平铺图片背景(水印)
在 Java 中向 PDF 添加水印:文本、图像和自定义样式
Java 插入图片水印到 PDF 文档
Java 添加和移除 PDF 文档中的水印印章
表格
Java 创建并格式化 PDF 表格
Java 使用 PdfTable 类创建并设置表格样式
Java 设置 PDF 跨页表格重复显示表头行
Java 提取 PDF 中的表格
Java 将表格数据从 PDF 导出到 Excel
页眉和页脚
Java 添加页眉页脚到 PDF
Java 添加不同页眉到 PDF 文档
Java 给现有的 PDF 文档添加页眉页脚
字体
Java 在 PDF 中应用不同的字体
打印
Java 制作 PDF 打印小册子
Java 打印 PDF 文档
附件
Java PDF 删除附件
Java 添加或删除 PDF 中的附件
Java 从 PDF 文档中提取附件
超链接
Java 添加链接到 PDF
Java 更新和删除 PDF 中的超链接
注释和动作
Java 添加动态图章到 PDF
Java 添加图片图章到 PDF
Java 在 PDF 中添加标注(Annotation)
Java 为 PDF 文档设置过期日期
Java 添加导航按钮到 PDF 文档
Java 删除 PDF 中的注释
Java 在 PDF 中添加注释
Java 添加动作到 PDF 文档
条形码
Java 在 PDF 中添加条形码
Java 添加二维码到 PDF 文档
Java 在 PDF 中添加条形码或二维码
书签
Java 修改 PDF 书签
Java 读取 PDF 中的书签
Java 删除 PDF 书签
Java 设置打开 PDF 文档时展开或折叠书签
Java 在 PDF 中添加、编辑或删除书签
列表
Java 在 PDF 文档中创建列表
Spire.PDF for Java 中文教程
Spire.Doc for Java
文档转换
使用 Java 将 Word 转换为 PDF:基础步骤 + 完整示例代码
Java 转换 Word 到图片时设置图片的分辨率
Linux 系统下 Java 转换 Word 到 PDF 时,结果文档乱码的处理方法
Java 将 Excel 数据保存为 Word 表格
Java 实现 Word 文档转换为 TIFF 图片(支持指定节导出)
Java 将 WPS 文字文档转为 PDF
Java 实现 Word 转 HTML:支持文档、节与段落级转换
Java 将 Word 转为 OFD
Java 将 XML 转为 PDF
Java 将 HTML 转为 XML
Java 将 HTML 转为 XPS
Java 将 Word 转为 XML 和 XML 转为 Word 的方法
Java 将 Word 文档转换为 XPS、XML、RTF、TXT 格式
Java 将 Word 转为 Excel
Java 将 Word 文档转换为加密 PDF
Java 将 Markdown 转换为 Word 和 PDF
Java 将 RTF 转换为 HTML、图片
Java 将 HTML 转换为图片
将 HTML 转换为 PDF | 简单快速的 Java 教程
Java 实现 HTML 转 Word 自动化 - 教程与代码示例
用 Java 实现 TXT 文本与 Word 互转:完整教程
如何使用 Java 将 RTF 文件转换为 PDF:全面教程
文档操作
从零开始创建 Word | 专业 Java 实践指南
Java 启用 Word 修订功能,接受/拒绝修订
Java 给 Word 文档添加内容控件
Java 添加 OLE 到 Word 文档
Java 复制 Word 文档
Java 添加、计数、检索和删除 Word 文档变量
Java 使用象征符号在 Word 中绘制复选框
使用 Java 轻松拆分 Word 文档(图文详解)
Java 添加 Word 数学公式
Java 创建 WPS 文字(Word)文档
使用 Java 准确统计 Word 文档中的字数(图文详解)
Java 在 Word 中嵌入多媒体(视频、音频)文件
Java 加载,操作和保存 WPS 文字文档
Java 获取 Word 中所有修订
Java 合并 Word 文档
Java 从 Word 文档中读取或删除文档属性
Java 在 Word 文档中添加或更改变量
Java 比较 Word 文档
Java 插入分页符和分节符到 Word 文档
Java 添加、插入和删除 Word 文档中的页面
Java 读取 Word 文档中的内容
Java 修改 Word 文档中的内容控件
Java 将一个 Word 文档的内容复制到另一个文档
Java 基于模板生成 Word 文档
在 Java 中解析 HTML:读取文件、抓取 URL 与提取数据
超链接
Java 添加超链接到 Word 文档
Java 修改 Word 超链接
Java 移除 Word 文档中的超链接
Java 查找并导出 Word 文档中的超链接
Java Word 文档中更改超链接颜色或移除超链接下划线
页面背景
Java 复制 Word 水印
Java 给 Word 不同页面设置不同背景
Java Word 文档添加背景颜色或背景图片
Java 给 Word 文档的段落或文本设置背景色
安全
Java 验证 Word 文档的限制编辑密码
Java 判断 Word 文档是否被密码保护
Java 给 Word 添加数字签名
Java Word 文档加密与解密
Java 在 Word 文档中设置或取消编辑限制
Java 在 Word 文档中添加图像印章
文本
轻松高亮 Word 文档中的关键文本 | Java 教程
Java 在 Word 中设置上、下标
Java 用图片替换 Word 文档中的特定文本
Java 在 Word 文档中使用正则表达式匹配文本
Java 给 Word 中的指定文本字符串添加边框
Java 给 Word 字符串添加强调符号(着重号)
Java 在 Word 文档中查找并替换文本
Java 设置 Word 文档字体格式
Java 从 Word 文档中提取文本和图片
Word 文档中如何给文本和段落添加边框 | Java 教程
图片和图形
Java 在 Word 中添加图形
Java 设置 Word 文档图片文字环绕方式
Java 旋转 Word 文档中的图形
Java 获取 Word 中指定图片的位置、大小、环绕方式
Java Word 文档中插入图片
Java 在 Word 文档中添加艺术字
Java 替换 Word 中的图片
页面设置
Java 实现 Word 文档分栏效果
Java 在 Word 中添加行号
Java 设置 Word 行间距和字间距
Java 设置 Word 页面方向和页面大小
Java 将文档属性添加到 Word 文档
Java 设置 Word 文档页边距
Java 添加页码到 Word 文档
Java 给 “多栏” Word 文档的每栏都设置页码
Java 在 Word 文档页面上添加装订线
Java 添加、修改和移除 Word 页面边框
批注
Java 修改或替换 Word 批注
Java 给 Word 指定字符串添加批注
Java 读取 Word 批注中的文本和图片
Java 获取 Word 中指定批注所标记的文字
Java 在 Word 文档中添加、回复或删除批注
Java 提取 Word 文档中的批注
段落
Java 设置 Word 中的段落缩进方式
Java 设置 Word 段落边框
Java 批量删除 Word 中的空白段落
Java 获取 Word 中的标题(目录)
Java 将 ASCII 字符设置为 Word 列表符号
Java 删除 Word 中的指定段落
Java 在 Word 中隐藏特定段落
Java 提取使用特定样式的 Word 段落
Java 设置 Word 文档中段落的对齐方式
Java Word 中在已有文本上添加项目符号列表或编号列表
Java 从 Word 文档中的现有文本创建项目符号列表或编号列表
Java 设置 Word 文档的段落间距和行间距
书签
Java 替换 Word 书签内容
Java 获取书签文本
Java 给 Word 指定字符串添加书签
如何在 Word 书签位置插入文本、图片和表格(Java 示例)
Java 在 Word 中添加或删除书签
表格
Java 合并、拆分 Word 表格中的单元格
Java 添加 Word 嵌套表格
Java 设置 Word 表格禁止跨页断行
Java 添加图片到 Word 表格
Java 操作 Word 表格:从复制单行、单列到整表的完整教程
Java 添加 Word 表格行或列
Java Word 表格设置样式和边框
Java 删除 Word 表格和 Word 表格内容
Java Word 表格自适应列宽
Java 设置 Word 表格的水平对齐方式
Java 读取 Word 表格中的文本和图片
Java 创建 Word 表格
Java 设置 Word 表格列宽
Java 添加、修改和移除 Word 表格边框
Java 提取 Word 文档中的表格
页眉和页脚
Java 设置 Word 奇偶页、首页页眉页脚不同
Java 添加表格到 Word 页眉
Java 复制 Word 中的页眉页脚
Java 调整 Word 页眉页脚的位置高度
Java Word 文档中插入页眉和页脚
Java 删除 Word 文档中的页眉页脚
表单域
Java 删除 Word 目录
Java 在 Word 中创建可填充表单
Java 在 Word 文档中创建目录
Java 给新建的 Word 文档创建目录
打印
Java 打印 Word 文档
Java 使用新方法打印 Word 文档
脚注和尾注
Java Word 中插入或删除脚注
Java 删除 Word 文档中的脚注
Java 读取 Word 中的脚注、尾注
文本框
Java 添加表格到 Word 文本框
Java 获取和删除 Word 文本框中的表格
Java 读取 Word 文本框中的文本/图片/表格
Java 设置 Word 文本框中的文字旋转方向
Java Word 文档中添加或删除文本框
字体
Java Word 转换 PDF 时嵌入非安装字体
Java 更改 Word 文档中段落文本的字体颜色
Java 在 Word 中更改字体颜色
Java 获取或替换 Word 文档中的字体
邮件合并
Java 创建 Word 邮件合并模板并合并文本
Java 在 Word 中邮件合并图片
水印
Java 添加多行文字水印到 Word 文档
Java 添加 Word 水印时,移除段落、文本域、表格和文本框中的背景色
Java 添加多行图片水印到 Word 文档
Java 移除 Word 文档中的水印
Java 添加文本水印和图片水印到 Word 文档
Java 插入重复水印到 Word 文档
图表
Java 在 Word 中创建图表
其它
Java 在 Word 中添加条形码
Java 删除 Word 宏
Java 添加条码、二维码到 Word 文档
Java Word 中添加上角标和下角标
Java 在 Word 中嵌入外部文件
Java 添加和删除 Word 中的题注
Spire.Doc for Java 中文教程
Spire.Presentation for Java
文档转换
Java 将 PowerPoint 幻灯片转为 XPS
Java 转换 PowerPoint 演示文稿为 OFD 【代码详解】
Java 将 PowerPoint 幻灯片转为 HTML
Java 转换 OpenDocument 演示文稿(.odp)到 PDF
Java 将 PowerPoint 转换为图像(PNG、JPG、TIFF、SVG)
Java 将 PowerPoint 转为 PDF
Java 将图像(PNG、JPG、BMP)转换为 PowerPoint
文档操作
在 Java 中创建 PPT 文档
Java 添加、隐藏、删除 PowerPoint 幻灯片,调整幻灯片顺序
Java 插入 HTML 字符串到 Presentation
Java 给 PowerPoint 幻灯片添加背景颜色和背景图片
Java 创建并用应用幻灯片母版
Java 添加 HTML 到 PowerPoint
Java 复制 PPT 幻灯片
Java 合并、拆分 PPT 幻灯片
Java 标记演示文稿为最终状态
Java 设置幻灯片版式
Java 设置和获取 PowerPoint 幻灯片标题
Java 添加 OLE 对象到 PowerPoint
Java 在两个 PowerPoint 文档之间复制幻灯片
Java 插入公式到 PowerPoint 幻灯片
Java 设置 PowerPoint 幻灯片背景
Java 更改 PowerPoint 演示文稿幻灯片大小
Java 添加、获取或删除 PowerPoint 文档属性
文本和段落
Java 提取 PowerPoint 文档中的文本
Java 教程在 PowerPoint 中创建编号列表和符号列表
Java 替换 PPT 文档中的文本
Java 自定义 PPT 项目符号样式
Java 设置 PowerPoint 幻灯片中的文字方向
Java 设置幻灯片段落缩进与间距
Java 在 PowerPoint 文档中查找和高亮文本
Java 为 PPT 中的文字添加阴影效果
Java 对 PPT 文本应用透明色
Java 获取 PowerPoint 中文本的位置
Java 设置 PPT 形状中文字的对齐方式
Java 更改 PowerPoint 文档中的字体样式
Java 在 PowerPoint 中添加上标和下标
形状
Java 将 PPT 形状(表格、文本框、三角形、图表等)保存成图片
Java 添加形状到 PPT
Java 添加文本框到 PPT 幻灯片
Java 设置和获取 PowerPoint 形状的可选文字
Java 在 PPT 中合并形状
Java PPT 中设置文字或图形自适应大小
Java 为 PPT 中的图形添加阴影效果
Java 提取 PowerPoint 中 SmartArt 图形的文本内容
Java 删除 PPT 中的文本框
Java 编辑 PPT SmartArt 图形
Java 设置 PPT 中的形状排列方式
Java 在 PPT 中创建 SmartArt 图形
图片
Java 替换 PPT 中的图片
Java 删除 PPT 幻灯片中的图片
Java 编辑 PPT 幻灯片中的图片
Java 在 PowerPoint 文档中添加或提取图像
Java 设置 PowerPoint 图片透明度
表格
Java 创建、删除、操作 表格
Java 合并与拆分 PowerPoint 表格的单元格
Java 设置 PowerPoint 表格的行高和列宽
Java 设置 PowerPoint 表格文字对齐方式
Java 添加或删除 PPT 表格的行和列
Java 更改 PowerPoint 表格内置样式
Java 设置 PowerPoint 表格对齐方式
Java 平均分布 PowerPoint 表格的行和列
图表
Java 创建 PowerPoint 图表
Java 在 PowePoint 中创建组合图表
Java 给 PowerPoint 图表添加数据标签并设置外观样式
Java 给 PowerPoint 图表添加趋势线
Java 在 PowerPoint 中创建折线图
Java 使用现有 Excel 数据创建 PowerPoint 图表
Java 在幻灯片中创建散点图
音频和视频
Java 在 PPT 中插入、提取视频及设置视频播放模式
批注和备注
添加、读取和删除 PowerPoint 幻灯片中的备注信息
Java 添加、替换和删除 PowerPoint 幻灯片中的批注信息
Java 获取 PPT 幻灯片中的批注内容
Java 给 PowerPoint 幻灯片上的特定文本添加批注
超链接
Java 在 PPT 中添加超链接
Java 在 PPT 中添加图片超链接
Java 修改或删除 PowerPoint 中的超链接
文档保护
Java 程序中加密解密 PPT 文件
Java 添加、检测、删除 PPT 数字签名
水印
Java 给 PowerPoint 文档添加文本水印
Java 给 PowerPoint 文档添加图片水印
Java 删除 PowerPoint 文本和图片水印
Java 添加多行多列文本水印至 PowerPoint 幻灯片文档
打印
Java 打印 PowerPoint 文档
Java 使用 PrinterSettings 打印 PowerPoint 文档
页眉和页脚
Java 添加、修改和移除 Powerpoint 文档中的页脚
动画效果
Java 给 PowerPoint 中的形状添加动画效果
Java 如何在 PowerPoint 中设置动画效果重复播放
Java 给 PowerPoint 文档段落添加动画效果
Java 自定义 PPT 动画路径
Java 设置 PowerPoint 幻灯片切换(换片)方式
Java 获取 PowerPoint 幻灯片切换效果
其它
Java 在 PowerPoint 文档中嵌入 ZIP 文件
Spire.Presentation for Java 中文教程
Spire.XLS for Java
文档转换
Java 将 Excel 转为 PDF
Java 将 Excel 转为图片、html、XPS、XML、CSV
Java 编程实现 Excel 转 TIFF:详细教程与代码示例
Java 将 Excel 转为 .et 和 .ett 格式
Java 将 Excel 转为 OFD
Java 将 Excel 转为图片时设置分辨率
Java 将 XML 转为 Excel
Java 将 Excel 转为 SVG
Java 将 Excel 转为 CSV 以及 CSV 转为 Excel 的方法
Java 导出带格式的 Excel 数据到 Word 表格
Java 实现 Excel 和 Office Open XML 之间的相互转换
Java 将 Excel 转为 Html
Java 实现 XLS 和 XLSX 之间的相互转换
Java 将 Excel 转换为 ODS
Java 将 HTML 转为 Excel
Java 将 Excel 转换为 TXT 文本
使用 Java 将 CSV 转换为 Excel(XLSX/XLS)并设置格式
如何使用 Java 将 TXT 文本转换为 Excel 表格
使用 Java 将 CSV 转换为 PDF(含格式设置)
如何使用 Java 将 Excel 转换为 JSON(支持多工作表与嵌套 JSON)
用 Java 将 JSON 数据转换为 Excel(JSON 转 XLSX 指南)
文档操作
Java 创建 Excel 文件
Java 设置 Excel 文档属性
Java 添加 OLE 对象到 Excel 文档
Java 添加、读取和删除 Excel 文档属性
Java Excel 设置背景颜色和背景图片
使用 Java 灵活拆分 Excel 文件 【自动化办公】
Java 设置 Excel 页边距
Java 在 Excel 中添加或删除分页符
Java 加载、编辑和保存 WPS 表格文件(.et/.ett)
Java 接受或拒绝 Excel 中的修订
Java 合并或拆分 Excel 文档
Java 调整 Excel 页面设置
如何使用 Java 编辑 Excel 文档
使用 Java 轻松解析 Excel 文件:读取 .XLS 和 .XLSX
Java 高效读取 CSV 文件:分步教程与核心示例
如何在 Java 中读取 Excel 文件(XLS/XLSX)—— 完整指南
Java 创建 CSV 文件:从零构建、数组批量写入与 Excel 转换
工作表
Java 添加与删除 Excel 工作表
Java 复制 Excel 工作表
Java 移动、隐藏、显示 Excel 工作表
Java 重命名 Excel 工作表并设置工作表标签颜色
Java 设置 Excel 行高列宽自适应 【实用指南】
Java Excel 冻结窗口
Java 添加文本框到 Excel 工作表
Java 读取 Excel 文本框中的文本和图片
Java 冻结或解除冻结 Excel 的行和列
Java 设置 Excel 工作表缩放比例
Java 删除 Excel 中的空白行和列
Java 隐藏或显示 Excel 中的网格线
Java 为 Excel 文本框设置字体和背景颜色
Java 将工作表按数据区域拆分成多个工作表
Java 设置 Excel 视图模式
Java 重命名 Excel 工作表并设置选项卡颜色
Java 调整 Excel 列顺序
Java 在 Excel 中取消冻结窗格及获取冻结窗格
Java设置Excel活动工作表或活动单元格
用 Java 获取所有 Excel 工作表名称【图文详解】
公式
Java 删除 Excel 中的公式同时保留其计算值
Java 在 Excel 工作表中插入或读取公式和函数
批注
Java 添加和读取 Excel 批注
Java 在 Excel 文档中隐藏或显示批注
Java 编辑或删除 Excel 工作表中的批注
Java Excel 添加图片批注
Java 提取 Excel 批注图片:一键导出指定或所有批注的背景图
图表
Java 在 Excel 文档中创建饼图
Java 给 Excel 图表添加数据表
Java 将 Excel 图表转换为图片
Java 创建 Excel 散点图
Java 使用不连续的数据创建 Excel 图表
Java 创建/编辑/删除 Excel 迷你图表
Java 插入图片到 Excel 图表
Java 隐藏图表的网格线
Java Excel 图表添加趋势线和读取趋势线公式
Java 设置 Excel 图表背景填充(颜色、图片填充)
Java 在 Excel 中添加分离型饼图、环形图
Java 创建含多层分类标签的 Excel 图表
Java 在 Excel 工作表中创建条形图
Java 在 Excel 中创建数据透视图
数据处理
Java 将数组写入 Excel
Java Excel 设置筛选器
Java 实现 Excel 查找与高亮:支持区域查找与正则表达式匹配
Java 自动化 Excel:轻松获取文本框中的内容
Java 实现 Excel 文本分列
Java Excel 数据排序
如何使用 Java 将 Excel 单元格文本拆分成多列
Java 为 Excel 中的数据范围添加小计
Java 在 Excel 中查找和替换数据
Java 设置 Excel 单元格的数字格式
Java 在 Excel 工作表中创建、修改及删除表格
Java 在 Excel 中添加、修改和删除切片器
Java 向 Excel 写入数据:3 种高效方法(含代码示例)
单元格
Java 合并和取消合并 Excel 单元格
Java Excel 中创建多级分组
Java Excel 设置数据验证
Java Excel 中设置行高和列宽
Java Excel 中设置字体
Java 设置 Excel 单元格中文字的对齐方式、缩进、方向和换行
Java 复制 Excel 单元格区域
Java 创建、编辑、删除 Excel 命名区域
Java Excel 中设置上下标
Java 复制 Excel 中包含公式的单元格时只保留公式值
Java 判断 Excel 工作表中是否包含合并单元格
Java 缩小 Excel 单元格字体以适应列宽
Java 设置 Excel 单元格文字自动换行和取消自动换行
Java 复制 Excel 单元格的格式
Java 为 Excel 单元格设置背景颜色和图案
Java 设置 Excel 单元格边框
Java 在 Excel 中复制行、列和单元格数据并保留格式
在 Excel 表格中添加下标:简单的 Java 教程
图片和图形
Java Excel 插入和提取图片
Java 添加、读取、删除 Excel 形状
Java 设置 Excel 图片大小和位置,删除图片
Java 用图片替换 Excel 表格中的特定文本
Java 压缩 Excel 中的图片
Java 在 Excel 文档插入图片
文档保护
Java 解密 Excel 工作簿/工作表
Java 锁定 Excel 中的特定单元格
Java 在 Excel 中添加或删除数字签名
Java 保护或取消保护 Excel 文档
页眉和页脚
Java 为 Excel 的第一页设置不同的页眉页脚
Java 在 Excel 工作表中插入页眉和页脚
条件格式
Java 为 Excel 中的行设置交替背景色
Java 高亮 Excel 中重复和唯一的数据
Java 高亮 Excel 中的最大和最小值
Java 设置 Excel 交通灯
Java 给 Excel 添加数据条类型的条件格式
Java 高亮 Excel 中低于或高于平均值的单元格
超链接
Java 添加图片超链接到 Excel
Java 获取 Excel 中的超链接
Java 添加超链接到 Excel 文档
Java 修改或删除 Excel 中的超链接
透视表
Java 刷新 Excel 中的透视表
Java 在 Excel 中创建或操作数据透视表
Java 在 Excel 中根据透视表创建操作图表
水印
Java 添加 Excel 文本水印和图片水印
打印
Java 打印 XLS 和 XLSX 文件
其它
Java Excel 插入和删除表单控件
Java 提取 Excel 中的 OLE 对象
Java 插入 OLE 对象到 Excel
Java 在 Excel 文档中创建下拉框
Spire.XLS for Java 中文教程
Spire.Barcode for Java
如何使用 Java 识别条形码:完整指南
使用 Java 生成二维码 - 嵌入 logo 并自定义样式
如何使用 Spire.Barcode for Java 生成 EAN-13 条形码
Java 创建一维、二维条码时设置数据文本不可见
Java 创建条形码
Spire.OCR for Java
如何在 Java 项目中扫描识别图片中的文字
Java 使用 Spire.OCR for Java 的新模型从图片中提取文本
Java OCR 教程:从图片中提取文本的实用指南
.NET
Spire.Doc for .NET
文档转换
Spire.Doc 转换功能详述
C#/VB.NET 将 HTML 保存为 PDF
C#/VB.NET Word 转 EPUB
C#/VB.NET Word 转 PCL
C#/VB.NET 转换 Word 文档到 PDF 时保留 Word 标题为 PDF 书签
C#/VB.NET 将 XML 转为 PDF
C#/VB.NET 将 Word 转换为 HTML
C#/VB.NET 将 RTF 转为 PDF
C# 实现 HTML 转 Word 和 Word 转 HTML
C#/VB.NET 将 Word 转换为 XML
C#/VB.NET 将 HTML 转为 XML
C#/VB.NET 将 HTML 转为 XPS
C#/VB.NET OpenXML 转 Word 及 Word 转 OpenXML
C#/VB.NET 将 Word 转为图片(JPG、PNG、SVG)
C#/VB.NET Word 转 RTF 或 RTF 转 Word
C#/VB.NET 将 Word 文档转换为 XPS 文件
如何使用 C# 将 Word (Doc 或 Docx) 转换为 PDF
C# 将 Markdown 转换为 Word 或 PDF
如何使用 C# 将 Word 转换为 Excel
C# 将 RTF 转换为 HTML、图片
C# 将 Word 转换为 Markdown
C# 在 Word 和 TXT 文本之间相互转换
C# 将 HTML 转换为图片
C# Markdown 转 HTML教程(含字符串、单文件与批量处理)
通过 C# 将 HTML 转换为 RTF(附完整示例代码)
C# 将 HTML 转换为文本:简单方法+示例代码
C# HTML 转 Markdown 详细教程 (支持 HTML 文件、字符串、内存流)
文档操作
C#/VB.NET 添加和获取 Word 文档摘要及属性
C#/VB.NET 如何在 Word 中插入分页符和分节符
C#/VB.NET 根据分节符和分页符拆分 Word 文档
C#/VB.NET 在 Word 中插入下拉列表控件、文本控件、图片控件等
C#/VB.NET Word 添加分栏、分割线
C#/VB.NET 给 Word 文档添加内容控件
C#/VB.NET 复制 Word 文档
C#/VB.NET 创建 Word 目录
C#/VB.NET 获取 Word 内容控件属性
C#/VB.NET 比较两个 Word 文档的内容
C#/VB.NET 获取两个 Word 文档之间比较出的差异
C#/VB.NET 接受或拒绝 Word 修订功能
C#/VB.NET 合并 Word 文档
C#/VB.NET 在 Word 文档中插入数学方程
C# 添加、插入和删除 Word 文档中的页面
C# 读取 Word 文档教程:提取文本、表格、图片与批注
C# 给新建的 Word 文档创建目录
C# 修改 Word 文档中的内容控件
C# 统计 Word 文档中的字数、字符数、段落数、行数和页数
C# 提取 Word 文档中的文本和图片
C# 创建 Word 文档(添加基本元素)
C# 通过模板创建 Word 文档
如何在 C# 中解析 HTML(字符串、文件与 URL)
邮件合并
C# 在 Word 文档中合成邮件
表单域
C#/VB.NET 添加 Word 域
C#/VB.NET 插入、计数、检索和删除 Word 文档变量
C#/VB.NET 更新 Word 域
C#/VB.NET 在 Word 中创建交叉引用
C#/VB.NET 插入、删除 Word 目录
C# 在 Word 文档段落开头、中部和最后添加日期域
安全
C#/VB.NET Word 文档保护
C#/VB.NET 给 Word 文档添加数字签名
C#/VB.NET 插入电子图章到 Word 文档
C# 在 Word 文档中添加和移除允许编辑区域
段落
C# 为 Word 中的指定段落或文本添加底色
C#/VB.NET Word 中删除空白行
C#/VB.NET 读取 Word 标题大纲
C#/VB.NET Word 中设置行间距
C#/VB.NET 将 ASCII 字符设置为 Word 列表符号
C#/VB.NET 在 Word 中添加横线
C#/VB.NET 设置 Word 中的段落对齐方式
C#/VB.NET 删除 Word 文档的段落
C#/VB.NET 在 Word 文档中插入分页符
C#/VB.NET 在 Word 文档中插入列表
C# 在 Word 中插入段落
页面设置
C#/VB.NET 设置纸张大小以及页边距
C#/VB.NET Word 添加行号
C#/VB.NET 给 Word 不同页面设置不同背景
C#/VB.NET 为 Word 中不同的章节设置不同的页码
C#/VB.NET 设置 Word 文档段落缩进
C# 在 Word 文档页面上添加装订线
C# 添加、修改和移除 Word 页面边框
C# 为 Word 文档设置背景颜色或背景图片
水印
C#/VB.NET Word 文档中添加水印
C#/VB.NET 删除 Word 中的水印
C#/VB.NET 添加多行文本水印到 Word 文档
C#/VB.NET 添加多行多列图片水印到 Word 文档
文本
C#/VB.NET Word 查找和替换功能
C#/VB.NET Word 中添加和删除特殊符号
C#/VB.NET Word 中设置文字效果
C#/VB.NET 在 Word 中插入上下标
C#/VB.NET 读取 Word 文档的文本内容
C#/VB.NET 根据 Word 的标题样式获取文字
C#/VB.NET 使用另一个 Word 文档替换 Word 文本
C#/VB.NET 用图片、表格替换 Word 文本
C#/VB.NET Word 使用正则表达式查找和替换文本
C#/VB.NET Word 中添加强调符号
C#/VB.NET Word 中更改英文文本为全部大写
C#/VB.NET 在 Word 文档中查找并突出显示文本
C#/VB.NET 将格式应用于 Word 中的字符
图片和形状
C#/VB.NET 添加形状和形状组合到 Word 文档
C#/VB.NET 创建 Word 艺术字
C#/VB.NET 修改 Word 文档中图片的大小
C#/VB.NET Word 中添加和删除题注
C#/VB.NET 如何插入图片到 Word 以及提取 Word 中的图片
C#/VB.NET 在 Word 中插入图片
C# 替换 Word 中的图片
如何使用 C# 从 Word 中提取图片
超链接
C#/VB.NET Word 中添加超链接链接到书签
C#/VB.NET Word 文档中插入超链接
C# 查找、修改 Word 文档中的超链接
C# 修改 Word 文档中图片和形状的超链接
通过C# 删除 Word 文档中的超链接
批注
C#/VB.NET 插入、提取 Word 批注中的图片
C#/VB.NET 读取 Word 批注中的文本内容
C#/VB.NET 在 Word 中添加、回复或删除 Word 中的注释
表格
C#/VB.NET 创建 Word 表格
C#/VB.NET 设置 Word 表格的格式
C#/VB.NET 操作 Word 表格行和列
C#/VB.NET 将 Excel 表格导入 Word
C#/VB.NET 提取 Word 表格中的图片
C#/VB.NET 复制 Word 表格行或列
C#/VB.NET 合并与拆分 Word 表格中的单元格
C#/VB.NET 在 Word 表格中插入或提取图像
C# 添加、修改和移除 Word 表格边框
C# 设置 Word 表格列宽
C# 从 Word 文档中提取表格
C# 删除 Word 文档中的表格
书签
C#/VB.NET 添加,替换和删除 Word 书签
C#/VB.NET 获取、删除书签的内容
C#/VB.NET 如何在 Word 文档的书签位置插入图片
C#/VB.NET 在 Word 书签位置插入表格
C#/VB.NET 在 Word 中插入书签
页眉和页脚
C#/VB.NET 删除 Word 文档中的页眉页脚
C#/VB.NET 如何锁定 Word 页眉和页脚不被修改
C#/VB.NET 复制 Word 页眉/页脚
C#/VB.NET 调整 Word 页眉页脚的位置高度
C#/VB.NET 设置 Word 首页/奇偶页页眉页脚不同
C#/VB.NET 在 Word