使用 C# 将 PDF 表格提取到 Excel

本简短指南描述了如何 使用 C# 从 PDF 提取表格到 Excel。您将获得设置 Aspose.PDF 与 Aspose。Cells 的 IDE 的详细信息、步骤列表,以及一个 使用 C# 将 PDF 表格导出到 Excel 的示例代码。提供的示例代码将演示完成此任务所需的所有必要代码流程。

使用 C# 将 PDF 表格数据提取到 Excel 的步骤

  1. 将 IDE 设置为在同一项目中同时使用 Aspose.PDF for .NETAspose.Cells for .NET
  2. 应用 Aspose.Total 许可证,以在不受任何限制或水印的情况下使用 API 功能
  3. 将源 PDF 文件加载到 Document 类对象中
  4. 使用 Workbook 类创建一个新的 Excel 文件,并为第一个工作表设置名称
  5. 解析 PDF 文件中的每一页
  6. 访问每页上的所有表格,并对每个表格,访问每行每列中的文本
  7. 将每个单元格的内容写入 Excel 文件目标工作表的相应行和单元格中
  8. 调整行/列宽度并保存工作簿

这些步骤概述了如何使用 C# 将 PDF 提取为 Excel 表格。设置开发 IDE,应用许可证,加载源 PDF,创建新的 Excel 文件,并解析 PDF 的每一页。获取每页中的表格集合,解析每个表格以获取单元格内容,并将其复制到输出 Excel 文件的目标工作表中的相应行和列。

使用 C# 将 PDF 表格提取到 Excel 的代码

此代码演示了如何 pull table from PDF into Excel using C#。提供的示例代码将 PDF 表格中的纯文本写入 Excel 单元格。您可以通过使用 PDF 单元格的字体、大小、粗体/斜体样式和颜色来保留格式。您还可以检测 PDF 表格中的数值和类似日期的值,并在写入 Excel 文件时使用相应的格式。

本教程解释了将 PDF 表格内容转移到 Excel 表格的过程。要将扫描的 PDF 转换为可编辑的 PDF,请参阅文章《使用 C# 将扫描的 PDF 转换为可编辑的 PDF》( https://kb.aspose.com/ zh/total/net/convert-scanned-pdf-to-editable-pdf-using-csharp/).

 简体中文