Skip to content
全新发布

PDF SDK 与 AI 文档处理

在 GitHub 获取完整的私有化部署SDK 包及 AI 智能文档处理能力,一键部署,快速构建您的文档处理工作流。

PDF 转 HTML

概述

ComPDF Conversion SDK 提供 PDF 转 HTML 功能,可以将 PDF 文件转换为 HTML 文件,同时保持原始文档的布局和格式,允许用户在 Web 上浏览和查看文档。

注意事项

在将 PDF 转换为 HTML 格式时,ComPDF Conversion SDK 提供以下四种选项来创建 HTML 文件:

选项描述
SINGLE_PAGE将整个 PDF 文件转换为一个单一的 HTML 文件,所有 PDF 页面按页码顺序连接,显示在同一个 HTML 页面上。
SINGLE_PAGE_WITH_BOOKMARK将 PDF 文件转换为一个单一的 HTML 文件,并在 HTML 页面的开头添加目录以供导航。仍然是将所有 PDF 页面按页码顺序连接,显示在同一个 HTML 页面上。
MULTIPLE_PAGE将 PDF 文件转换为多个 HTML 文件,每个 HTML 文件对应一个 PDF 页面,用户可以通过 HTML 页面的底部链接导航到下一个 HTML 文件。
MULTIPLE_PAGE_WITH_BOOKMARK将 PDF 文件转换为多个 HTML 文件,每个 HTML 文件对应一个 PDF 页面,用户可以通过 HTML 页面的底部链接导航到下一个 HTML 文件。所有 HTML 文件的链接会以目录形式呈现在一个 HTML 文件中以供导航。

示例

以下是完整的示例代码,演示了如何将 PDF 文档转换为 HTML 文档。

python
input_file_path = "***"
password = "***"
output_file_name = "***"

html_options = ConvertOptions()
error = CPDFConversion.start_pdf_to_html(input_file_path, password, output_file_name, html_options)