PDF 转 HTML

在浏览器中直接将您的 PDF 文件转换为 HTML。

... 或将文件拖放到此处

文件绝不会离开您的设备

请添加要转换的 PDF 文件。

常见问题

HTML 文件里究竟装的是什么?

.html 文件是一棵标签树,用来描述每一段内容“是什么”——标题、列表还是表格——至于长什么样,则交给渲染它的程序决定。

我的文件会被上传到服务器吗?

不会。您的 PDF 文件在浏览器中读取,HTML 文件也完全在浏览器中生成,因此没有任何内容离开您的设备。

如何一次下载所有图片?

使用「全部下载 (.zip)」即可将所有页面的图片打包在一个压缩包中获取。

版式会和原文件完全一样吗?

文字、标题和表格的列会被还原并重新组合成 HTML 文件。这是忠于内容的转换,而不是原始页面版式的复制,因此字体、间距和图片都不会保留。

扫描版 PDF 怎么办?

扫描页面是文字的图片而不是文字本身,因此没有内容可提取。请改为转换成图片格式,或先进行 OCR 文字识别。

对文件大小或数量有限制吗?

没有。所有处理都在您自己的设备上运行,唯一的实际限制是浏览器可用的内存大小。

需要安装什么吗?

不需要。无需安装任何东西,也无需注册账号——该转换器可在任何现代浏览器中运行,电脑和手机皆可。

关于 HTML 格式

.html 是 Tim Berners-Lee 于 1993 年推出的标记语言格式。 它以 WHATWG HTML 的名义作为公开规范发布,因此不必依赖创建它的程序也能读取文件。

.html 文件是一棵标签树,用来描述每一段内容“是什么”——标题、列表还是表格——至于长什么样,则交给渲染它的程序决定。

这类文件通常出自 Chrome、Firefox和VS Code。

会保留下来的

  • 标题层级
  • 正文文字
  • 表格的行与列
  • 项目符号与编号列表
  • 阅读顺序

不会保留的

  • 原本的页面版式
  • 嵌入的图片
  • 嵌入的字体

值得了解

  • 扫描版 PDF 是一页纸的照片而不是文字,因此本工具无从提取,结果会是空的。这是如实的结果,而不是出了故障。
  • 这项转换忠于内容而非像素:文字、标题层级和表格的列会保留下来,原本的页面版式不会。
信息
  • Windows
  • Linux
  • Mac
  • iPhone
  • Android

如何使用PDF 转 HTML

在浏览器中直接将您的 PDF 文件转换为 HTML。

提供多种工具

本网站提供众多处理 PDF 的工具:合并、拆分、转换、签名等等。

使用简单

PDF Goat 24 让编辑 PDF 尽可能快速简单。无需安装或配置任何东西——直接在这里使用工具即可。

适配您的系统

没有特殊要求。此工具可在任何现代浏览器上运行,支持 Windows、Mac、Linux 和移动设备。

无需安装

您无需安装任何软件。一切都直接在您的浏览器中运行,就在您所在的地方。

安全对我们很重要

您的文件完全在您的浏览器中处理,绝不会上传到服务器,因此始终保持私密。

更多实用工具

分享此页面

请为此应用评分