PDF 转 HTML 转换器

自动删除/文件在我们的服务器上处理,转换完成后立即删除。

或将您的图片拖放到此处

如何将 PDF 文件转换为 HTML

PDF 转 HTML 转换器

本工具接受 PDF 文件,返回 HTML 文件。PDF 格式只记录文字在页面上的位置,并不记录哪一部分是标题、列表还是表格。所以 HTML 格式结果的结构必须从字号和位置推断出来。结果是一个近似,而不是一对一的转换。

如何把 PDF 文件转换为 HTML 格式

  1. 选择 PDF 文件,或者把它拖到上传区域
  2. 确认所需的结果是 HTML 格式
  3. 开始转换,并留意每个文件的状态
  4. 逐个下载已完成的结果

一次转换多个文件

本页面一次最多接受 10 个文件,并逐个处理。重复的文件、名称不合规的文件以及已损坏的文件,可能会被跳过或报为错误。

转换后的文件大小

大小很难预测,因为文字被提取出来,而图片会以另一种方式重新摆放。

如何检查结果

检查标题层级、段落顺序,以及原先是表格或分栏的所有段落。如果来源是扫描件,里面没有可提取的文字,结果会是空的。

需要知道的限制

本工具改变的是文件格式。并不保证所有元数据、各格式特有的全部属性以及所有嵌入对象都能毫发无损地通过转换。请保留原始文件,并在真正要使用该文件的那个程序里打开结果。

常见问题

为什么标题层级出错

因为层级是从字号推断出来的。原文件里没有可以依据的结构信息。

扫描版 PDF 能转换吗

扫描件里只有图像,没有可提取的文字。所以结果里不会有书面内容。

我的原始文件会被改动吗

不会。留在你设备上的那个文件保持原样。