PDF 转 HTML 转换器
自动删除/文件在我们的服务器上处理,转换完成后立即删除。
或将您的图片拖放到此处
如何将 PDF 文件转换为 HTML
PDF 转 HTML 转换器
本工具接受 PDF 文件,返回 HTML 文件。PDF 格式只记录文字在页面上的位置,并不记录哪一部分是标题、列表还是表格。所以 HTML 格式结果的结构必须从字号和位置推断出来。结果是一个近似,而不是一对一的转换。
如何把 PDF 文件转换为 HTML 格式
- 选择 PDF 文件,或者把它拖到上传区域
- 确认所需的结果是 HTML 格式
- 开始转换,并留意每个文件的状态
- 逐个下载已完成的结果
一次转换多个文件
本页面一次最多接受 10 个文件,并逐个处理。重复的文件、名称不合规的文件以及已损坏的文件,可能会被跳过或报为错误。
转换后的文件大小
大小很难预测,因为文字被提取出来,而图片会以另一种方式重新摆放。
如何检查结果
检查标题层级、段落顺序,以及原先是表格或分栏的所有段落。如果来源是扫描件,里面没有可提取的文字,结果会是空的。
需要知道的限制
本工具改变的是文件格式。并不保证所有元数据、各格式特有的全部属性以及所有嵌入对象都能毫发无损地通过转换。请保留原始文件,并在真正要使用该文件的那个程序里打开结果。
常见问题
为什么标题层级出错
因为层级是从字号推断出来的。原文件里没有可以依据的结构信息。
扫描版 PDF 能转换吗
扫描件里只有图像,没有可提取的文字。所以结果里不会有书面内容。
我的原始文件会被改动吗
不会。留在你设备上的那个文件保持原样。
