调整下载方式与工具使用偏好。
适用于单个 PDF 或图片文件,不包含 ZIP 下载。
下载文件数量超过此值时,打包为 ZIP。
对此问题感到抱歉!
如果你仍然遇到问题,不要犹豫,向我们寻求帮助。你可以在我们的GitHub页面上提交工单,或者通过Discord与我们联系:
免费免登录 · 单文件最多 50MB · 同一网络一次处理一个任务。转换文件会上传至服务器,完成后清理。使用与隐私说明
请先选择需要处理的文件。
将PDF转换为HTML格式。
将 PDF 转成可在浏览器中查看的 HTML 及相关资源,并用 ZIP 一起交付。它用于页面内容转换,不是自动制作完整网站。
上传能正常打开的 PDF。加密或损坏文档应先处理;扫描页可能以图像方式呈现,不会自动恢复为语义化网页正文。
转换可能生成 HTML、图片和多个辅助文件。它们彼此引用,下载后应完整解压,保留原有文件名和目录关系。
在解压后的文件夹中打开生成的 HTML。不要只移动某个 HTML 文件而遗漏图片,否则页面可能出现空白、错位或缺失资源。
PDF 的固定页面布局转为网页后,字体、分页、定位和缩放可能不同。请在实际使用的浏览器和屏幕宽度下检查。
生成的结构更偏向还原页面外观,不保证有整洁的标题层级、响应式布局或可直接维护的业务组件。发布前通常还需整理代码与资源。
核对所有页、超链接、图表和文字复制结果。需要文字语义更清晰时,可另外提取文本,再由你所用的建站流程重新组织。
HTML 往往依赖单独的图片和辅助文件,ZIP 用于把这些结果集中交付。完整解压后再查看,不要把 ZIP 直接改成 html 后缀。
HTML 引用了同批生成的资源文件,移动或删除资源会破坏路径。保持解压后的文件结构,并从该目录打开入口 HTML。
不会保证。PDF 原本是固定版面,转换得到的页面可能采用固定定位,需要另行编写响应式样式才能达到正式网站的效果。
不能。工具基于 PDF 内容重建 HTML,不包含原网站的组件、业务逻辑或编辑工程,也不能找回已经丢失的源结构。
扫描页主要是图片,普通转换不能保证识别文字。可先使用 OCR,但识别层也不等于完整、语义清晰的网页正文结构。
可先作为静态内容检查,但发布前应核对资源路径、可读性、链接和页面样式。转换成功不代表已经完成网站适配与内容整理。
此服务使用pdftohtml进行文件转换。