转换器不支持的功能
它把 PDF 的文字重建为 Word 段落。有些 PDF 本来就没有存储的内容,自然无法找回。
不支持扫描版 PDF
扫描页面是没有文本层的图片,工具无法读取。请先用 PDF 与图片 OCR 处理,再把识别出的文字粘贴到文档中。
没有图片或表格
只能得到文字。图片和真正的 Word 表格不会被提取;表格的单元格通常会变回一行行独立的文字。
不保留原始格式
字体、颜色、粗体和斜体样式以及多栏版式都不会保留,源页面之间也没有真正的 Word 分页符,只有一个可选的“第 N 页”标题。
重新排版只是估计
段落分隔是通过测量文字行之间的间距得出的,而不是 PDF 的真实结构,因此不常见的版式可能排版错乱。如果段落合并有误,可切换为“保留每一行为独立段落”。
一次只能处理一个文件
队列一次只接受一个 PDF,最大 100 MB。若要反向转换,请使用 DOCX 转 PDF。
相关工具
常见问题
转换器会把 PDF 中的文字重建为可编辑的 Word 段落。阅读顺序和段落分隔会保留,但分栏、表格、图片和精确的字体样式不会还原,因为 PDF 存储的是定位好的字符,而不是文档结构。
扫描版 PDF 是没有文本层的页面图片,因此本工具无法读取。请先用 PDF 与图片 OCR 识别文字,再把文字粘贴到文档中。
工具无法打开它。请在创建该 PDF 的应用程序中,或用其他 PDF 工具移除密码后再试一次。
不会。PDF.js 打开文件,JSZip 组装 .docx 包,整个过程完全在浏览器标签页内完成。您文档的任何字节都不会离开设备。
可以。本工具写出的是符合标准的 Office Open XML WordprocessingML 包,也就是 Word 自身保存所用的 .docx 格式,因此可以在 Microsoft Word、Google Docs、LibreOffice Writer、Pages 和 WPS Office 中打开。
默认情况下,换行会合并为连贯的段落。这个选项会改为保留 PDF 原有的换行,适合表格、代码、地址等不该重新排版的内容。
文件始终留在您的设备上
PDF.js 读取文件,JSZip 在同一个标签页内构建 .docx。您的文档不会被上传或存储,关闭标签页后即从内存中清除。只有在需要时,才会从 cdnjs 下载这些库。