PDF 转 DOCX 转换器

pdf → docx

将 PDF 转换为可编辑的 Word(.docx)文档。您的浏览器读取文本层并自行生成文件,因此不会上传任何内容。

设置
队列不会上传任何文件
将 PDF 文件拖放到此处
正在读取 PDF 文本层...

关于这款 PDF 转 DOCX 转换器

转换器在您的浏览器中把 PDF 转换为可编辑的 Word 文档。PDF.js 逐页读取文本层,把定位好的文字重新组合成行和段落,再用 JSZip 把结果打包成真正的 Office Open XML .docx 文件。

PDF 记录的是每个字符在页面上的位置,而不是某一行是标题还是表格单元格,因此转换器需要根据位置和间距来推断结构。在普通文字页面上,它能较好地还原阅读顺序和段落;扫描页面完全没有文本层,自然也就无从读取。

使用方法

01

添加 PDF

将 PDF 拖放到方框中,或点击“选择 PDF 文件”选取。若文件含文本层会显示文字预览,否则会显示提示。

02

选择排版方式

决定换行是合并为段落还是保持独立,以及是否在每页插入“第 N 页”标题。

03

转换

点击“将 PDF 转换为 DOCX”。PDF.js 会逐页读取,进度条随之更新。

04

获取文件

生成好的 .docx 会带着“下载”按钮出现,文件名取自您最初的 PDF。只有点击后它才会保存到您的设备。

功能

  • 您的浏览器读取 PDF 并写出 Word 文件;不会上传任何内容。
  • 阅读顺序和段落分隔会保留。默认情况下换行会合并为段落,您也可以选择保留 PDF 的每一行作为独立段落。
  • 可以选择在每页文字上方插入加粗的“第 N 页”标题。
  • 生成结果是真正的 Office Open XML .docx 包,也就是 Word 自身保存所用的格式,由 JSZip 构建。
  • 扫描页面或其他纯图片 PDF 没有文本层,工具因此无法读取;此时会有提示引导您使用 OCR 工具。
  • 一次转换一个 PDF,最大 100 MB。

技术规格

规格 说明
支持格式 含文本层的 PDF 文件,一次一个
输出 一个 .docx 文件,A4 尺寸,页边距 2 厘米
排版选项 将换行合并为段落,或保留每一行独立
页面标题 每页可选插入加粗的“第 N 页”标题
不会提取 图片、表格、分栏、字体和颜色;只读取文字
文件大小上限 100 MB
依赖库 PDF.js 读取文件,JSZip 打包 .docx,两者均从 cdnjs CDN 加载
文件去向 哪儿也不去,始终留在当前标签页的内存中
使用须知

转换器不支持的功能

它把 PDF 的文字重建为 Word 段落。有些 PDF 本来就没有存储的内容,自然无法找回。

不支持扫描版 PDF

扫描页面是没有文本层的图片,工具无法读取。请先用 PDF 与图片 OCR 处理,再把识别出的文字粘贴到文档中。

没有图片或表格

只能得到文字。图片和真正的 Word 表格不会被提取;表格的单元格通常会变回一行行独立的文字。

不保留原始格式

字体、颜色、粗体和斜体样式以及多栏版式都不会保留,源页面之间也没有真正的 Word 分页符,只有一个可选的“第 N 页”标题。

重新排版只是估计

段落分隔是通过测量文字行之间的间距得出的,而不是 PDF 的真实结构,因此不常见的版式可能排版错乱。如果段落合并有误,可切换为“保留每一行为独立段落”。

一次只能处理一个文件

队列一次只接受一个 PDF,最大 100 MB。若要反向转换,请使用 DOCX 转 PDF。

相关工具

常见问题

转换器会把 PDF 中的文字重建为可编辑的 Word 段落。阅读顺序和段落分隔会保留,但分栏、表格、图片和精确的字体样式不会还原,因为 PDF 存储的是定位好的字符,而不是文档结构。

扫描版 PDF 是没有文本层的页面图片,因此本工具无法读取。请先用 PDF 与图片 OCR 识别文字,再把文字粘贴到文档中。

工具无法打开它。请在创建该 PDF 的应用程序中,或用其他 PDF 工具移除密码后再试一次。

不会。PDF.js 打开文件,JSZip 组装 .docx 包,整个过程完全在浏览器标签页内完成。您文档的任何字节都不会离开设备。

可以。本工具写出的是符合标准的 Office Open XML WordprocessingML 包,也就是 Word 自身保存所用的 .docx 格式,因此可以在 Microsoft Word、Google Docs、LibreOffice Writer、Pages 和 WPS Office 中打开。

默认情况下,换行会合并为连贯的段落。这个选项会改为保留 PDF 原有的换行,适合表格、代码、地址等不该重新排版的内容。

文件始终留在您的设备上

PDF.js 读取文件,JSZip 在同一个标签页内构建 .docx。您的文档不会被上传或存储,关闭标签页后即从内存中清除。只有在需要时,才会从 cdnjs 下载这些库。