选择文字型PDF
适合报告、合同、论文等以文字为主的文件。
选择全部或指定页面,提取PDF已有文字层并生成标准DOCX,可按原页面插入分页符。原PDF不上传;工具专注文字可编辑,不承诺还原复杂版式或OCR扫描件。
适合报告、合同、论文等以文字为主的文件。
留空转换全部,也可填写1,3,5-8。
在Word中编辑前,先核对多栏、表格和特殊符号。
正文、标题和普通段落可写入DOCX,便于修改、引用与重新排版。
表格、图片、分栏、公式、页眉页脚和精确位置可能丢失或改变。
页面只有图片时没有可编辑文字层,本工具不会猜测或伪造识别结果。
PDF.js的 getTextContent() 提供页面文字项与换行信息。本站逐页读取后,将文字写入WordprocessingML的 document → body → paragraph → run → text 结构,并在浏览器内打包为DOCX。
微软说明PDF转Word最适合以文字为主的文档,而且转换结果可能与原PDF不同;图表密集页面甚至可能只表现为图片。本站因此把输出明确标为“文字版Word”,并把版式差异放在工具前说明。
PDF.js:getTextContent ↗Microsoft Learn:WordprocessingML结构 ↗Microsoft Support:在Word中打开PDF ↗
PDF字节、提取文字、WordprocessingML和DOCX压缩包都在浏览器标签页内生成。本站不上传文档、不保存文字、不调用云端转换或OCR服务。
不会。PDF读取、文字层提取、WordprocessingML生成和DOCX打包全部在当前浏览器中完成,本站服务器不会收到文档内容。刷新或关闭标签页后,临时结果会释放。
不会。本工具生成便于继续编辑的文字版DOCX,尽量保留段落换行与可选的原PDF分页,但不还原图片、表格、页眉页脚、字体、分栏、公式或精确位置。重要版式请对照原PDF。
不能直接转换成可编辑文字。此工具只读取PDF已有文字层,不做OCR;扫描件可先导出PNG,再使用可信OCR识别,或使用专业软件处理。
部分PDF只有页面图片,或把文字转成路径轮廓;也有文件使用异常字体编码。它们视觉上像文字,但没有可正常读取的文字层,通常需要OCR或原始编辑文件。
PDF记录固定页面上的绘制位置,Word使用可重排的段落。微软也说明PDF转Word最适合以文字为主的文档,而且转换结果不一定与原PDF完全一致。
可以。填写1,3,5-8等页码或范围;留空表示全部。一次最多200页、200万字符,长文档建议分批转换并逐段核对。
输出采用标准Office Open XML文字文档结构,通常可在Microsoft Word、WPS Office、LibreOffice和支持DOCX导入的在线文档工具中打开。不同软件的字体与分页可能略有差异。
暂不支持,也不会要求你把PDF密码提交给本站。请由文件所有者先在可信软件中解除保护,再处理可正常打开的副本。