字体没嵌入,Word里字全变方块
你传了个带中文标题的PDF,转完打开Word一看,标题变成一堆□□□,正文倒是正常——这八成是原PDF用了非系统字体(比如思源黑体或华文细黑),但导出时没勾选‘嵌入字体’。Windows自带的宋体、微软雅黑能兜底,但设计稿、投标文件常用字体往往不内置。我们试过一份17页的招标书PDF(8.4MB),用默认设置转换后,三级标题全部失真。解决方法很简单:上传前先用Adobe Acrobat点‘文件→属性→字体’,看有没有‘(not embedded)’字样;如果有,优先用我们这个PDF转Word工具,它会自动检测并启用备用字体映射,比本地软件更稳。
扫描件当真PDF用,结果文字全糊成图
很多人把手机拍的合同照片存成PDF就直接上传转换,结果Word里只有一张大图,没法编辑。这不是转换失败,是你手里的根本不是‘可选中文字’的PDF。真正能提取文字的PDF,用鼠标拖一下就能高亮字;如果只能框选一片灰,说明它是扫描图。这时候必须开OCR——但别急着点‘开始转换’。我们实测发现,同样一份A4扫描件(300dpi,2.1MB),选‘标准OCR’模式,识别率约82%;换成‘高精度OCR+保留原始布局’,虽然耗时多40秒,但表格线对齐度提升明显,连发票上的小字号金额都认准了。
表格一拆三,合并单元格全没了
Pdf里一个跨三行的审批表,转到Word里变成6个小格子,表头还跑到第二页去。问题出在PDF表格本身就没用标准表格结构,而是靠线条+空格硬撑。尤其老系统导出的PDF(比如金蝶、用友早期版本),表格本质是‘文本块+竖线’。我们建议:先用在线工具预处理——上传后别急着下载,点‘预览’看表格是否完整。如果发现错位,勾选‘强制按列分割’选项,它会重新分析视觉列宽,再导出。上周有位财务同事反馈,她处理的12页报销单PDF(含嵌套表格),用这个方式重试后,87%的合并单元格成功还原,剩下几处手动调整也只要两三分钟。

意见反馈
提交成功