PDF 的设计目标是「在任何设备上看起来一样」,代价是它记录的是页面上每个字的位置,而不是文档的语义结构。这就解释了这一组工具的能力边界:合并、拆分、提取页面、重排、加水印、加密这类页面级操作可靠且无损;转成 Word 这类需要还原结构的操作只能尽力而为。
全部处理都在浏览器内完成,所以合同、发票、证件扫描件不需要上传给第三方服务。
完成 PDF 转 Word、Word/Excel/PowerPoint/EPUB/MOBI/图片转 PDF,并支持合并、拆分、提取页面和整理 PDF 页面。所有首版 PDF 操作都在浏览器本地完成。
首版 PDF 转换在浏览器本地完成,文件不会上传到服务器。
PDF 的设计目标是「在任何设备上看起来一样」,代价是它记录的是页面上每个字的位置,而不是文档的语义结构。这就解释了这一组工具的能力边界:合并、拆分、提取页面、重排、加水印、加密这类页面级操作可靠且无损;转成 Word 这类需要还原结构的操作只能尽力而为。
全部处理都在浏览器内完成,所以合同、发票、证件扫描件不需要上传给第三方服务。
不同操作对原始内容的保真程度差别很大,选之前值得先看清这一点。
| 操作 | 是否无损 | 会发生什么 | 需要注意 |
|---|---|---|---|
| 合并 / 拆分 / 提取 / 重排 | 无损 | 只改动页面对象的组织方式 | 书签和部分表单域可能不随页面迁移 |
| 加水印 | 接近无损 | 在原页面上叠加一层内容 | 水印是可被再次编辑移除的图层,不等于防篡改 |
| 加密 / 解密 | 无损 | 只改变文档的权限与加密设置 | 权限限制依赖阅读器遵守,不是强加密保护 |
| PDF 转 Word | 有损 | 按文字位置反推段落与样式 | 复杂排版、表格、分栏需要人工校对 |
扫描件本质上是图片。如果 PDF 是拍照或扫描生成的,里面没有文字层,转 Word 或复制文字都取不到内容:这种情况需要先做 OCR 文字识别。
PDF 的权限限制(禁止打印、禁止复制)是写给阅读器看的声明,取决于阅读器是否遵守,不能当作加密强度。真正需要保密请用打开密码。
本地处理受浏览器内存限制。页数极多或含大量高分辨率图片的文件可能失败,可以先拆分成几份再分别处理。