PDF 转 JSON
为 JavaScript、Python 或 ETL 流程导出 PDF 的标准元数据、页数和逐页文字。JSON 包含文档元数据以及每页的页码和纯文字,便于程序继续处理。不重建表格、坐标、图片、字体或视觉版式;没有文字层的扫描页会得到空内容,必须先执行 OCR。整个处理过程都在当前浏览器中完成,原始文件不会上传到 1PDF 服务器;实际速度取决于文件大小和设备可用内存。
选择文件或拖放到这里
.pdf · 单个文件
文件仅在浏览器本地处理,不会离开你的设备。
如何使用PDF 转 JSON
- 选择需要使用“PDF 转 JSON”处理的文件,并确认文件和页面顺序正确。
- 根据页面上的选项设置处理参数,然后在本地执行“PDF 转 JSON”。
- 下载结果并在常用阅读器中检查页数、方向、清晰度和目标内容。
常见问题
“PDF 转 JSON”会把文件上传到服务器吗?
不会。文件解析和结果生成都在你的浏览器本地完成,原始文档不会发送到 1PDF 服务器。
使用“PDF 转 JSON”会改变原文件吗?
不会覆盖原文件。JSON 包含文档元数据以及每页的页码和纯文字,便于程序继续处理,浏览器会把结果作为一个新文件下载。
使用这项功能前需要注意什么?
不重建表格、坐标、图片、字体或视觉版式;没有文字层的扫描页会得到空内容,必须先执行 OCR。处理重要文件时,请保留原件并在分享前检查下载结果。
相关工具
PDF 转 JPG
按所选分辨率把 PDF 的每一页转换为 JPG 图片。转换完全在浏览器本地进行,不上传文档,支持多页打包下载。
PDF 转 PNG
将 PDF 每一页渲染为清晰的 PNG 图片,可自定义分辨率。文档不会上传,多页结果自动打包下载。
PDF 转 TXT
从含文字层的 PDF 中提取可复制文字并保存为 TXT。处理完全在浏览器本地进行,文档不会上传服务器。
提取 PDF 图片
从 PDF 对象中提取可识别的嵌入图片并下载,多个结果自动打包。不会把整页渲染成图片,处理在浏览器本地完成。
提取 PDF 表格
根据文字位置把每个含文本的 PDF 页面整理为一个 CSV。不会识别同页多张独立表格,扫描件需要先做 OCR。
PDF 转 WebP
按指定分辨率把每个 PDF 页面转换为独立 WebP 图片,多页结果自动打包。转换在浏览器本地完成。