ParseJet

PDF OCR — 扫描PDF文字识别

扫描 PDF 就是页面的图片:无法搜索、无法选文字、无法复制。ParseJet 的 PDF OCR 对每个纯图像页面进行字符识别,在我们自己的服务器上运行,返回你可以搜索、复制、重复使用的文字。已有文本层的页面直接提取,所以混合文档也能完整返回。

拖放文件到此处或 浏览

支持PDF文件

免费 — 每天3次请求,无需注册。 获取每月300个免费额度。

工作原理

1

上传扫描 PDF

拖放扫描仪生成的文件、手机扫描应用或传真的 PDF。也支持有文本层的数字 PDF。

2

逐页文字识别

ParseJet 检查每一页。有文字的页面直接读取;纯图像页面进行渲染并通过 OCR 处理。

3

复制文字

复制整个文档,或通过 API 以 Markdown 或纯文本格式获取,用于搜索、电子表格或 LLM。

主要特性

这款pdf ocr脱颖而出的原因。

自动检测哪些页面需要 OCR

无需配置。少于几十个可提取字符的页面被视为扫描件并进行识别;其他所有页面保留原始文字。

20+ 种语言

拉丁文字、简体和繁体中文、日文无需设置。韩文、西里尔文、阿拉伯文、印地文、泰文和希腊文扫描件需要一个语言提示。

混合文档处理

有扫描签名页的合同、插入扫描件的报告——文字按页序返回,识别的页面自动拼接。

不离开我们的服务器

页面在 ParseJet 自己的基础设施上进行渲染和识别,使用开源模型;任何第三方 AI 服务都看不到你的文档。

Markdown 或纯文本

请求 output_format=markdown 以保留数字页面的标题和表格,或 raw 获取纯文本。

单次请求最多 30 个扫描页面

足以处理大多数信件、表单和报告。更长的扫描件:分割文件或通过 API 分批处理。

使用场景

此工具能为您节省时间的常见场景。

存档合同和发票

让多年的扫描文件变得可搜索——提取文字一次并建立索引。

手机扫描的文档

扫描应用保存纯图像 PDF。通过 OCR 运行它们以复制地址、条款或总数。

旧书和报告

将扫描页面转换为文字,用于引用、翻译或无障碍工具。

将扫描件输入 AI

Claude 和 ChatGPT 无法可靠地读取页面照片。先进行 OCR,再粘贴或输入文字。

通过API自动化

以编程方式使用相同的工具。适用于任何语言——仅需HTTP。

cURL
# Scanned pages are detected and OCR'd automatically
curl -X POST "https://api.parsejet.com/v1/parse/auto/file?output_format=markdown" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]"

# Non-Latin scripts: add a language hint (ko, ru, ar, hi, th, el ...)
curl -X POST "https://api.parsejet.com/v1/parse/auto/file?language=ru" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]"

# Response metadata tells you which pages were recognized:
# "metadata": { "ocr_pages": [1, 2, 3], ... }
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/auto/file",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("scan.pdf", "rb")},
    params={"output_format": "markdown"},
    timeout=120,
)
data = resp.json()
print(data["text"])
print("OCR'd pages:", data["metadata"].get("ocr_pages", []))
JavaScript
const formData = new FormData();
formData.append("file", pdfFile);

const res = await fetch(
  "https://api.parsejet.com/v1/parse/auto/file?output_format=markdown",
  { method: "POST", headers: { Authorization: "Bearer YOUR_API_KEY" }, body: formData },
);
const { text, metadata } = await res.json();
console.log(text);
console.log("OCR'd pages:", metadata.ocr_pages ?? []);

想自动化处理吗?

ParseJet API 通过一个 HTTP 端点提供相同的解析能力。无需 ffmpeg、poppler 或 tesseract — 只需一次 API 调用。

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
查看 API 文档

常见问题

如何对 PDF 进行 OCR?

在上方上传 PDF。ParseJet 查看每一页,识别纯图像的页面,并显示完整文字——通常在几秒钟内完成一份典型的信件或表单。复制它,或调用 API 对许多文件执行相同操作。

我怎样知道我的 PDF 是否需要 OCR?

打开它并尝试选中一个单词。如果没有突出显示,或放大后字母看起来像照片一样像素化,那么页面是图像,需要 OCR。来自扫描仪、传真机和手机扫描应用的 PDF 几乎总是这样。

能得到可搜索的 PDF 返回吗?

你得到的是文字,不是新的 PDF 文件。这是你复制、搜索、索引、翻译或输入 AI 模型所需的。如果你特别需要原始 PDF 加上隐形文本层,OCRmyPDF 等桌面工具可以做到。

有页面限制吗?

单次请求最多识别 30 个扫描页面;已包含文字的页面不计入限制。对于更长的扫描件,分割文件或通过 API 分部分发送。响应元数据列出识别的页面和跳过的页面。

支持哪些语言?

英文和所有拉丁文字、简体和繁体中文、日文自动支持。对于韩文、俄文和其他西里尔文字、阿拉伯文、印地文、泰文或希腊文,传递 language=ko、ru、ar、hi、th 或 el(本页面的本地化版本已为你设置)。

这是免费的吗?

是的。无需注册每天免费 3 次,免费账户每月 300 积分,付费计划从 19 美元/月起,支持更大的文件和更高的配额。

免费开始提取文本

无需注册。几秒钟内解析您的第一个文件。

查看价格