PDF OCR — 扫描PDF文字识别
扫描 PDF 就是页面的图片:无法搜索、无法选文字、无法复制。ParseJet 的 PDF OCR 对每个纯图像页面进行字符识别,在我们自己的服务器上运行,返回你可以搜索、复制、重复使用的文字。已有文本层的页面直接提取,所以混合文档也能完整返回。
拖放文件到此处或 浏览
支持PDF文件
免费 — 每天3次请求,无需注册。 获取每月300个免费额度。
工作原理
上传扫描 PDF
拖放扫描仪生成的文件、手机扫描应用或传真的 PDF。也支持有文本层的数字 PDF。
逐页文字识别
ParseJet 检查每一页。有文字的页面直接读取;纯图像页面进行渲染并通过 OCR 处理。
复制文字
复制整个文档,或通过 API 以 Markdown 或纯文本格式获取,用于搜索、电子表格或 LLM。
主要特性
这款pdf ocr脱颖而出的原因。
自动检测哪些页面需要 OCR
无需配置。少于几十个可提取字符的页面被视为扫描件并进行识别;其他所有页面保留原始文字。
20+ 种语言
拉丁文字、简体和繁体中文、日文无需设置。韩文、西里尔文、阿拉伯文、印地文、泰文和希腊文扫描件需要一个语言提示。
混合文档处理
有扫描签名页的合同、插入扫描件的报告——文字按页序返回,识别的页面自动拼接。
不离开我们的服务器
页面在 ParseJet 自己的基础设施上进行渲染和识别,使用开源模型;任何第三方 AI 服务都看不到你的文档。
Markdown 或纯文本
请求 output_format=markdown 以保留数字页面的标题和表格,或 raw 获取纯文本。
单次请求最多 30 个扫描页面
足以处理大多数信件、表单和报告。更长的扫描件:分割文件或通过 API 分批处理。
使用场景
此工具能为您节省时间的常见场景。
存档合同和发票
让多年的扫描文件变得可搜索——提取文字一次并建立索引。
手机扫描的文档
扫描应用保存纯图像 PDF。通过 OCR 运行它们以复制地址、条款或总数。
旧书和报告
将扫描页面转换为文字,用于引用、翻译或无障碍工具。
将扫描件输入 AI
Claude 和 ChatGPT 无法可靠地读取页面照片。先进行 OCR,再粘贴或输入文字。
通过API自动化
以编程方式使用相同的工具。适用于任何语言——仅需HTTP。
# Scanned pages are detected and OCR'd automatically curl -X POST "https://api.parsejet.com/v1/parse/auto/file?output_format=markdown" \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" # Non-Latin scripts: add a language hint (ko, ru, ar, hi, th, el ...) curl -X POST "https://api.parsejet.com/v1/parse/auto/file?language=ru" \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" # Response metadata tells you which pages were recognized: # "metadata": { "ocr_pages": [1, 2, 3], ... }
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/auto/file",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("scan.pdf", "rb")},
params={"output_format": "markdown"},
timeout=120,
)
data = resp.json()
print(data["text"])
print("OCR'd pages:", data["metadata"].get("ocr_pages", [])) const formData = new FormData();
formData.append("file", pdfFile);
const res = await fetch(
"https://api.parsejet.com/v1/parse/auto/file?output_format=markdown",
{ method: "POST", headers: { Authorization: "Bearer YOUR_API_KEY" }, body: formData },
);
const { text, metadata } = await res.json();
console.log(text);
console.log("OCR'd pages:", metadata.ocr_pages ?? []); 常见问题
如何对 PDF 进行 OCR?
在上方上传 PDF。ParseJet 查看每一页,识别纯图像的页面,并显示完整文字——通常在几秒钟内完成一份典型的信件或表单。复制它,或调用 API 对许多文件执行相同操作。
我怎样知道我的 PDF 是否需要 OCR?
打开它并尝试选中一个单词。如果没有突出显示,或放大后字母看起来像照片一样像素化,那么页面是图像,需要 OCR。来自扫描仪、传真机和手机扫描应用的 PDF 几乎总是这样。
能得到可搜索的 PDF 返回吗?
你得到的是文字,不是新的 PDF 文件。这是你复制、搜索、索引、翻译或输入 AI 模型所需的。如果你特别需要原始 PDF 加上隐形文本层,OCRmyPDF 等桌面工具可以做到。
有页面限制吗?
单次请求最多识别 30 个扫描页面;已包含文字的页面不计入限制。对于更长的扫描件,分割文件或通过 API 分部分发送。响应元数据列出识别的页面和跳过的页面。
支持哪些语言?
英文和所有拉丁文字、简体和繁体中文、日文自动支持。对于韩文、俄文和其他西里尔文字、阿拉伯文、印地文、泰文或希腊文,传递 language=ko、ru、ar、hi、th 或 el(本页面的本地化版本已为你设置)。
这是免费的吗?
是的。无需注册每天免费 3 次,免费账户每月 300 积分,付费计划从 19 美元/月起,支持更大的文件和更高的配额。
相关工具
Image to Text — Free OCR (Optical Character Recognition)
Convert image to text online for free. OCR reads JPG, PNG, WebP and photos in 20+ languages and returns copy-ready text — no signup. API for developers too.
PDF to Text Converter
Convert PDF to text online for free. This PDF text converter handles multi-page files, scanned PDFs (OCR), and complex layouts. No signup — or automate via API.
Extract Text from PDF
Extract text from any PDF in seconds — digital or scanned. Drop the file, copy the text. Free, no signup, nothing to install; developers get the same via API.
PDF to Markdown Converter
Convert PDF to Markdown online for free. Preserves headings, lists, tables, and code blocks. No signup required — try it instantly or automate via API.