OCR API — 이미지를 JSON 텍스트로 변환
한 번의 HTTP 호출로 앱에 광학 문자 인식을 추가합니다. ParseJet OCR API로 JPG, PNG, WebP, 스캔 PDF를 보내면 깔끔한 텍스트와 메타데이터가 JSON으로 돌아옵니다 — Tesseract를 컴파일할 필요도 없고, 모델 파일을 관리할 필요도 없고, GPU도 필요 없습니다. 월 300 요청으로 무료로 시작하세요. 여기서 이미지로 시도해 보세요.
여기에 파일을 끌어다 놓거나 찾아보기
JPG,JPEG,PNG,GIF,WEBP,TIFF,BMP,PDF 파일 지원
무료 — 하루 3회 요청, 가입 불필요. 하면 월 300 크레딧 무료.
작동 방식
무료 API 키 받기
가입하고, 대시보드에서 키를 만들면 월 300 요청을 받습니다. 키가 없으면 빠른 테스트를 위해 하루에 3 요청을 받습니다.
이미지 POST
/v1/parse/image/ocr로 한 번의 멀티파트 요청 — 또는 PDF와 다른 문서도 같은 코드 경로로 보내면 /v1/parse/auto/file.
JSON 사용
응답에 텍스트, 제목, 소스 타입, 이미지 크기, 줄 수, 평균 신뢰도 점수 같은 메타데이터가 있습니다.
주요 기능
이 ocr api가 돋보이는 이유.
한 엔드포인트, 모든 언어
순수 HTTP 멀티파트 업로드: Python, JavaScript, Go, PHP, Ruby, Swift, cron의 curl — 파일을 POST할 수 있는 모든 것.
공식 SDK
pip install parsejet이나 npm install parsejet을 하고 client.parse.ocr()을 호출합니다 — 재시도, 에러, 타입핑이 처리됩니다.
20개 이상 언어
라틴 문자, 중국어, 일본어는 자동으로 읽혀집니다. 한국어, 키릴 문자, 아랍어, 데바나가리, 태국어, 그리스어는 language=ko, ru, ar, hi, th, el을 보냅니다.
스캔 PDF도
/v1/parse/auto/file로 PDF를 보내면 이미지 전용 페이지가 자동으로 OCR됩니다(요청당 최대 30개), 인식된 페이지 번호는 메타데이터에 있습니다.
예측 가능한 JSON
모든 응답이 같은 형태입니다: text, title, source_type, metadata. confidence는 metadata.ocr_confidence에 있으므로 신뢰도가 낮은 결과는 사람에게 보낼 수 있습니다.
직접 호스팅하는 모델, 제3자 AI 없음
인식이 ParseJet 인프라에서 오픈소스 PP-OCR 모델로 실행됩니다. 이미지는 메모리에서 처리되고 유지되지 않습니다 — 큰 클라우드 비전 API로 고객 문서를 보내는 것보다 규정 준수가 더 간단합니다.
사용 사례
이 도구가 시간을 절약해주는 일반적인 시나리오.
영수증 및 송장 캡처
사용자가 올린 사진에서 합계, 날짜, 판매점 이름을 읽고, 자신의 코드에서 검증합니다.
스크린샷 검토 및 검색
사용자가 올린 이미지에서 텍스트를 추출해서 검색하거나 필터링하거나 규칙으로 확인합니다.
RAG 문서 수집
PDF, DOCX와 함께 이미지와 스캔 페이지를 OCR 처리해서 한 API로 청킹과 임베딩 전에 처리합니다.
모바일 앱 백엔드
앱을 작게 유지합니다: 온디바이스 OCR 모델을 넣지 말고 API로 사진을 보냅니다.
서버리스에서 Tesseract 교체
Lambda, Vercel, Cloudflare 함수에 네이티브 바이너리나 언어팩을 번들할 필요가 없습니다 — 그냥 HTTP 호출입니다.
API로 자동화
동일한 도구를 프로그래밍 방식으로 사용하세요. 모든 언어와 호환 — 단순히 HTTP입니다.
# pip install httpx
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/image/ocr",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("receipt.jpg", "rb")},
data={"language": "en"}, # optional hint: ko, ru, ar, hi, th, el ...
timeout=60,
)
resp.raise_for_status()
result = resp.json()
print(result["text"])
if result["metadata"]["ocr_confidence"] < 0.8:
print("low confidence — send for manual review")
# Batch a folder of scans
from pathlib import Path
for img in Path("scans").glob("*.png"):
r = httpx.post(
"https://api.parsejet.com/v1/parse/image/ocr",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": (img.name, img.read_bytes(), "image/png")},
)
print(img.name, r.json()["text"][:80]) // npm install parsejet
import { ParseJet } from "parsejet";
import { readFile } from "node:fs/promises";
const client = new ParseJet({ apiKey: process.env.PARSEJET_API_KEY });
const image = await readFile("receipt.jpg");
const result = await client.parse.ocr(image, "receipt.jpg");
console.log(result.text);
// Or plain fetch, in any runtime:
const form = new FormData();
form.append("file", new Blob([image]), "receipt.jpg");
const res = await fetch("https://api.parsejet.com/v1/parse/image/ocr", {
method: "POST",
headers: { Authorization: `Bearer ${process.env.PARSEJET_API_KEY}` },
body: form,
});
const { text, metadata } = await res.json(); # No API key: 3 requests/day for testing curl -X POST https://api.parsejet.com/v1/parse/image/ocr \ -F "[email protected]" # With a key (300 free requests/month), Korean text curl -X POST https://api.parsejet.com/v1/parse/image/ocr \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" -F "language=ko" # Response # { # "text": "...", # "title": "menu", # "source_type": "image_ocr", # "metadata": { "width": 1280, "height": 960, "ocr_lines": 14, "ocr_confidence": 0.96 } # }
자동화하고 싶으신가요?
ParseJet API는 단일 HTTP 엔드포인트를 통해 동일한 파싱 기능을 제공합니다. ffmpeg, poppler, tesseract 없이 — 단 한 번의 API 호출만으로 가능합니다.
자주 묻는 질문
무료 OCR API가 있나요?
네. 키가 없으면 하루에 3 요청을 만들 수 있고, 테스트에 충분합니다. 무료 계정이면 월 300 크레딧이 있는 API 키를 얻습니다(이미지 1개 = 크레딧 1개). 유료 플랜은 제한과 파일이 더 커서 월 $19부터 시작합니다.
Python에서 OCR API를 어떻게 쓰나요?
이미지를 멀티파트 폼 데이터로 /v1/parse/image/ocr에 POST합니다. Authorization 헤더에 키를 넣습니다 — httpx나 requests로 3줄입니다. 텍스트는 JSON 응답의 "text" 필드에 있습니다. PyPI의 parsejet 패키지는 재시도와 타입이 지정된 결과로 같은 호출을 감싸줍니다.
정확도는 어느 정도인가요?
API는 PP-OCR 인식 모델을 씁니다. 많은 프로덕션 OCR 시스템이 쓰는 같은 계열입니다. 인쇄된 텍스트, 스크린샷, 깨끗한 스캔본은 매우 높은 정확도로 옵니다. 모든 응답에 평균 신뢰도 점수가 있어서 임계값을 정할 수 있습니다. 필기와 흐린 사진은 낮은 점수입니다.
어떤 언어를 지원하나요?
영어, 모든 라틴 문자 언어, 간체/정체 중국어, 일본어는 매개변수 없이 필요합니다. 한국어, 키릴 문자(ru 또는 uk, bg…), 아랍어(ar 또는 fa, ur), 힌디어(hi), 태국어(th), 그리스어(el)는 language=ko, ru, ar, hi, th, el을 보냅니다.
제한은 무엇인가요?
이미지 최대 20MB, 유료 플랜에서 PDF 최대 200MB(키 없으면 2MB, 무료 계정 5MB). 분당 요청은 플랜에 따라 다릅니다. 스캔 PDF는 요청당 최대 30개 이미지 페이지를 인식합니다.
이미지를 저장하나요?
아니요. 파일은 ParseJet 서버에서 메모리로 오픈소스 모델로 처리되고 응답이 보내지면 삭제됩니다. 제3자 AI 제공 업체로 전달되지 않고 학습에 쓰이지 않습니다.
Tesseract와 어떻게 다르나요?
Tesseract는 직접 실행하면 무료이지만 바이너리, 언어팩, 이미지 전처리, 정확도 조정을 소유합니다 — 사진과 CJK 텍스트에 힘깁니다. ParseJet API는 한 번의 HTTP 호출 뒤의 현대식 심층학습 OCR을 주고, 모든 ParseJet 파서와 같은 JSON 형태입니다.
관련 도구
Image to Text — Free OCR (Optical Character Recognition)
Convert image to text online for free. OCR reads JPG, PNG, WebP and photos in 20+ languages and returns copy-ready text — no signup. API for developers too.
PDF OCR — Text Recognition for Scanned PDFs
Free online PDF OCR. Upload a scanned PDF and get its text — pages without a text layer are recognized automatically, in 20+ languages. No signup, API available.
PDF Parser
Parse PDF files to extract text, metadata, and structure. Free online tool and developer API. A modern alternative to pdf-parse and pdfplumber.
Image to Markdown Converter
Convert an image to Markdown online for free. OCR screenshots and photos of documents into structured Markdown text — or automate it via the API.