OCR API — rasmlardagi matnni bitta so'rov bilan oling
Bitta HTTP chaqiriq bilan ilovangizga optik belgi tanib olishni qo'shing. JPG, PNG, WebP yoki skanerlangan PDF'ni ParseJet OCR API'ga yuboring va JSON sifatida toza matn va metama'lumotni oling — Tesseract kompayl qilish talab emas, model fayllari yoki GPU. Oyiga 300 so'rov bilan bepul boshlang; rasmda sinab ko'ring.
Faylni bu erga tashlang yoki ko‘rib chiqing
JPG,JPEG,PNG,GIF,WEBP,TIFF,BMP,PDF fayllarni qabul qiladi
Bepul — kuniga 3 so‘rov, ro‘yxatdan o‘tish shart emas. oyiga 300 kredit bepul olish uchun.
Qanday ishlaydi
Bepul API kalit oling
Ro'yxatdan o'ting, boshqaruv panelida kalit yarating va oyiga 300 so'rovga ega bo'lasiz. Tez test uchun kalitsiz kuniga 3 ta so'rovga ega bo'lasiz.
Rasmni POST qiling
/v1/parse/image/ocr manziliga bitta multipart so'rov — yoki PDF va boshqa hujjatlarni ham bir kod yo'li bilan yuborganingiz bo'lsa /v1/parse/auto/file.
JSON-dan foydalaning
Javobda matn, sarlavha, manba turi va rasm o'lchami, qator soni va o'rtacha ishonchlik balli kabi metama'lumot mavjud.
Asosiy xususiyatlar
Bu ocr api ni nima ajralib turadigan qiladi.
Bitta endpoint, har qanday tilla
Sodda HTTP multipart bilan: Python, JavaScript, Go, PHP, Ruby, Swift, curl cron ishida — POST qila oladigan har qanday narsa.
Rasmiy SDK
pip install parsejet yoki npm install parsejet va client.parse.ocr() chaqiring — qayta urinish, xatolar va yozish siz boshqariladi.
20+ tilla
Lotin yozuvi, xitoycha va yaponcha avtomatik o'qiladi; koreyscha, ruscha, arab, xindi, tailand yoki grek uchun language=ko, ru, ar, hi, th, el yuboring.
Skanerlangan PDF'lar ham
PDF'ni /v1/parse/auto/file'ga yuboring va faqat rasmli sahifalar avtomatik OCR qilinadi (bitta so'rovda 30 gacha), tanib olingan sahifalar metama'lumotda.
Taxmin qiluvchan JSON
Har bir javob bir xil shaklda: matn, sarlavha, source_type, metama'lumot. Ishonchlik metama'lumot.ocr_confidence'da, past ishonchlik natijalarini shaxsga yo'naltirishingiz mumkin.
O'z-o'zini xost qilgan modellar, uchinchi tomon AI emas
Tanib olish ParseJet infrastukturasida ochiq manbali PP-OCR modellari bilan ishga tushadi. Rasmlar xotirada qayta ishlanadi va saqlanmaydi — katta bulut ko'rish API'ga mijoz hujjatlarini yuborgandan ko'ra sodda moslik.
Foydalanish holatlari
Ushbu vositangiz vaqtni tejaydigan umumiy holatlar.
Kvitansiya va hisob-faktura ushlash
Foydalanuvchilarga o'z kodingizda yuklangan fotolardagi summalar, sanalar va sotuvchi nomlarini o'qing va tekshiring.
Skrinshotni oniy tekshirish va qidirish
Foydalanuvchi yuklagan rasmlardagi matnni ajratib, qidirish, filtrlash yoki qoidalar bilan tekshirish uchun.
RAG uchun hujjat qabul qilish
Skanerlangan sahifalar va rasmlarni PDF va DOCX bilan bitta API orqali OCR qiling, keyin chunklash va joylashtirishdan oldin.
Mobil ilovalar orqasi
Ilovani kichik saqlang: fotosni qurilmada OCR modeli o'rnatmasdan API'ga yuboring.
Serverless'da Tesseract almashtirish
Lambda, Vercel yoki Cloudflare funksiyalariga mahalliy binar fayllar yoki tilla paketlarini paketlab qo'ymasdan — faqat HTTP chaqiriq.
API bilan avtomatlashtiring
Xuddi shu vositaning dasturiy ta'minotidan foydalaning. Har qanday til bilan ishlaydi — faqat HTTP.
# pip install httpx
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/image/ocr",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("receipt.jpg", "rb")},
data={"language": "en"}, # optional hint: ko, ru, ar, hi, th, el ...
timeout=60,
)
resp.raise_for_status()
result = resp.json()
print(result["text"])
if result["metadata"]["ocr_confidence"] < 0.8:
print("low confidence — send for manual review")
# Batch a folder of scans
from pathlib import Path
for img in Path("scans").glob("*.png"):
r = httpx.post(
"https://api.parsejet.com/v1/parse/image/ocr",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": (img.name, img.read_bytes(), "image/png")},
)
print(img.name, r.json()["text"][:80]) // npm install parsejet
import { ParseJet } from "parsejet";
import { readFile } from "node:fs/promises";
const client = new ParseJet({ apiKey: process.env.PARSEJET_API_KEY });
const image = await readFile("receipt.jpg");
const result = await client.parse.ocr(image, "receipt.jpg");
console.log(result.text);
// Or plain fetch, in any runtime:
const form = new FormData();
form.append("file", new Blob([image]), "receipt.jpg");
const res = await fetch("https://api.parsejet.com/v1/parse/image/ocr", {
method: "POST",
headers: { Authorization: `Bearer ${process.env.PARSEJET_API_KEY}` },
body: form,
});
const { text, metadata } = await res.json(); # No API key: 3 requests/day for testing curl -X POST https://api.parsejet.com/v1/parse/image/ocr \ -F "[email protected]" # With a key (300 free requests/month), Korean text curl -X POST https://api.parsejet.com/v1/parse/image/ocr \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" -F "language=ko" # Response # { # "text": "...", # "title": "menu", # "source_type": "image_ocr", # "metadata": { "width": 1280, "height": 960, "ocr_lines": 14, "ocr_confidence": 0.96 } # }
Buni avtomatlashtirmoqchimisiz?
ParseJet API sizga bitta HTTP endpoint orqali bir xil tahlil qilish quvvatini beradi. Ffmpeg yo'q, poppler yo'q, tesseract yo'q — faqat bitta API chaqiruvi.
Tez-tez so'raladigan savollar
Bepul OCR API bormi?
Ha. Kalitsiz kuniga 3 ta so'rovga ega bo'lasiz, bu test uchun yetarli. Bepul hisob oyiga 300 kredit bilan API kalit beradi (bitta rasm = bitta kredit). Pullik rejalar yuqori cheklovlar va kattaroq fayllar uchun oyiga $19 dan.
OCR API'ni Python'da qanday ishlataman?
Rasmni /v1/parse/image/ocr manziliga multipart form ma'lumoti sifatida POST qiling, otorlashish sarlavhasiga kalit bilan — httpx yoki requests'da uchta qator, yuqorida ko'rsatilgan. Matn JSON javobining "text" sohasida. PyPI'dagi parsejet paketi bir xil chaqiriqni qayta urinish va yozilgan natijalar bilan o'rab beradi.
Qanchalik aniq?
API PP-OCR tanib olish modellari ishlatadi, ko'p ishlab chiqarish OCR tizimlari oilasini kuchaytiradigan. Bosma matn, skrinshotlar va toza skanlar yuqori aniqlik bilan qaytadi; har bir javobda o'rtacha ishonchlik balli mavjud, uni chegaralashingiz mumkin. Qo'lda yozilgan matn va xiralashgan fotolar pastroq ball beradi.
Qaysi tilllar qo'llab-quvvatlanadi?
Inglizcha va lotin yozuvli barcos, soddalashtirilgan va an'anaviy xitoycha, yaponcha parametr talab qilmaydi. Koreyscha, kirill (ru yoki uk, bg...), arab (yoki fa, ur), xindi, tailand yoki grek uchun language=ko, ru, ar, hi, th, el yuboring.
Cheklovlar qanday?
Rasmlar 20 MB gacha, pullik rejalar uchun PDF 200 MB gacha (kalitsiz 2 MB, bepul hisob 5 MB). Minutiga so'rovlar rejaga bog'liq. Skanerlangan PDF bitta so'rovda 30 gacha rasm sahifasini tanib oladi.
Mening rasmlarimni saqlanganmi?
Yo'q. Fayllar ParseJet serverlarida xotirada qayta ishlanadi, ochiq manbali modellar bilan va javob yuborilganda o'chiriladi. Ular uchinchi tomon AI provayderi tomoniga jo'natilmaydi va o'qitish uchun ishlatilmaydi.
Bu Tesseract'dan qanday farq qiladi?
Tesseract o'zingiz ishga tushirish uchun bepul, lekin siz binary fayllar, tilla paketlari, rasm qayta ishlash va aniqlik sozlashni boshqarasiz — va u fotolar va CJK matn bilan kurashadi. ParseJet API bitta HTTP chaqiriq orqasi zamonaviy chuqur o'rganish OCR beradi, har bir boshqa ParseJet parser kabi JSON shaklida.
Bog'liq vositalar
Image to Text — Free OCR (Optical Character Recognition)
Convert image to text online for free. OCR reads JPG, PNG, WebP and photos in 20+ languages and returns copy-ready text — no signup. API for developers too.
PDF OCR — Text Recognition for Scanned PDFs
Free online PDF OCR. Upload a scanned PDF and get its text — pages without a text layer are recognized automatically, in 20+ languages. No signup, API available.
PDF Parser
Parse PDF files to extract text, metadata, and structure. Free online tool and developer API. A modern alternative to pdf-parse and pdfplumber.
Image to Markdown Converter
Convert an image to Markdown online for free. OCR screenshots and photos of documents into structured Markdown text — or automate it via the API.
Matnni bepul ajratishni boshlang
Ro'yxatdan o'tish talab etilmaydi. Birinchi faylingizni soniyalar ichida tahlil qiling.