ParseJet

OCR API — rasmlardagi matnni bitta so'rov bilan oling

Bitta HTTP chaqiriq bilan ilovangizga optik belgi tanib olishni qo'shing. JPG, PNG, WebP yoki skanerlangan PDF'ni ParseJet OCR API'ga yuboring va JSON sifatida toza matn va metama'lumotni oling — Tesseract kompayl qilish talab emas, model fayllari yoki GPU. Oyiga 300 so'rov bilan bepul boshlang; rasmda sinab ko'ring.

Faylni bu erga tashlang yoki ko‘rib chiqing

JPG,JPEG,PNG,GIF,WEBP,TIFF,BMP,PDF fayllarni qabul qiladi

Bepul — kuniga 3 so‘rov, ro‘yxatdan o‘tish shart emas. oyiga 300 kredit bepul olish uchun.

Qanday ishlaydi

1

Bepul API kalit oling

Ro'yxatdan o'ting, boshqaruv panelida kalit yarating va oyiga 300 so'rovga ega bo'lasiz. Tez test uchun kalitsiz kuniga 3 ta so'rovga ega bo'lasiz.

2

Rasmni POST qiling

/v1/parse/image/ocr manziliga bitta multipart so'rov — yoki PDF va boshqa hujjatlarni ham bir kod yo'li bilan yuborganingiz bo'lsa /v1/parse/auto/file.

3

JSON-dan foydalaning

Javobda matn, sarlavha, manba turi va rasm o'lchami, qator soni va o'rtacha ishonchlik balli kabi metama'lumot mavjud.

Asosiy xususiyatlar

Bu ocr api ni nima ajralib turadigan qiladi.

Bitta endpoint, har qanday tilla

Sodda HTTP multipart bilan: Python, JavaScript, Go, PHP, Ruby, Swift, curl cron ishida — POST qila oladigan har qanday narsa.

Rasmiy SDK

pip install parsejet yoki npm install parsejet va client.parse.ocr() chaqiring — qayta urinish, xatolar va yozish siz boshqariladi.

20+ tilla

Lotin yozuvi, xitoycha va yaponcha avtomatik o'qiladi; koreyscha, ruscha, arab, xindi, tailand yoki grek uchun language=ko, ru, ar, hi, th, el yuboring.

Skanerlangan PDF'lar ham

PDF'ni /v1/parse/auto/file'ga yuboring va faqat rasmli sahifalar avtomatik OCR qilinadi (bitta so'rovda 30 gacha), tanib olingan sahifalar metama'lumotda.

Taxmin qiluvchan JSON

Har bir javob bir xil shaklda: matn, sarlavha, source_type, metama'lumot. Ishonchlik metama'lumot.ocr_confidence'da, past ishonchlik natijalarini shaxsga yo'naltirishingiz mumkin.

O'z-o'zini xost qilgan modellar, uchinchi tomon AI emas

Tanib olish ParseJet infrastukturasida ochiq manbali PP-OCR modellari bilan ishga tushadi. Rasmlar xotirada qayta ishlanadi va saqlanmaydi — katta bulut ko'rish API'ga mijoz hujjatlarini yuborgandan ko'ra sodda moslik.

Foydalanish holatlari

Ushbu vositangiz vaqtni tejaydigan umumiy holatlar.

Kvitansiya va hisob-faktura ushlash

Foydalanuvchilarga o'z kodingizda yuklangan fotolardagi summalar, sanalar va sotuvchi nomlarini o'qing va tekshiring.

Skrinshotni oniy tekshirish va qidirish

Foydalanuvchi yuklagan rasmlardagi matnni ajratib, qidirish, filtrlash yoki qoidalar bilan tekshirish uchun.

RAG uchun hujjat qabul qilish

Skanerlangan sahifalar va rasmlarni PDF va DOCX bilan bitta API orqali OCR qiling, keyin chunklash va joylashtirishdan oldin.

Mobil ilovalar orqasi

Ilovani kichik saqlang: fotosni qurilmada OCR modeli o'rnatmasdan API'ga yuboring.

Serverless'da Tesseract almashtirish

Lambda, Vercel yoki Cloudflare funksiyalariga mahalliy binar fayllar yoki tilla paketlarini paketlab qo'ymasdan — faqat HTTP chaqiriq.

API bilan avtomatlashtiring

Xuddi shu vositaning dasturiy ta'minotidan foydalaning. Har qanday til bilan ishlaydi — faqat HTTP.

Python
# pip install httpx
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/image/ocr",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("receipt.jpg", "rb")},
    data={"language": "en"},     # optional hint: ko, ru, ar, hi, th, el ...
    timeout=60,
)
resp.raise_for_status()
result = resp.json()
print(result["text"])
if result["metadata"]["ocr_confidence"] < 0.8:
    print("low confidence — send for manual review")

# Batch a folder of scans
from pathlib import Path
for img in Path("scans").glob("*.png"):
    r = httpx.post(
        "https://api.parsejet.com/v1/parse/image/ocr",
        headers={"Authorization": "Bearer YOUR_API_KEY"},
        files={"file": (img.name, img.read_bytes(), "image/png")},
    )
    print(img.name, r.json()["text"][:80])
JavaScript / Node
// npm install parsejet
import { ParseJet } from "parsejet";
import { readFile } from "node:fs/promises";

const client = new ParseJet({ apiKey: process.env.PARSEJET_API_KEY });
const image = await readFile("receipt.jpg");
const result = await client.parse.ocr(image, "receipt.jpg");
console.log(result.text);

// Or plain fetch, in any runtime:
const form = new FormData();
form.append("file", new Blob([image]), "receipt.jpg");
const res = await fetch("https://api.parsejet.com/v1/parse/image/ocr", {
  method: "POST",
  headers: { Authorization: `Bearer ${process.env.PARSEJET_API_KEY}` },
  body: form,
});
const { text, metadata } = await res.json();
cURL
# No API key: 3 requests/day for testing
curl -X POST https://api.parsejet.com/v1/parse/image/ocr \
  -F "[email protected]"

# With a key (300 free requests/month), Korean text
curl -X POST https://api.parsejet.com/v1/parse/image/ocr \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "language=ko"

# Response
# {
#   "text": "...",
#   "title": "menu",
#   "source_type": "image_ocr",
#   "metadata": { "width": 1280, "height": 960, "ocr_lines": 14, "ocr_confidence": 0.96 }
# }

Buni avtomatlashtirmoqchimisiz?

ParseJet API sizga bitta HTTP endpoint orqali bir xil tahlil qilish quvvatini beradi. Ffmpeg yo'q, poppler yo'q, tesseract yo'q — faqat bitta API chaqiruvi.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
API Hujjatlarini O'qing

Tez-tez so'raladigan savollar

Bepul OCR API bormi?

Ha. Kalitsiz kuniga 3 ta so'rovga ega bo'lasiz, bu test uchun yetarli. Bepul hisob oyiga 300 kredit bilan API kalit beradi (bitta rasm = bitta kredit). Pullik rejalar yuqori cheklovlar va kattaroq fayllar uchun oyiga $19 dan.

OCR API'ni Python'da qanday ishlataman?

Rasmni /v1/parse/image/ocr manziliga multipart form ma'lumoti sifatida POST qiling, otorlashish sarlavhasiga kalit bilan — httpx yoki requests'da uchta qator, yuqorida ko'rsatilgan. Matn JSON javobining "text" sohasida. PyPI'dagi parsejet paketi bir xil chaqiriqni qayta urinish va yozilgan natijalar bilan o'rab beradi.

Qanchalik aniq?

API PP-OCR tanib olish modellari ishlatadi, ko'p ishlab chiqarish OCR tizimlari oilasini kuchaytiradigan. Bosma matn, skrinshotlar va toza skanlar yuqori aniqlik bilan qaytadi; har bir javobda o'rtacha ishonchlik balli mavjud, uni chegaralashingiz mumkin. Qo'lda yozilgan matn va xiralashgan fotolar pastroq ball beradi.

Qaysi tilllar qo'llab-quvvatlanadi?

Inglizcha va lotin yozuvli barcos, soddalashtirilgan va an'anaviy xitoycha, yaponcha parametr talab qilmaydi. Koreyscha, kirill (ru yoki uk, bg...), arab (yoki fa, ur), xindi, tailand yoki grek uchun language=ko, ru, ar, hi, th, el yuboring.

Cheklovlar qanday?

Rasmlar 20 MB gacha, pullik rejalar uchun PDF 200 MB gacha (kalitsiz 2 MB, bepul hisob 5 MB). Minutiga so'rovlar rejaga bog'liq. Skanerlangan PDF bitta so'rovda 30 gacha rasm sahifasini tanib oladi.

Mening rasmlarimni saqlanganmi?

Yo'q. Fayllar ParseJet serverlarida xotirada qayta ishlanadi, ochiq manbali modellar bilan va javob yuborilganda o'chiriladi. Ular uchinchi tomon AI provayderi tomoniga jo'natilmaydi va o'qitish uchun ishlatilmaydi.

Bu Tesseract'dan qanday farq qiladi?

Tesseract o'zingiz ishga tushirish uchun bepul, lekin siz binary fayllar, tilla paketlari, rasm qayta ishlash va aniqlik sozlashni boshqarasiz — va u fotolar va CJK matn bilan kurashadi. ParseJet API bitta HTTP chaqiriq orqasi zamonaviy chuqur o'rganish OCR beradi, har bir boshqa ParseJet parser kabi JSON shaklida.

Matnni bepul ajratishni boshlang

Ro'yxatdan o'tish talab etilmaydi. Birinchi faylingizni soniyalar ichida tahlil qiling.

Narxlarni Ko'rish