ParseJet

OCR API — Tek İstekle Görsellerden Metin Çıkarma

Uygulamanıza optik karakter tanıma ekleyin bir HTTP çağrısıyla. ParseJet OCR API'sine bir JPG, PNG, WebP veya taranmış PDF gönderin ve temiz metin ve meta verinin JSON'ını geri alın — Tesseract'ı derlemek, model dosyalarını yönetmek veya GPU yok. Ayda 300 istekle başlamak için ücretsiz; sağdaki bir görüntüde deneyin.

Bir dosyayı buraya bırakın veya göz atın

JPG,JPEG,PNG,GIF,WEBP,TIFF,BMP,PDF dosyalarını kabul eder

Ücretsiz — günde 3 istek, kayıt gerekmez. ayda 300 kredi ücretsiz için.

Nasıl çalışır

1

Ücretsiz API anahtarı alın

Kaydolun, panoda bir anahtar oluşturun ve ayda 300 istek alırsınız. Hızlı test için hiç anahtarsız günde 3 istek alırsınız.

2

Görsel POST edin

/v1/parse/image/ocr için bir çok parçalı istek — veya PDF'leri ve diğer belgeleri aynı kod yolundan da gönderirseniz /v1/parse/auto/file.

3

JSON'ı kullanın

Yanıt metni, başlığı, kaynak türünü ve görüntü boyutu, satır sayısı ve ortalama güven puanı gibi meta veriler içerir.

Temel özellikler

Bu ocr api aracını öne çıkaran özellikler.

Bir uç nokta, herhangi bir dil

Düz HTTP çok parçalı yükleme ile: Python, JavaScript, Go, PHP, Ruby, Swift, cron işinde curl — dosya POST'u yapabilen her şey.

Resmi SDK'lar

pip install parsejet veya npm install parsejet ve client.parse.ocr() çağırın — yeniden denemeler, hatalar ve yazma sizin için işlenir.

20+ dil

Latin komut dosyaları, Çince ve Japonca otomatik olarak okunur; Korece, Kiril, Arapça, Devanagari, Tayca veya Yunanca için language=ko, ru, ar, hi, th veya el gönderin.

Taranmış PDF'ler de

/v1/parse/auto/file'a bir PDF gönderin ve sadece görüntü sayfaları otomatik olarak OCR'lenir (istek başına 30'a kadar), tanınan sayfa numaraları meta verilerde.

Tahmin edilebilir JSON

Her yanıt aynı şekildedir: metin, başlık, kaynak_türü, meta veri. Güven meta veriler içindedir.ocr_confidence yani düşük güven sonuçlarını bir insana yönlendirebilirsiniz.

Kendi kendine barındırılan modeller, üçüncü taraf AI yok

Tanıma, ParseJet altyapısında açık kaynak PP-OCR modelleriyle çalışır. Görüntüler bellekte işlenir ve korunmaz — büyük bulut vizyon API'sine müşteri belgelerini göndermeye göre daha basit uyum.

Kullanım senaryoları

Bu aracın size zaman kazandırdığı yaygın senaryolar.

Makbuz ve fatura yakalama

Kullanıcılar tarafından yüklenen fotoğraflardan toplamları, tarihleri ve satıcı adlarını okuyun, ardından kendi kodunuzda doğrulayın.

Ekran görüntüsü ılımlılığı ve arama

Kullanıcı tarafından gönderilen görsellerden metni çıkarın, böylece aranabilir, filtrelenebilir veya kurallara karşı kontrol edilebilir.

RAG için belge yutma

PDF'ler ve DOCX'ler yanında taranmış sayfaları ve görüntüleri, parçalamadan ve yerleştirmeden önce bir API aracılığıyla OCR yapın.

Mobil uygulama arka uçları

Uygulamayı küçük tutun: fotoğrafı, cihazda bir OCR modeli göndermek yerine API'ye gönderin.

Sunucusuz Tesseract'ı değiştirme

Lambda, Vercel veya Cloudflare işlevlerine paket haline getirilecek yerel ikili dosya veya dil paketi yok — sadece bir HTTP çağrısı.

API ile otomatikleştirin

Aynı aracı programatik olarak kullanın. Herhangi bir dil ile çalışır — sadece HTTP.

Python
# pip install httpx
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/image/ocr",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("receipt.jpg", "rb")},
    data={"language": "en"},     # optional hint: ko, ru, ar, hi, th, el ...
    timeout=60,
)
resp.raise_for_status()
result = resp.json()
print(result["text"])
if result["metadata"]["ocr_confidence"] < 0.8:
    print("low confidence — send for manual review")

# Batch a folder of scans
from pathlib import Path
for img in Path("scans").glob("*.png"):
    r = httpx.post(
        "https://api.parsejet.com/v1/parse/image/ocr",
        headers={"Authorization": "Bearer YOUR_API_KEY"},
        files={"file": (img.name, img.read_bytes(), "image/png")},
    )
    print(img.name, r.json()["text"][:80])
JavaScript / Node
// npm install parsejet
import { ParseJet } from "parsejet";
import { readFile } from "node:fs/promises";

const client = new ParseJet({ apiKey: process.env.PARSEJET_API_KEY });
const image = await readFile("receipt.jpg");
const result = await client.parse.ocr(image, "receipt.jpg");
console.log(result.text);

// Or plain fetch, in any runtime:
const form = new FormData();
form.append("file", new Blob([image]), "receipt.jpg");
const res = await fetch("https://api.parsejet.com/v1/parse/image/ocr", {
  method: "POST",
  headers: { Authorization: `Bearer ${process.env.PARSEJET_API_KEY}` },
  body: form,
});
const { text, metadata } = await res.json();
cURL
# No API key: 3 requests/day for testing
curl -X POST https://api.parsejet.com/v1/parse/image/ocr \
  -F "[email protected]"

# With a key (300 free requests/month), Korean text
curl -X POST https://api.parsejet.com/v1/parse/image/ocr \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" -F "language=ko"

# Response
# {
#   "text": "...",
#   "title": "menu",
#   "source_type": "image_ocr",
#   "metadata": { "width": 1280, "height": 960, "ocr_lines": 14, "ocr_confidence": 0.96 }
# }

Bunu otomatikleştirmek mi istiyorsunuz?

ParseJet API, aynı ayrıştırma gücünü tek bir HTTP endpoint'i ile sunar. ffmpeg yok, poppler yok, tesseract yok — sadece bir API çağrısı.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
API Dokümanlarını Okuyun

Sıkça sorulan sorular

Ücretsiz bir OCR API var mı?

Evet. Herhangi bir anahtar olmadan günde 3 istek yapabilirsiniz, bu testi yapmak için yeterlidir. Ücretsiz hesap, ayda 300 kredi (bir görüntü = bir kredi) ile bir API anahtarı verir. Ücretli planlar daha yüksek sınırlar ve daha büyük dosyalar için 19$/aydan başlar.

OCR API'sini Python'da nasıl kullanırım?

Görüntüyü Yetkilendirme başlığında anahtarınızla /v1/parse/image/ocr'a çok parçalı form verisi olarak POST edin — httpx veya isteklerle üç satır, yukarıda gösterilmiştir. Metin, JSON yanıtının "metin" alanındadır. PyPI'deki parsejet paketi aynı çağrıyı yeniden denemeler ve yazılan sonuçlarla sarmalanır.

Ne kadar doğru?

API, pek çok üretim OCR sistemini güçlendiren PP-OCR tanıma modellerini kullanır. Yazılı metin, ekran görüntüleri ve temiz taramalar çok yüksek doğrulukla geri döner; her yanıt eşik yapabileceğiniz ortalama bir güven puanı taşır. El yazısı ve bulanık fotoğraflar daha düşük puanlanır.

Hangi diller desteklenir?

İngilizce ve tüm Latin yazı dili, Basitleştirilmiş ve Geleneksel Çince ve Japonca parametre gerekmez. Korece, Kiril, Arapça, Devanagari, Tayca veya Yunanca için language=ko, ru (veya uk, bg…), ar (veya fa, ur), hi, th veya el gönderin.

Sınırlar nelerdir?

20 MB'a kadar görüntüler, ücretli planlarda 200 MB'a kadar PDF'ler (anahtar olmadan 2 MB, ücretsiz hesapla 5 MB). İstek başına sınırlar plana bağlıdır. Taranmış bir PDF, istek başına 30'a kadar görüntü sayfasını tanır.

Görsellerimi saklar mısınız?

Hayır. Dosyalar, ParseJet sunucularında açık kaynak modelleri kullanarak bellekte işlenir ve yanıt gönderildiğinde atılır. Bunlar hiçbir üçüncü taraf AI sağlayıcısına iletilmez ve eğitim için kullanılmaz.

Bu, Tesseract'tan nasıl farklı?

Tesseract kendiniz çalıştırmak için ücretsizdir ancak ikili dosyaları, dil paketlerini, görüntü ön işlemesini ve doğruluk ayarlamasını yönetirsiniz — ve fotoğraf ve CJK metniyle mücadele eder. ParseJet API, bir HTTP çağrısının arkasında modern derin öğrenme OCR'ı verir, her diğer ParseJet ayrıştırıcısıyla aynı JSON şekli ile.

Ücretsiz metin çıkarmaya başlayın

Kayıt gerekmez. İlk dosyanızı saniyeler içinde ayrıştırın.