OCR API — استخراج النص من الصور بطلب واحد
أضف استخراج النص من الصور إلى تطبيقك مع استدعاء HTTP واحد. أرسل JPG أو PNG أو WebP أو ملف PDF ممسوح إلى API OCR من ParseJet واحصل على نص نظيف + بيانات وصفية مرة أخرى كـ JSON — بدون Tesseract للتجميع أو ملفات نموذج لإدارة أو GPU. مجاني للبدء مع 300 طلب شهريًا؛ جربه على صورة هنا.
أسقط ملفًا هنا أو تصفح
يقبل ملفات JPG,JPEG,PNG,GIF,WEBP,TIFF,BMP,PDF
مجاني — 3 طلبات/يوم، بدون تسجيل. للحصول على 300 رصيد/شهر مجانًا.
كيف يعمل
احصل على مفتاح API مجاني
انشئ حسابًا، أنشئ مفتاحًا في لوحة التحكم، وتحصل على 300 طلب شهريًا. بدون مفتاح على الإطلاق تحصل على 3 طلبات يوميًا لاختبار سريع.
أرسل الصورة
طلب multipart واحد إلى /v1/parse/image/ocr — أو /v1/parse/auto/file إذا أرسلت أيضًا ملفات PDF وملفات أخرى من خلال نفس مسار الكود.
استخدم JSON
الاستجابة تحتوي النص والعنوان والنوع المصدر والبيانات الوصفية مثل حجم الصورة وعدد الأسطر ودرجة ثقة متوسطة.
الميزات الرئيسية
ما الذي يجعل ocr api هذا مميزًا.
نقطة نهاية واحدة، أي لغة
HTTP عادي مع تحميل multipart: Python وJavaScript وGo وPHP وRuby وSwift و curl في cron job — أي شيء يمكنه POST ملف.
SDKs رسمية
pip install parsejet أو npm install parsejet واستدعِ client.parse.ocr() — المحاولات والأخطاء والكتابة معالجة لك.
20+ لغة
النصوص اللاتينية والصينية واليابانية تُقرأ تلقائيًا؛ اطلب language=ko أو ru أو ar أو hi أو th أو el للكورية والسيريلية والعربية والديواناغارية والتايلاندية أو اليونانية.
ملفات PDF الممسوحة أيضًا
أرسل ملف PDF إلى /v1/parse/auto/file والصفحات التي هي صور فقط تُشغّل OCR تلقائيًا (حتى 30 في الطلب)، مع أرقام الصفحات المعترف بها في البيانات الوصفية.
JSON يمكن التنبؤ به
كل استجابة لها نفس الشكل: نص وعنوان ونوع مصدر وبيانات وصفية. الثقة موجودة في metadata.ocr_confidence لذا يمكنك توجيه النتائج منخفضة الثقة إلى إنسان.
النماذج الذاتية المستضافة، بدون ذكاء اصطناعي من طرف ثالث
يعمل الاعتراف على بنية ParseJet مع نماذج PP-OCR مفتوحة المصدر. تُعالج الصور في الذاكرة ولا تُحفظ — امتثال أبسط من إرسال مستندات العملاء لـ API رؤية بسحابة كبيرة.
حالات الاستخدام
سيناريوهات شائعة حيث يوفر لك هذا الأداة الوقت.
التقاط الإيصالات والفواتير
اقرأ الإجماليات والتواريخ وأسماء البائعين من صور حمّلها المستخدمون، ثم تحقق منها في كودك الخاص.
اعتدال الصور والبحث
استخرج النص من الصور المرسلة من قبل المستخدمين حتى يمكن البحث عنها وتصفيتها أو التحقق من القواعد.
استخراج المستندات لـ RAG
استخرج صفحات ممسوحة والصور جنبًا إلى جنب مع ملفات PDF و DOCX عبر API واحدة قبل التقطيع والتضمين.
خلفيات تطبيق الجوال
أبقِ التطبيق صغيرًا: أرسل الصورة إلى API بدلاً من شحن نموذج OCR على الجهاز.
استبدال Tesseract في serverless
بدون ملفات ثنائية أصلية أو حزم لغة لتجميعها في Lambda أو Vercel أو وظائف Cloudflare — فقط استدعاء HTTP.
أتمتة باستخدام الـ API
استخدم نفس الأداة برمجيًا. يعمل مع أي لغة — مجرد HTTP.
# pip install httpx
import httpx
resp = httpx.post(
"https://api.parsejet.com/v1/parse/image/ocr",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": open("receipt.jpg", "rb")},
data={"language": "en"}, # optional hint: ko, ru, ar, hi, th, el ...
timeout=60,
)
resp.raise_for_status()
result = resp.json()
print(result["text"])
if result["metadata"]["ocr_confidence"] < 0.8:
print("low confidence — send for manual review")
# Batch a folder of scans
from pathlib import Path
for img in Path("scans").glob("*.png"):
r = httpx.post(
"https://api.parsejet.com/v1/parse/image/ocr",
headers={"Authorization": "Bearer YOUR_API_KEY"},
files={"file": (img.name, img.read_bytes(), "image/png")},
)
print(img.name, r.json()["text"][:80]) // npm install parsejet
import { ParseJet } from "parsejet";
import { readFile } from "node:fs/promises";
const client = new ParseJet({ apiKey: process.env.PARSEJET_API_KEY });
const image = await readFile("receipt.jpg");
const result = await client.parse.ocr(image, "receipt.jpg");
console.log(result.text);
// Or plain fetch, in any runtime:
const form = new FormData();
form.append("file", new Blob([image]), "receipt.jpg");
const res = await fetch("https://api.parsejet.com/v1/parse/image/ocr", {
method: "POST",
headers: { Authorization: `Bearer ${process.env.PARSEJET_API_KEY}` },
body: form,
});
const { text, metadata } = await res.json(); # No API key: 3 requests/day for testing curl -X POST https://api.parsejet.com/v1/parse/image/ocr \ -F "[email protected]" # With a key (300 free requests/month), Korean text curl -X POST https://api.parsejet.com/v1/parse/image/ocr \ -H "Authorization: Bearer YOUR_API_KEY" \ -F "[email protected]" -F "language=ko" # Response # { # "text": "...", # "title": "menu", # "source_type": "image_ocr", # "metadata": { "width": 1280, "height": 960, "ocr_lines": 14, "ocr_confidence": 0.96 } # }
هل تريد أتمتة هذا؟
ParseJet API تمنحك نفس قوة التحليل عبر نقطة نهاية HTTP واحدة. لا ffmpeg، لا poppler، لا tesseract — مجرد استدعاء API واحد.
الأسئلة الشائعة
هل هناك API OCR مجانية؟
نعم. بدون مفتاح يمكنك عمل 3 طلبات يوميًا، كافيًا للاختبار. حساب مجاني يعطيك مفتاح API مع 300 رصيد شهريًا (صورة واحدة = رصيد واحد). الخطط المدفوعة تبدأ من 19 دولار شهريًا لحدود أعلى وملفات أكبر.
كيف أستخدم API OCR في Python؟
أرسل الصورة كبيانات نموذج multipart إلى /v1/parse/image/ocr مع مفتاحك في رؤوس التفويض — ثلاثة أسطر مع httpx أو requests، موضحة أعلاه. النص موجود في حقل "text" من استجابة JSON. حزمة parsejet على PyPI تلف نفس الاستدعاء مع المحاولات والنتائج المكتوبة.
ما مدى دقتها؟
تستخدم API نماذج استخراج PP-OCR، نفس الأسرة التي تعمل أنظمة OCR الإنتاج الكثيرة. النص المطبوع ولقطات الشاشة والمسوحات النظيفة تعود بدقة عالية جدًا؛ كل استجابة تحمل درجة ثقة متوسطة يمكنك تحديدها. الكتابة اليدوية والصور الضبابية تسجل أقل.
أي اللغات مدعومة؟
الإنجليزية وجميع اللغات اللاتينية والصينية المبسطة والتقليدية واليابانية لا تحتاج معامل. أرسل language=ko أو ru (أو uk أو bg…) أو ar (أو fa أو ur) أو hi أو th أو el للكورية والسيريلية والعربية والديواناغارية والتايلاندية أو اليونانية.
ما الحدود؟
صور حتى 20 ميجابايت وملفات PDF حتى 200 ميجابايت على الخطط المدفوعة (2 ميجابايت بدون مفتاح و5 ميجابايت على الحساب المجاني). الطلبات في الدقيقة تعتمد على الخطة. ملف PDF ممسوح يعترف حتى 30 صفحة صورة في الطلب الواحد.
هل تخزنون صوري؟
لا. تُعالج الملفات في الذاكرة على خوادم ParseJet مع نماذج مفتوحة المصدر وتُحذف عند إرسال الاستجابة. لا تُرسل إلى أي مزود ذكاء اصطناعي من طرف ثالث ولا تُستخدم للتدريب.
كيف يختلف عن Tesseract؟
Tesseract مجانية للتشغيل بنفسك لكنك تملك الملفات الثنائية وحزم اللغة والمعالجة المسبقة وضبط الدقة — وتكافح مع الصور و CJK. API ParseJet تعطيك OCR تعلم عميق حديث خلف استدعاء HTTP واحد، مع نفس شكل JSON كمحلل ParseJet الآخر.
أدوات ذات صلة
Image to Text — Free OCR (Optical Character Recognition)
Convert image to text online for free. OCR reads JPG, PNG, WebP and photos in 20+ languages and returns copy-ready text — no signup. API for developers too.
PDF OCR — Text Recognition for Scanned PDFs
Free online PDF OCR. Upload a scanned PDF and get its text — pages without a text layer are recognized automatically, in 20+ languages. No signup, API available.
PDF Parser
Parse PDF files to extract text, metadata, and structure. Free online tool and developer API. A modern alternative to pdf-parse and pdfplumber.
Image to Markdown Converter
Convert an image to Markdown online for free. OCR screenshots and photos of documents into structured Markdown text — or automate it via the API.