Document OCR

OCR اسناد فارسی و انگلیسی — OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.

Interactive Sample Demo

برای مدیر: نتیجه کسب‌وکار

قبل

ثبت دستی اسکن و تایپ متن از تصویر؛ صفحات فارسی و مختلط معمولاً خراب می‌شوند.

بعد

یک تصویر تا ۵ مگابایت به PDF قابل جستجو و فایل UTF-8 تبدیل می‌شود؛ فایل آپلودشده ذخیره پایدار نمی‌شود.

  • PaddleOCR-VL-1.6
  • فارسی + انگلیسی
  • PDF قابل جستجو
  • بدون ذخیره پایدار

«یک اسکن، یک PDF قابل جستجو — بدون نگهداری فایل روی سرور عمومی.»

— Document Operations (ناشناس)

مستندات عمومی

چه می‌کند؟

Document OCR یکی از محصولات پورتفولیوی هوش مصنوعی آریا اِی‌آی است. نسخه عمومی روی Hugging Face یک دموی نمونه است؛ نسخه تولید با یکپارچه‌سازی داده، SSO و audit trail استقرار می‌یابد.

OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.

درخواست پایلوت از طریق فرم تماس سایت با ذکر علاقه به Document OCR ثبت می‌شود تا محدوده داده، قیود و معیار موفقیت مشخص گردد.

چه کسی از آن استفاده می‌کند؟

مالی، بایگانی، دبیرخانه، حقوقی و تیم‌هایی که باید متن اسکن را در ERP یا بایگانی دیجیتال بگذارند.

خروجی دمو «نمونه تعاملی» است؛ آپلود زنده فایل سازمانی روی Space عمومی توصیه نمی‌شود.

کاربرد در صنایع

مالی و حسابداری

تبدیل فاکتور و رسید اسکن‌شده به متن قابل جستجو.

دبیرخانه

ورود نامه و فرم کاغذی به گردش دیجیتال.

حقوقی

متن‌گذاری قرارداد و پیوست اسکن‌شده.

منابع انسانی

استخراج متن از مدارک پرسنلی.

بایگانی سازمانی

ساخت لایه متن پنهان روی تصویر اصلی.

خدمات مشتری

خواندن فرم و درخواست المانی از اسکن.

برای مهندس: Pipeline و معماری

Upload image → resize ≤1920px → PaddleOCR-VL-1.6 on ZeroGPU → searchable PDF + UTF-8 txt

ocrdocumentpersianfarsienglishpdf

معماری مرجع از README اسپیس روی Hugging Face پیروی می‌کند. استقرار تولید با Docker، متغیر محیطی و اتصال به سامانه موجود انجام می‌شود.

پشته فنی

  • Python
  • Transformers
  • PaddleOCR-VL-1.6
  • Gradio
  • ZeroGPU
  • Docker

متریک‌های قابل بازتولید

بنچمارکجزئیاتنتیجه
ModelPaddleOCR-VL-1.6ZeroGPU
InputJPG/PNG/WEBP/BMP/TIFF1 image
Limitmax 5 MBlongest side 1920
Privacytemp dir onlyno persist

سوالات پرتکرار

Document OCR چیست و چه مسئله‌ای را حل می‌کند؟

OCR عمومی اسناد فارسی و انگلیسی با خروجی PDF قابل جستجو و فایل متن یونیکد.

آیا می‌توان داده واقعی سازمان را در دمو عمومی وارد کرد؟

خیر. دمو عمومی برای نمونه‌های ازپیش‌محاسبه‌شده یا داده ترکیبی است. داده production باید در استقرار on-prem یا VPC با کنترل دسترسی وارد شود.

آیا این محصول جایگزین سامانه فعلی می‌شود؟

نمونه اولیه (POC) برای نمایش OCR اسناد است. برای حجم بالا، چندصفحه PDF و استقرار داخل سازمان پایلوت on-prem توصیه می‌شود.

متریک‌های صفحه از کجا آمده‌اند؟

از README و کارت مدل/اسپیس روی Hugging Face؛ اعداد بنچمارک را با داده سازمان خود در پایلوت بازسنجی کنید.

لینک‌های Hugging Face

درخواست پایلوت

برای استقرار on-prem، یکپارچه‌سازی با سامانه‌های موجود یا fine-tune روی داده سازمان خود تماس بگیرید.